Welke nieuwe AI-modellen moeten ontwikkelaars kennen in april 2026?
De eerste week van april 2026 bracht een uitzonderlijke dichtheid aan modelreleases — van Googles open-weight Gemma 4-familie tot IBM's compacte document-parsing VLM, Alibaba's million-token codeermodel en Netflix' eerste open-source videogenerator. Dit zijn de releases die het meest uitmaken voor ontwikkelaars die echte applicaties bouwen.
Gemma 4: open-weight multimodaal voor iedereen
Google DeepMind bracht Gemma 4 uit op 2 april in vier formaten: 2B, 4B, 31B dense en een 26B Mixture-of-Experts-variant met slechts 4B actieve parameters. Alle zijn gelicenseerd onder Apache 2.0 en verwerken van nature tekst, beeld en audio on-device.
Het 31B-model behaalt een LMArena-score van 1452, scoort 85,2% op MMLU Pro en 80,0% op LiveCodeBench v6. De MoE-variant haalt vrijwel dezelfde kwaliteit (1441) terwijl het dramatisch goedkoper draait. Belangrijke architecturale innovaties zijn alternerende sliding-window en global attention-lagen, Dual RoPE, Per-Layer Embeddings en een gedeelde KV-cache.
Waarom het ertoe doet: Een open-weight model dat tekst, afbeeldingen en audio in één pakket verwerkt, elimineert de noodzaak voor multi-model pipelines. De MoE-variant maakt dit toegankelijk op consumentenhardware.
Granite 4.0 3B Vision: document-AI in 3 miljard parameters
IBM's Granite 4.0 3B Vision wordt geleverd als een LoRA-adapter bovenop Granite 4.0 Micro, met een vernieuwende DeepStack Injection-architectuur. Het routeert abstracte visuele features naar vroege Transformer-lagen en hoge-resolutie ruimtelijke details naar latere lagen.
Het resultaat: 86,4% op Chart2Summary, 92,1 op PubTablesV2 en 85,5% exact match op VAREX KVP-extractie — documentparsing-nauwkeurigheid die voorheen modellen van 5–10× groter vereiste. Met 3B parameters draait dit op edge-apparaten.
Qwen 3.6 Plus: een million-token agentic coder
Alibaba's Qwen 3.6 Plus wordt geleverd met een standaard contextvenster van 1 miljoen tokens en is geoptimaliseerd voor agentic codeerworkflows. Het evenaart Anthropics Opus 4.5 op SWEBench Pro en verslaat concurrenten op Terminal Bench. Qwen 3.5 Omni — een zustermodel — verwerkt van nature tekst, beeld, audio en video en evenaart Gemini 3.1 Pro in audiovisueel begrip.
Beide zijn beschikbaar via OpenRouter's gratis tier, waardoor ze direct toegankelijk zijn voor experimenten.
Holo3: desktop-automatiseringsagent
Holo3-35B-A3B van Hcompany is een autonome desktop computer-use agent getraind in synthetische bedrijfsomgevingen via een "agentic learning flywheel." Het behaalt 78,85% op OSWorld-Verified — state-of-the-art voor GUI-automatisering — terwijl het slechts 10B actieve parameters gebruikt van de 122B in totaal.
Ook opvallend
- [Falcon Perception & OCR](https://huggingface.co/blog/tiiuae/falcon-perception) — Compacte early-fusion modellen voor open-vocabulary grounding (68,0 Macro-F1 op SA-Co) en documentbegrip (80,3% op olmOCR). Apache 2.0.
- TTT-E2E — Astera/Nvidia/Stanford-onderzoek dat test-time training demonstreert: een 3B-model dat dynamisch zijn eigen weights bijwerkt tijdens inferentie en 128K-token contexten verwerkt met constante inferentietijd.
- Netflix VOID — Een volledig open-source videogeneratiemodel van een grote entertainmentstudio. Vereist 40GB+ VRAM maar signaleert Hollywoods commitment aan open AI.
- MAI Transcribe 1 — Microsofts spraakherkenningsmodel dat best-in-class nauwkeurigheid over 25 talen behaalt en Whisper en GPT Transcribe overtreft.
- Google Lyria 3 — Muziekgeneratie met zang, gedetailleerde bewerkingscontroles, gelicenseerde trainingsdata en ingebedde SynthID-watermerking.
De trend: open, multimodaal en efficiënt
De releases van deze week delen drie thema's: (1) open weights zijn nu de standaard voor nieuwe modelfamilies, (2) multimodale mogelijkheden — beeld, audio, video — zijn basisvereisten in plaats van premiumfeatures, en (3) efficiëntie via MoE-architecturen, LoRA-adapters en compacte modelformaten is de primaire concurrentie-as. Het tijdperk waarin je enorme rekenkracht nodig had om capabele AI te draaien loopt ten einde.
Bronnen: Hugging Face Gemma 4, IBM Granite 4 Vision, Qwen 3.6 Blog, Holo3 Blog, The Batch Issue 347
Geschreven door
AI Intel Pipeline