Meer leren over AI?
AI inzetten voor je team? In onze trainingen leer je het in 4 uur.
Dennis Claassen
AI-trainer · 35+ teams getraind
Key Takeaways
- •3 augustus 2026: Alibaba lanceert Qwen3.8-Max, een Mixture-of-Experts model met 2,4 biljoen totale parameters en 95 miljard actieve parameters per token, beschikbaar via de QwenCloud API en Vercel AI Gateway (Developers Digest).
- •Prijs: $2 per miljoen inputtokens en $6 per miljoen outputtokens — goedkoper dan de meeste frontier-modellen op API-niveau (Developers Digest).
- •Benchmarks (vendor-supplied): Alibaba rapporteert 86,1 op OSWorld-Verified (computer use) tegenover Fable 5 (85,0) en GPT-5.6 Sol Max (83,2). Alle benchmarkcijfers zijn Alibaba's eigen rapportage — onafhankelijke verificatie ontbreekt op dit moment (Neowin).
- •Open weights: worden verwacht rond 10 augustus 2026 op Hugging Face en ModelScope onder Apache 2.0 — de eerste keer dat Alibaba een Max-klasse model opensourct (Developers Digest; QwenLM GitHub).
- •Privacywaarschuwing: gebruik via de QwenCloud API stuurt uw data naar Chinese servers. Alibaba's Qwen-team werd in juni 2026 door Anthropic beschuldigd van de grootste distillatieaanval op Claude ooit — context die u moet kennen vóór u zakelijke data verwerkt (eigen analyse).
3 augustus 2026. Alibaba Cloud kondigt Qwen3.8-Max aan — een model dat op papier zowel Claude Fable 5 als GPT-5.6 Sol overtreft op agentic computergebruikstaken. Twee dingen maken dit nieuw: het is het eerste Max-klasse model dat Alibaba als open weights uitbrengt, en het klopt concurrent Kimi K3 af op agentic benchmarks terwijl Kimi K3 vorige week nog de nieuwe standaard leek te zetten.
Maar de claim "wij verslaan Fable 5" verdient een eerlijk onderzoek — het zijn Alibaba's eigen cijfers, en het zijn dezelfde Alibaba die Anthropic eerder dit jaar in een formele klacht beschuldigde van een massale poging om Claude's trainingsdata te stelen.
Wat is Qwen3.8-Max?
Qwen3.8-Max is het nieuwe topmodel van Alibaba Cloud's Qwen-reeks — de opvolger van Qwen3 en Qwen3.5. Net als Kimi K3 en DeepSeek V4 Flash gebruikt het een Mixture-of-Experts (MoE)-architectuur: de meeste parameters zijn per token inactief, wat de rekenintensiteit per inferentiestap beperkt terwijl de totale modelcapaciteit hoog blijft.
| Eigenschap | Waarde |
|---|---|
| Totale parameters | 2,4 biljoen |
| Actieve parameters per token | 95 miljard |
| Contextvenster | 1 miljoen tokens |
| Modaliteiten | Tekst + afbeeldingen + video |
| Architectuur | Mixture-of-Experts |
| API-prijs (QwenCloud) | $2/M input, $6/M output |
| Toegang | QwenCloud (model-id: qwen3.8-max), Vercel AI Gateway |
| Open weights | Verwacht ~10 augustus 2026 (Hugging Face + ModelScope) |
| Licentie | Apache 2.0 |
Bron: Developers Digest; licentietype bevestigd via QwenLM GitHub.
Het model verwerkt tekst, afbeeldingen en video — waarmee het multimodaal concurreert met GPT-5.6 Sol en Gemini 3.5 Pro. De multimodale agentic-inzet is ook het gebied waar Alibaba de meest concrete claims maakt.
De benchmark-claims: wat Alibaba zegt
Alle onderstaande scores zijn Alibaba's eigen rapportage. Onafhankelijke evaluators van Artificial Analysis en Arena.AI bekijken het model op dit moment; externe scores worden de komende week tot twee weken verwacht. Tot die tijd zijn de cijfers uitsluitend te beschouwen als vendor-claims.
Computer use (OSWorld-Verified)
OSWorld-Verified meet hoe goed een model zelfstandig computerinterfaces bedient — vensters openen, formulieren invullen, bestanden beheren zonder menselijke tussenkomst.
| Model | OSWorld-Verified |
|---|---|
| Qwen3.8-Max | 86,1 |
| Claude Fable 5 | 85,0 |
| GPT-5.6 Sol Max | 83,2 |
Als deze score standhoudt bij onafhankelijke evaluatie, is dit vandaag het sterkste model op UI-automatisering — een groeiend use case in backoffice-automatisering.
Coding en software-engineering
| Benchmark | Qwen3.8-Max | Referentie (GPT-5.6 Sol Max) |
|---|---|---|
| Terminal-Bench 2.1 | 86,6 | 88,8 |
| SWE-bench Pro | 67,7 | — |
| FrontierSWE | 73,5 | — |
| PaperBench | 93,0 | — |
| CoWorkBench | 74,8 | — |
Bron: Neowin; VentureBeat.
Op Terminal-Bench scoort GPT-5.6 Sol Max nog altijd hoger dan Qwen3.8-Max (88,8 vs 86,6). De claim dat Qwen3.8-Max "Fable 5 en GPT-5.6 Sol verslaat" is dus selectief: op computer use en een deel van de coding-benchmarks scoort het hoger, maar niet op alle taken.
Beschikbaarheid en prijs
Qwen3.8-Max is per 3 augustus 2026 beschikbaar via:
- •QwenCloud API — $2/M inputtokens, $6/M outputtokens
- •Vercel AI Gateway (
alibaba/qwen3.8-max) — zelfde tarieven - •Qwen Chat — consumenteninterface
De API-prijs van $2/$6 is competitief. Voor vergelijkbare frontier-class agentic modellen liggen de outputkosten doorgaans tussen $10 en $20 per miljoen tokens. Dat maakt Qwen3.8-Max interessant voor high-volume-agentic-toepassingen — áls de kwaliteit voor uw specifieke use case voldoet.
Open weights: wanneer en hoe?
Alibaba heeft aangekondigd dat de weights van Qwen3.8-Max én een kleinere variant (Qwen3.8-27B) volgende week worden gepubliceerd op Hugging Face en ModelScope (Developers Digest).
De licentie wordt Apache 2.0 — consistent met alle eerdere Qwen open-weight releases (QwenLM GitHub). Apache 2.0 is de meest permissieve open-source licentie: commercieel gebruik, fine-tunen en herdistributie zijn vrij toegestaan, ook voor grote bedrijven. Geen omzetdrempel, geen aparte overeenkomst nodig — anders dan de Kimi K3-licentie.
Dit is historisch: het is de eerste keer dat Alibaba een Max-klasse frontiermodel opensourct. Als de weights op ~10 augustus live gaan, maakt dat Qwen3.8-Max zelfhostbaar in uw eigen Europese infrastructuur — wat het privacyvraagstuk dat hieronder volgt wezenlijk anders kleurt.
Wat betekent dit voor Nederlandse bedrijven?
Als u agentic workflows of UI-automatisering bouwt
Als de OSWorld-Verified-score (86,1) standhoudt bij onafhankelijke evaluatie, is Qwen3.8-Max vandaag het sterkste beschikbare model voor computer-use-automatisering. Dit type gebruik — browseragents, formulierverwerking, backoffice-RPA — is een groeiend toepassingsgebied. Maar wacht op externe evaluatie voordat u hierop een vendorkeuze baseert.
Als u maximale coding-prestatie zoekt
Kimi K3 (Moonshot AI, uitgebracht 27 juli 2026) scoort op externe coding-benchmarks zoals SWE Marathon (42,0) nog steeds hoger dan Qwen3.8-Max op vergelijkbare taken. Voor pure software-engineering-agents is Kimi K3 momenteel de betere keuze op basis van onafhankelijke data.
Als data-soevereiniteit een vereiste is
De API-route is voor privacygevoelige data geen optie zolang er geen Apache 2.0-weights zijn. Zodra de open weights beschikbaar zijn (~10 augustus), kunt u het model draaien via een EU-gebaseerde inferentiepartner of in uw eigen infrastructuur. Dan verlaat uw data de EU niet.
Beslissingsschema
| Situatie | Aanbeveling |
|---|---|
| Agentic / computer-use prototyping, niet-gevoelige data | Test QwenCloud API |
| Gevoelige bedrijfsdata | Wacht op open weights + EU-inferentiepartner (~10 aug) |
| Maximale coding-prestatie vandaag | Kimi K3 via EU inference |
| Budget-bewuste brede zakelijke taken | Claude Sonnet 5 (brede NL tooling-integratie) |
| Self-hosting agentic AI in Europa | Open weights ~10 aug: Apache 2.0, geen restricties |
De Alibaba-context: wat u moet weten
Twee maanden geleden beschuldigde Anthropic Alibaba van de grootste bekende distillatieaanval op Claude: via circa 25.000 nep-accounts werden 28,8 miljoen Claude-gesprekken onderschept om Qwen-modellen te trainen. De beschuldiging staat in een formele brief aan het Amerikaanse Senaatscomité voor Bankzaken. Er is geen rechtelijke uitspraak, maar de beschuldiging is ernstig en relevant. We schreven er uitgebreid over: Anthropic beschuldigt Alibaba van distillatieaanval op Claude.
Dit verandert niets aan de technische kwaliteit van het model zelf, maar het is de context waarbinnen u een zakelijke afhankelijkheid van het QwenCloud-platform afweegt.
De privacyvereiste is concreet: als u de QwenCloud API gebruikt, worden uw data verwerkt door servers die worden beheerd door een in China gevestigde onderneming. China valt niet onder een EU-adequaatheidsbeslissing. Voor AVG-plichtige gegevens — klantdata, HR, contracten, financiële informatie — is gebruik via de Chinese API juridisch riskant.
Zodra de Apache 2.0-weights beschikbaar zijn, verandert dit: u kunt het model dan zelfhosten bij een Europees platform zoals Scaleway of OVHcloud, en data verlaat de EU niet.
Eerlijk perspectief
Qwen3.8-Max heeft drie echte sterktes:
- •Prijs: $2/$6 per M tokens is de laagste prijs in zijn prestatieklas.
- •Computer-use: een score van 86,1 op OSWorld-Verified is — áls hij standhoudt — vandaag de hoogste van een frontiermodel.
- •Open weights + Apache 2.0: meest permissieve licentie in zijn klasse, volgende week beschikbaar.
Maar drie voorbehouden horen bij het volledige beeld:
- •Alle benchmarks zijn vendor-supplied — wacht op Artificial Analysis en Arena.AI voor onafhankelijke evaluatie.
- •De API is niet geschikt voor gevoelige data — zie het privacygedeelte hierboven. De Apache 2.0-weights veranderen dat wanneer ze live gaan.
- •GPT-5.6 Sol Max scoort nog hoger op Terminal-Bench (88,8 vs 86,6) — de claim dat Qwen3.8-Max "GPT-5.6 verslaat" is niet universeel.
De kernboodschap voor Nederlandse bedrijven: dit is een serieus model en $2/$6 per M tokens is een eerlijke prijs. Maar evalueer het op uw eigen use case, wacht op onafhankelijke benchmarks voor productiebeslissingen, en regel de dataprivacy via open weights zodra die beschikbaar zijn.
Veelgestelde vragen
Wat is Alibaba Qwen3.8-Max?
Qwen3.8-Max is het nieuwe topmodel van Alibaba Cloud's Qwen-reeks, uitgebracht op 3 augustus 2026. Het is een Mixture-of-Experts (MoE)-model met 2,4 biljoen totale parameters en 95 miljard actieve parameters per token. Het model is multimodaal (tekst, afbeeldingen, video) en heeft een contextvenster van 1 miljoen tokens. Het is nu beschikbaar via de QwenCloud API voor $2 per miljoen inputtokens en $6 per miljoen outputtokens. Open weights volgen rond 10 augustus 2026 op Hugging Face onder Apache 2.0-licentie. Bron: Developers Digest (3 augustus 2026).
Is Qwen3.8-Max beter dan Claude Fable 5?
Alibaba claimt dat Qwen3.8-Max Claude Fable 5 overtreft op twee agentic benchmarks: OSWorld-Verified (86,1 vs 85,0) en Terminal-Bench 2.1 (86,6 vs 84,6). Deze cijfers zijn echter Alibaba's eigen rapportage — onafhankelijke evaluatie door derde partijen zoals Artificial Analysis en Arena.AI was op 4 augustus 2026 nog niet beschikbaar. Op Terminal-Bench scoort GPT-5.6 Sol Max nog hoger dan Qwen3.8-Max (88,8 vs 86,6), dus de claim "verslaat alle concurrenten" is selectief. Bron: Neowin; VentureBeat (augustus 2026).
Wanneer zijn de open weights van Qwen3.8-Max beschikbaar?
Alibaba kondigde aan dat de weights van Qwen3.8-Max en een kleinere variant (Qwen3.8-27B) rond 10 augustus 2026 worden gepubliceerd op Hugging Face en ModelScope. De licentie is Apache 2.0 — de meest permissieve open-source licentie, zonder omzetdrempel. Dit is de eerste keer dat Alibaba een Max-klasse (frontiermodel) opensourct. Bron: Developers Digest (3 augustus 2026); QwenLM GitHub.
Is het veilig voor Nederlandse bedrijven om Qwen3.8-Max via de API te gebruiken?
Voor niet-gevoelige data (openbare informatie, niet-persoonsgebonden teksten) is de QwenCloud API bruikbaar. Voor privacygevoelige data — klantgegevens, HR-informatie, contracten, financiële data — is gebruik via de Chinese API een AVG-risico: China heeft geen EU-adequaatheidsbeslissing, en data gaat naar servers beheerd door een Chinese onderneming. Zodra de Apache 2.0-weights beschikbaar zijn (~10 augustus), kunt u het model draaien via een Europese inferentiepartner zodat data de EU niet verlaat. Aanvullend context: Anthropic beschuldigde Alibaba's Qwen-team in juni 2026 van de grootste bekende distillatieaanval op Claude.
Wat kost Qwen3.8-Max in vergelijking met andere AI-modellen?
Qwen3.8-Max kost $2 per miljoen inputtokens en $6 per miljoen outputtokens via QwenCloud (per 4 augustus 2026). De outputprijs van $6/M is lager dan de meeste frontier-class modellen, die doorgaans tussen $10 en $20/M output liggen. Dit maakt het interessant voor high-volume agentic toepassingen. Vergelijkend: Kimi K3 (Moonshot AI) kost $3/$15/M tokens, en de meeste Claude- en GPT-5.6-varianten liggen boven $10/M output. Bron: Developers Digest (3 augustus 2026).

