Nieuws

Alibaba Qwen3.8-Max: het grootste open-weight agentic model van China — eerlijke analyse

Op 3 augustus 2026 lanceerde Alibaba Qwen3.8-Max: een 2,4-biljoen-parameters MoE-model dat op basis van eigen benchmarks beweert Claude Fable 5 en GPT-5.6 Sol te verslaan op agentic taken. De API is beschikbaar voor $2/$6 per miljoen tokens; open weights volgen volgende week onder Apache 2.0. Eerlijke analyse inclusief de Alibaba-context die u als Nederlands bedrijf moet kennen.

Dennis ClaassenDennis Claassen8 min lezen
Alibaba Cloud AI-logo naast een vergelijkingstabel van Qwen3.8-Max met Claude Fable 5 en GPT-5.6 Sol op agentic benchmarks, met een EU-privacyvlag als context voor Nederlandse bedrijven

Meer leren over AI?

AI inzetten voor je team? In onze trainingen leer je het in 4 uur.

Dennis Claassen

Dennis Claassen

AI-trainer · 35+ teams getraind

Bekijk trainingen

Key Takeaways

  • 3 augustus 2026: Alibaba lanceert Qwen3.8-Max, een Mixture-of-Experts model met 2,4 biljoen totale parameters en 95 miljard actieve parameters per token, beschikbaar via de QwenCloud API en Vercel AI Gateway (Developers Digest).
  • Prijs: $2 per miljoen inputtokens en $6 per miljoen outputtokens — goedkoper dan de meeste frontier-modellen op API-niveau (Developers Digest).
  • Benchmarks (vendor-supplied): Alibaba rapporteert 86,1 op OSWorld-Verified (computer use) tegenover Fable 5 (85,0) en GPT-5.6 Sol Max (83,2). Alle benchmarkcijfers zijn Alibaba's eigen rapportage — onafhankelijke verificatie ontbreekt op dit moment (Neowin).
  • Open weights: worden verwacht rond 10 augustus 2026 op Hugging Face en ModelScope onder Apache 2.0 — de eerste keer dat Alibaba een Max-klasse model opensourct (Developers Digest; QwenLM GitHub).
  • Privacywaarschuwing: gebruik via de QwenCloud API stuurt uw data naar Chinese servers. Alibaba's Qwen-team werd in juni 2026 door Anthropic beschuldigd van de grootste distillatieaanval op Claude ooit — context die u moet kennen vóór u zakelijke data verwerkt (eigen analyse).

3 augustus 2026. Alibaba Cloud kondigt Qwen3.8-Max aan — een model dat op papier zowel Claude Fable 5 als GPT-5.6 Sol overtreft op agentic computergebruikstaken. Twee dingen maken dit nieuw: het is het eerste Max-klasse model dat Alibaba als open weights uitbrengt, en het klopt concurrent Kimi K3 af op agentic benchmarks terwijl Kimi K3 vorige week nog de nieuwe standaard leek te zetten.

Maar de claim "wij verslaan Fable 5" verdient een eerlijk onderzoek — het zijn Alibaba's eigen cijfers, en het zijn dezelfde Alibaba die Anthropic eerder dit jaar in een formele klacht beschuldigde van een massale poging om Claude's trainingsdata te stelen.

Wat is Qwen3.8-Max?

Qwen3.8-Max is het nieuwe topmodel van Alibaba Cloud's Qwen-reeks — de opvolger van Qwen3 en Qwen3.5. Net als Kimi K3 en DeepSeek V4 Flash gebruikt het een Mixture-of-Experts (MoE)-architectuur: de meeste parameters zijn per token inactief, wat de rekenintensiteit per inferentiestap beperkt terwijl de totale modelcapaciteit hoog blijft.

EigenschapWaarde
Totale parameters2,4 biljoen
Actieve parameters per token95 miljard
Contextvenster1 miljoen tokens
ModaliteitenTekst + afbeeldingen + video
ArchitectuurMixture-of-Experts
API-prijs (QwenCloud)$2/M input, $6/M output
ToegangQwenCloud (model-id: qwen3.8-max), Vercel AI Gateway
Open weightsVerwacht ~10 augustus 2026 (Hugging Face + ModelScope)
LicentieApache 2.0

Bron: Developers Digest; licentietype bevestigd via QwenLM GitHub.

Het model verwerkt tekst, afbeeldingen en video — waarmee het multimodaal concurreert met GPT-5.6 Sol en Gemini 3.5 Pro. De multimodale agentic-inzet is ook het gebied waar Alibaba de meest concrete claims maakt.

De benchmark-claims: wat Alibaba zegt

Alle onderstaande scores zijn Alibaba's eigen rapportage. Onafhankelijke evaluators van Artificial Analysis en Arena.AI bekijken het model op dit moment; externe scores worden de komende week tot twee weken verwacht. Tot die tijd zijn de cijfers uitsluitend te beschouwen als vendor-claims.

Computer use (OSWorld-Verified)

OSWorld-Verified meet hoe goed een model zelfstandig computerinterfaces bedient — vensters openen, formulieren invullen, bestanden beheren zonder menselijke tussenkomst.

ModelOSWorld-Verified
Qwen3.8-Max86,1
Claude Fable 585,0
GPT-5.6 Sol Max83,2

Als deze score standhoudt bij onafhankelijke evaluatie, is dit vandaag het sterkste model op UI-automatisering — een groeiend use case in backoffice-automatisering.

Coding en software-engineering

BenchmarkQwen3.8-MaxReferentie (GPT-5.6 Sol Max)
Terminal-Bench 2.186,688,8
SWE-bench Pro67,7
FrontierSWE73,5
PaperBench93,0
CoWorkBench74,8

Bron: Neowin; VentureBeat.

Op Terminal-Bench scoort GPT-5.6 Sol Max nog altijd hoger dan Qwen3.8-Max (88,8 vs 86,6). De claim dat Qwen3.8-Max "Fable 5 en GPT-5.6 Sol verslaat" is dus selectief: op computer use en een deel van de coding-benchmarks scoort het hoger, maar niet op alle taken.

Beschikbaarheid en prijs

Qwen3.8-Max is per 3 augustus 2026 beschikbaar via:

  • QwenCloud API — $2/M inputtokens, $6/M outputtokens
  • Vercel AI Gateway (alibaba/qwen3.8-max) — zelfde tarieven
  • Qwen Chat — consumenteninterface

De API-prijs van $2/$6 is competitief. Voor vergelijkbare frontier-class agentic modellen liggen de outputkosten doorgaans tussen $10 en $20 per miljoen tokens. Dat maakt Qwen3.8-Max interessant voor high-volume-agentic-toepassingen — áls de kwaliteit voor uw specifieke use case voldoet.

Open weights: wanneer en hoe?

Alibaba heeft aangekondigd dat de weights van Qwen3.8-Max én een kleinere variant (Qwen3.8-27B) volgende week worden gepubliceerd op Hugging Face en ModelScope (Developers Digest).

De licentie wordt Apache 2.0 — consistent met alle eerdere Qwen open-weight releases (QwenLM GitHub). Apache 2.0 is de meest permissieve open-source licentie: commercieel gebruik, fine-tunen en herdistributie zijn vrij toegestaan, ook voor grote bedrijven. Geen omzetdrempel, geen aparte overeenkomst nodig — anders dan de Kimi K3-licentie.

Dit is historisch: het is de eerste keer dat Alibaba een Max-klasse frontiermodel opensourct. Als de weights op ~10 augustus live gaan, maakt dat Qwen3.8-Max zelfhostbaar in uw eigen Europese infrastructuur — wat het privacyvraagstuk dat hieronder volgt wezenlijk anders kleurt.

Wat betekent dit voor Nederlandse bedrijven?

Als u agentic workflows of UI-automatisering bouwt

Als de OSWorld-Verified-score (86,1) standhoudt bij onafhankelijke evaluatie, is Qwen3.8-Max vandaag het sterkste beschikbare model voor computer-use-automatisering. Dit type gebruik — browseragents, formulierverwerking, backoffice-RPA — is een groeiend toepassingsgebied. Maar wacht op externe evaluatie voordat u hierop een vendorkeuze baseert.

Als u maximale coding-prestatie zoekt

Kimi K3 (Moonshot AI, uitgebracht 27 juli 2026) scoort op externe coding-benchmarks zoals SWE Marathon (42,0) nog steeds hoger dan Qwen3.8-Max op vergelijkbare taken. Voor pure software-engineering-agents is Kimi K3 momenteel de betere keuze op basis van onafhankelijke data.

Als data-soevereiniteit een vereiste is

De API-route is voor privacygevoelige data geen optie zolang er geen Apache 2.0-weights zijn. Zodra de open weights beschikbaar zijn (~10 augustus), kunt u het model draaien via een EU-gebaseerde inferentiepartner of in uw eigen infrastructuur. Dan verlaat uw data de EU niet.

Beslissingsschema

SituatieAanbeveling
Agentic / computer-use prototyping, niet-gevoelige dataTest QwenCloud API
Gevoelige bedrijfsdataWacht op open weights + EU-inferentiepartner (~10 aug)
Maximale coding-prestatie vandaagKimi K3 via EU inference
Budget-bewuste brede zakelijke takenClaude Sonnet 5 (brede NL tooling-integratie)
Self-hosting agentic AI in EuropaOpen weights ~10 aug: Apache 2.0, geen restricties

De Alibaba-context: wat u moet weten

Twee maanden geleden beschuldigde Anthropic Alibaba van de grootste bekende distillatieaanval op Claude: via circa 25.000 nep-accounts werden 28,8 miljoen Claude-gesprekken onderschept om Qwen-modellen te trainen. De beschuldiging staat in een formele brief aan het Amerikaanse Senaatscomité voor Bankzaken. Er is geen rechtelijke uitspraak, maar de beschuldiging is ernstig en relevant. We schreven er uitgebreid over: Anthropic beschuldigt Alibaba van distillatieaanval op Claude.

Dit verandert niets aan de technische kwaliteit van het model zelf, maar het is de context waarbinnen u een zakelijke afhankelijkheid van het QwenCloud-platform afweegt.

De privacyvereiste is concreet: als u de QwenCloud API gebruikt, worden uw data verwerkt door servers die worden beheerd door een in China gevestigde onderneming. China valt niet onder een EU-adequaatheidsbeslissing. Voor AVG-plichtige gegevens — klantdata, HR, contracten, financiële informatie — is gebruik via de Chinese API juridisch riskant.

Zodra de Apache 2.0-weights beschikbaar zijn, verandert dit: u kunt het model dan zelfhosten bij een Europees platform zoals Scaleway of OVHcloud, en data verlaat de EU niet.

Eerlijk perspectief

Qwen3.8-Max heeft drie echte sterktes:

  1. Prijs: $2/$6 per M tokens is de laagste prijs in zijn prestatieklas.
  2. Computer-use: een score van 86,1 op OSWorld-Verified is — áls hij standhoudt — vandaag de hoogste van een frontiermodel.
  3. Open weights + Apache 2.0: meest permissieve licentie in zijn klasse, volgende week beschikbaar.

Maar drie voorbehouden horen bij het volledige beeld:

  • Alle benchmarks zijn vendor-supplied — wacht op Artificial Analysis en Arena.AI voor onafhankelijke evaluatie.
  • De API is niet geschikt voor gevoelige data — zie het privacygedeelte hierboven. De Apache 2.0-weights veranderen dat wanneer ze live gaan.
  • GPT-5.6 Sol Max scoort nog hoger op Terminal-Bench (88,8 vs 86,6) — de claim dat Qwen3.8-Max "GPT-5.6 verslaat" is niet universeel.

De kernboodschap voor Nederlandse bedrijven: dit is een serieus model en $2/$6 per M tokens is een eerlijke prijs. Maar evalueer het op uw eigen use case, wacht op onafhankelijke benchmarks voor productiebeslissingen, en regel de dataprivacy via open weights zodra die beschikbaar zijn.

Veelgestelde vragen

Wat is Alibaba Qwen3.8-Max?

Qwen3.8-Max is het nieuwe topmodel van Alibaba Cloud's Qwen-reeks, uitgebracht op 3 augustus 2026. Het is een Mixture-of-Experts (MoE)-model met 2,4 biljoen totale parameters en 95 miljard actieve parameters per token. Het model is multimodaal (tekst, afbeeldingen, video) en heeft een contextvenster van 1 miljoen tokens. Het is nu beschikbaar via de QwenCloud API voor $2 per miljoen inputtokens en $6 per miljoen outputtokens. Open weights volgen rond 10 augustus 2026 op Hugging Face onder Apache 2.0-licentie. Bron: Developers Digest (3 augustus 2026).

Is Qwen3.8-Max beter dan Claude Fable 5?

Alibaba claimt dat Qwen3.8-Max Claude Fable 5 overtreft op twee agentic benchmarks: OSWorld-Verified (86,1 vs 85,0) en Terminal-Bench 2.1 (86,6 vs 84,6). Deze cijfers zijn echter Alibaba's eigen rapportage — onafhankelijke evaluatie door derde partijen zoals Artificial Analysis en Arena.AI was op 4 augustus 2026 nog niet beschikbaar. Op Terminal-Bench scoort GPT-5.6 Sol Max nog hoger dan Qwen3.8-Max (88,8 vs 86,6), dus de claim "verslaat alle concurrenten" is selectief. Bron: Neowin; VentureBeat (augustus 2026).

Wanneer zijn de open weights van Qwen3.8-Max beschikbaar?

Alibaba kondigde aan dat de weights van Qwen3.8-Max en een kleinere variant (Qwen3.8-27B) rond 10 augustus 2026 worden gepubliceerd op Hugging Face en ModelScope. De licentie is Apache 2.0 — de meest permissieve open-source licentie, zonder omzetdrempel. Dit is de eerste keer dat Alibaba een Max-klasse (frontiermodel) opensourct. Bron: Developers Digest (3 augustus 2026); QwenLM GitHub.

Is het veilig voor Nederlandse bedrijven om Qwen3.8-Max via de API te gebruiken?

Voor niet-gevoelige data (openbare informatie, niet-persoonsgebonden teksten) is de QwenCloud API bruikbaar. Voor privacygevoelige data — klantgegevens, HR-informatie, contracten, financiële data — is gebruik via de Chinese API een AVG-risico: China heeft geen EU-adequaatheidsbeslissing, en data gaat naar servers beheerd door een Chinese onderneming. Zodra de Apache 2.0-weights beschikbaar zijn (~10 augustus), kunt u het model draaien via een Europese inferentiepartner zodat data de EU niet verlaat. Aanvullend context: Anthropic beschuldigde Alibaba's Qwen-team in juni 2026 van de grootste bekende distillatieaanval op Claude.

Wat kost Qwen3.8-Max in vergelijking met andere AI-modellen?

Qwen3.8-Max kost $2 per miljoen inputtokens en $6 per miljoen outputtokens via QwenCloud (per 4 augustus 2026). De outputprijs van $6/M is lager dan de meeste frontier-class modellen, die doorgaans tussen $10 en $20/M output liggen. Dit maakt het interessant voor high-volume agentic toepassingen. Vergelijkend: Kimi K3 (Moonshot AI) kost $3/$15/M tokens, en de meeste Claude- en GPT-5.6-varianten liggen boven $10/M output. Bron: Developers Digest (3 augustus 2026).

Tags
ai-modellenopen-source-aialibabaqwenagentic-aidata-soevereiniteitbenchmarkchinese-ai
Dennis Claassen
Geschreven door

Dennis Claassen

Founder & AI Trainer

Dennis is de oprichter van Project Impact en traint Nederlandse bedrijven in het effectief gebruiken van AI. Met jarenlange ervaring in tech en onderwijs helpt hij teams om AI praktisch toe te passen.

Gerelateerde Artikelen

Meer interessante artikelen over dit onderwerp

Serverracks in een datacenter naast een scherm met Claude Code-interface — Claude Code self-hosted environments draaien op uw eigen infrastructuur
Nieuws

Claude Code op uw eigen servers: Anthropic lanceert self-hosted omgevingen en compliance-hooks

Binnen vier dagen na het begin van de EU AI Act-handhaving lanceerde Anthropic twee enterprise-features: Claude Code-sessies draaien voortaan op uw eigen servers, en elke medewerkersbijdrage wordt via uw eigen DLP-server gerouteerd vóórdat het model die ziet. Geen toeval, wel relevant.

6 min lezen
Abstracte weergave van een leiderschapswisseling bij een grote AI-organisatie: twee silhouetten waarbij één een stap opzij doet en een ander naar voren treedt, op een achtergrond van Googles blauw-rood kleurenpalet
Nieuws

Aardverschuiving bij Google AI: Hassabis stapt op als DeepMind-CEO, Jeff Dean vertrekt met vier topwetenschappers

Op 5 augustus 2026 kondigde Google aan dat Demis Hassabis aftreedt als CEO van Google DeepMind en dat chief scientist Jeff Dean het bedrijf na 27 jaar verlaat. Hassabis wordt chairman en chief scientist bij Alphabet; DeepMind-CTO Koray Kavukcuoglu neemt de dagelijkse leiding over. Dean vertrekt samen met drie topwetenschappers om Discovery Loop op te richten: een startup gericht op AI-versneld wetenschappelijk onderzoek. Voor Nederlandse bedrijven die op Gemini of Google AI vertrouwen, stelt dit een directe vraag: wat verandert er?

7 min lezen
NVIDIA Vera Rubin chips naast de Noorse vlag en een datacenterrij — beeld voor de Anthropic Volta compute-deal van $10 miljard in Tydal, Noorwegen (augustus 2026)
Nieuws

Anthropic sluit $10 miljard compute-deal in Noorwegen — wat het betekent voor uw Claude-gebruik

Op 4 augustus 2026 sloot Anthropic een contract van $10 miljard met Volta Infra voor 121 megawatt NVIDIA Vera Rubin-capaciteit in Tydal, Noorwegen — aangedreven op waterkracht. De deal vergroot Claude's capaciteit aanzienlijk, maar capaciteit komt pas beschikbaar vanaf december 2026. Ondertussen staat Anthropic's uptimecijfer op 99,36% — onder de standaard van 99,9% voor enterprise-contracten. Dit is wat u nu moet weten.

7 min lezen

AI leren toepassen in je bedrijf?

Ontdek onze praktische AI trainingen voor teams.