Senast uppdaterad: 2026-09-08
Qwen ai gratis: konsumentchatten Qwen Chat kostar ingenting, och API:et börjar på $0.15 per miljon indatatokens. Qwen är Alibaba Clouds familj av stora språkmodeller med öppna vikter, med både täta modeller och Mixture-of-Experts, från 0,5 miljarder till över 2 000 miljarder parametrar. Det aktuella flaggskeppet aktiverar cirka 95 miljarder parametrar per steg av totalt 2 400 miljarder. Det matchar frontmodellerna på kod och matematik till en bråkdel av beräkningskostnaden. De flesta mindre vikterna går att köra själv kommersiellt utan avgift.
Om Qwen
Qwen (kort för Tongyi Qianwen) är Alibaba Clouds familj av stora språkmodeller och AI-chattassistent. Den lanserades som beta i april 2023 och öppnades för allmänheten i september samma år. I februari 2026 hade Qwen 203 miljoner aktiva användare i månaden, en ökning med 554 % på en enda månad. Modellfamiljen blev den mest nedladdade familjen med öppna vikter på Hugging Face. Den hade över 700 miljoner nedladdningar i januari 2026 och gick därmed förbi Metas Llama i totalt antal nedladdningar.
Modellerna spänner från 0,5 miljarder till över 1 000 miljarder parametrar, med både täta modeller och Mixture-of-Experts. Flaggskeppet Qwen3-235B aktiverar bara 22 miljarder parametrar per steg, vilket håller inferenskostnaden nere. Qwen Chat, den kostnadsfria konsumentappen på chat.qwen.ai, finns som klient för iOS, Android, Windows och macOS. Utvecklare når samma modeller via Alibaba Clouds Model Studio (DashScope), ett OpenAI-kompatibelt API. De flesta vikterna släpps under en öppen licens, så du kan köra dem själv utan royalty.
Den senaste utgåvan, Qwen 3.6-Plus, kom den 2 april 2026. Utgivningstakten är hög, och Qwen har hållit jämna steg med västerländska frontlabb trots USA:s exportbegränsningar på chip.
Skärmbilder

Priser
Gratisnivå: 1M tokens per modell i 90 dagar efter att du aktiverat Model Studio. 47/M för utdata. 80 över det).
00/M för utdata. Konsumentappen Qwen Chat är fortsatt gratis.
| Plan | Pris per månad | Det här ingår |
|---|---|---|
| Qwen Chat (Free) | Gratis | |
| Qwen3.8-Flash API | Gratis | per token |
| Qwen3.7-Plus API | Gratis | per token, nivåprissättning över 256K |
| Qwen3.8-Max API | Gratis | per token |
Funktioner per plan
| Funktion | Qwen3.8-Max API | Qwen Chat (Free) | Qwen3.7-Plus API | Qwen3.8-Flash API |
|---|---|---|---|---|
| Kontextfönster | 1M (262K nativt) | 128K | 1M (nivåprissatt över 256K) | 1M |
| Kostnad för indatatokens | $2.00/M | Gratis | $0.40/M (≤256K) | $0.15/M |
| Kostnad för utdatatokens | $6.00/M | Gratis | $1.60/M (≤256K) | $0.47/M |
Viktigaste funktionerna
- Hybridt tänkande: Du växlar mellan ett snabbt läge utan resonemang för korta svar och ett långsamt, noggrant resonemangsläge för svåra uppgifter. Med en enda reglage styr du balansen mellan fart och djup.
- Kontextfönster på 1M tokens: API:et på Plus-nivån ger ett kontextfönster på 1 miljon tokens och upp till 65 536 utdatatokens. Det räcker för att analysera en hel kodbas eller en bokstor text i ett enda anrop.
- Multimodal inmatning: text, bild, ljud och video: Qwen Chat hanterar text, bildförståelse via Qwen2.5-VL, ljudinmatning via Qwen2.5-Audio (tal, musik och naturljud) och videoförståelse, allt i samma chattgränssnitt.
- Stöd för över 119 språk: Qwen3-modellerna stöder 119 språk och dialekter, och Qwen3.5 utökar täckningen till 201 språk. Det gör familjen till en av de språkligt bredaste bland stora språkmodeller.
- Kodning i 92 programmeringsspråk: Qwen2.5-Coder är tränad på 5,5 tusen miljarder tokens och stöder 92 programmeringsspråk. Modellen nådde 69,6 % på SWE-bench Verified, vilket placerar den bland de bästa kodmodellerna med öppna vikter.
- MoE-arkitekturen i Qwen 3.6 med dubbel genomströmning: Qwen 3.6 använder en mogen Mixture-of-Experts-arkitektur med gles aktivering och AITemplate-kernelfusion. Det ger ungefär dubbelt så hög inferensgenomströmning som Qwen 2.5 på jämförbar hårdvara.
- Qwen Max: 2 400 miljarder parametrar, nu allmänt tillgänglig: Alibaba gjorde sin flaggskeppsmodell Max allmänt tillgänglig i augusti 2026. Det är en multimodal MoE-modell med 2 400 miljarder parametrar som aktiverar 95 miljarder per token. Den prissätts nu med vanliga tokenpriser via Alibaba Cloud Model Studio.
- Qwen 3.6: sex storlekar och royaltyfri licens: Qwen 3.6 släpptes i maj 2026 i sex storlekar under en öppen licens. Företag kan driftsätta modellerna fritt i kommersiell miljö och välja storlek efter uppgiftens krav och sin beräkningsbudget.
Fördelar
- Den mest nedladdade modellfamiljen med öppna vikter i världen, med 700M nedladdningar på Hugging Face i januari 2026. Det ger en stor community, många finjusterade varianter och aktivt stöd från tredje part.
- API-priserna är klart lägre än hos de ledande alternativen, ungefär 40 gånger lägre än GPT-4o för indatatokens. Det gör Qwen användbar för produktionsflöden med stora volymer.
- Den öppna licensen innebär ingen inlåsning vid egen drift. Llamas egna licens sätter i stället ett tak för gratis kommersiell användning vid ett fast antal aktiva användare i månaden.
- Hybridläget låter utvecklare välja resonemangsdjup per fråga. Det är ett konkret sätt att spara kostnad som GPT-4o och Claudes basmodeller saknar.
- Modellen på Plus-nivån delar resultatet 72,4 på SWE-bench Verified med GPT-5 mini. Kodprestandan ligger alltså på frontnivå utan frontpriser.
Nackdelar
- Qwen-modellerna vägrar svara på frågor som strider mot den kinesiska regeringens politiska linje, bland annat Taiwans statsstatus och vissa historiska händelser. Det begränsar användningen inom journalistik och politisk forskning.
- Bildgenereringen ligger efter specialiserade bildmodeller som Stable Diffusion och DALL-E 3, enligt oberoende granskares tester under 2025.
- Att felsöka och ändra befintlig kod fungerar sämre än att skriva ny kod från grunden. Granskare nämner misslyckade refaktoreringar som ett verktyg som Claude Sonnet klarar bättre.
- De bästa API-funktionerna och gratiskvoterna finns främst i Singapore-regionen. Global-distributionen har ingen gratiskvot, och slutpunkterna för fastlandskina är begränsade till konton registrerade i Kina.
Produktinformation
- Moln
- Ja
- Egen drift
- Ja
- Lokalt (on-premise)
- Ja
- Språk
- Engelska, Förenklad kinesiska, Traditionell kinesiska, Japanska, Koreanska, Och över 114 till
- Träning
- Officiell API-dokumentation, Videohandledningar på YouTube, Discord-community, Exempel på GitHub, Guider på Hugging Face Hub
Datahantering
- Regelefterlevnad
- Alibaba Cloud ISO 27001 · SOC 2
Vanliga frågor
Vad kostar Qwen egentligen?
Qwen Chat, konsumentchatten, kostar ingenting. API-åtkomst via Alibaba Cloud Model Studio faktureras per token (Singapore-regionen). Qwen3.8-Flash kostar $0.15 för indata och $0.47 för utdata per miljon. Qwen3.7-Plus kostar $0.40 för indata och $1.60 för utdata per miljon (upp till 256K kontext). Qwen3.8-Max kostar $2.00 för indata och $6.00 för utdata per miljon. Batchinferens stöds för närvarande inte för någon av modellerna i den här regionen.
Vad ingår i Qwens gratisnivå?
Hela Qwen Chat på chat.qwen.ai: textchatt, bild- och videoförståelse, bildgenerering, webbsökning och kodkörning, utan prenumeration. Nya konton i Alibaba Cloud Model Studio får dessutom 1 miljon gratis API-tokens per modell i 90 dagar efter aktiveringen. När kvoten är slut går API-anropen över till vanlig fakturering per token.
Vilka alternativ finns till Qwen?
Claude passar team som vill ha det starkaste engelska resonemanget och företagsstöd. GPT-4o har det bredaste befintliga verktygsekosystemet för team som redan byggt på det. DeepSeek når eller slår Qwen på rena kodbenchmarks, vilket passar när du inte behöver Qwens bredd i språk och modaliteter.
Qwen eller DeepSeek: vilket ska du välja?
DeepSeek V4 leder på rena benchmarks, med ungefär 83,7 % på SWE-bench och 99,4 % på AIME, och underbjuder Qwen-Max på pris för utdatatokens. Qwens fördel är bredden: många språk, multimodal inmatning av text, bild, ljud och video samt ett OpenAI-kompatibelt Model Studio-API som DeepSeek inte matchar. Välj DeepSeek om du vill ha högsta kodpoängen på topplistan, och Qwen om du bygger flerspråkiga eller multimodala produkter.
Hur kommer du igång med Qwen?
För vanlig användning öppnar du chat.qwen.ai eller installerar appen för iOS, Android, Windows eller macOS och börjar chatta utan kostnad. För utveckling skapar du ett Alibaba Cloud-konto, aktiverar Model Studio och hämtar en API-nyckel i DashScope-konsolen. Eftersom slutpunkten är OpenAI-kompatibel fungerar de flesta befintliga SDK:er om du byter bas-URL. Börja med Qwen-Flash för tester innan du går vidare till Qwen-Plus eller Qwen-Max i produktion.
Bästa alternativen
- Claude: Claude är starkare på engelska resonemang och företagsstöd. Qwen täcker fler språk till en bråkdel av API-kostnaden.
- GPT-4o: GPT-4o har det bredaste befintliga ekosystemet. Qwen ger egen drift med öppen licens och betydligt lägre pris per token.
- DeepSeek: DeepSeek leder på SWE-bench, medan Qwen hanterar bild, ljud och video samt fler språk i ett och samma verktyg.