Modeli AI kryesor dhe i përballueshëm i Xiaomi-t kryeson mes modeleve me burim të hapur, ndërsa Anthropic thotë se Claude ndihmoi për ta arritur këtë sukses

foto

Xiaomi ka publikuar linjën e saj MiMo-V2.6, dhe modeli kryesor kryeson listat midis modeleve të disponueshme hapur, ndërsa kushton një pjesë të vogël të konkurrencës për detyrë. Fitimet vijnë nga një raund masivisht i zgjeruar i të mësuarit me përforcime, megjithëse kompania akuzohet gjithashtu se ka huazuar nga Claude i Anthropic.

foto

Sipas Xiaomi, modeli më i madh nga dy modelet e reja , MiMo-V2.6-Pro, shënon 46 pikë në Indeksin e Inteligjencës nga firma e analizave Artificial Analysis . Kjo e bën atë modelin më të fortë të inteligjencës artificiale të disponueshëm hapur aktualisht, përpara rivalëve si Kimi K3 dhe Qwen. Gjëja më e rëndësishme është çmimi: 0.435 dollarë për milion tokenë hyrës dhe 0.87 dollarë për milion tokenë dalës.

Sipas llogaritjeve të Artificial Analysis, një detyrë e vetme testimi kushton vetëm rreth 0.13 dollarë, një pjesë e vogël e çmimit që kërkojnë modele të ngjashme. Kjo e vendos modelin në atë që quhet kufiri Pareto i inteligjencës dhe kostos.

foto

Pro është një model i kombinuar me ekspertë me 1.02 trilion parametra, vetëm 42 miliardë prej të cilëve janë aktivë për kërkesë. Krahas tij ndodhet edhe MiMo-V2.6-Flash më i vogël dhe më efikas.

Xiaomi ia atribuon rritjen e performancës të mësuarit përforcues (RL) shumë të zgjeruar, që do të thotë trajnim përmes provës, reagimeve dhe shpërblimit. Kompania e shkallëzoi këtë fazë përgjatë tre boshteve: më shumë të dhëna për hap trajnimi, mjedise detyrash më të larmishme dhe më shumë llogaritje për vlerësimin e zgjidhjeve.

Xiaomi thotë se testi zgjati më pak se gjashtë ditë dhe kushtoi rreth 2.62 milionë dollarë për Pro dhe 0.85 milionë dollarë për Flash. Në testin e kodimit DeepSWE, rezultati i Pro u rrit nga 58.4 në 72.6, ndërsa Flash u rrit nga 48.8 në 65.7.

Për ta mbajtur stërvitjen të qëndrueshme në këtë shkallë, Xiaomi ngriu mekanizmin e shpërndarjes së brendshme të modelit dhe shtoi disa shtresa mbrojtjeje kundër “hakimit të shpërblimeve”, truket që një model përdor për të manipuluar shpërblimet pa e zgjidhur në të vërtetë detyrën.

Së bashku me modelet, Xiaomi po sjell një variant veçanërisht të shpejtë të quajtur Pro-UltraSpeed, me deri në 20 herë shpejtësi daljeje. Ajo që bie më shumë në sy është se kompania po hap mjetet e saj RL, duke përfshirë raportin teknik, kornizën e plotë të trajnimit, një model më të vogël për trajnime të mëtejshme dhe rreth 7,000 detyra trajnimi të gatshme me vlerësues automatikë për zhvillimin e softuerëve, sigurinë kibernetike, punën në zyrë dhe dizajnin e faqeve të internetit, plus afërsisht 1,000 detyra për kompozimin e muzikës.

Detyrat vijnë nga një përzierje burimesh. Një pjesë e kodit vjen nga kërkesa reale të GitHub nga punonjësit dhe pyetjet e përdoruesve, ndërsa përshkrimet e tjera të detyrave gjenerohen nga një model gjuhësor. Detyrat kibernetike mbështeten në OSS-Fuzz, një koleksion prej dhjetëra mijëra dobësish të vërteta softuerike, dhe mjediset e zyrës rindërtohen në mënyrë sintetike.

Kjo shfaqje e hapjes është në kontrast të thellë me akuzat që Anthropic ngriti vetëm dy javë më parë. Në raportin e saj të inteligjencës së kërcënimeve, Anthropic shqyrtoi rastet e abuzimit me Claude të zbuluara midis dhjetorit 2025 dhe gushtit 2026 dhe përmendi shtatë laboratorë kinezë të lidhur me fushatat kundër modelit: Alibaba, Moonshot AI, DeepSeek, Zhipu, Xiaomi, MiniMax dhe SenseTime.

Në përgjithësi, thuhet se laboratorët kanë gjeneruar rreth 190 milionë shkëmbime për të përvetësuar aftësitë e Claude për trajnimin e modeleve të tyre, një teknikë që Anthropic e quan distilim i paligjshëm.

Xiaomi shfaqet me emër. Në një rast të etiketuar GTG-16008, Anthropic gjurmoi më shumë se 400,000 shkëmbime gjatë 20 ditëve në mars dhe prill 2026, në të cilat Xiaomi kaloi bisedat e përdoruesve dhe seancat e kodimit nga modelet e veta MiMo përmes OpenClaw dhe OpenCode te Claude, duke synuar të pasurojë të dhënat e trajnimit për modelet e ardhshme. Raporti nuk ofron pothuajse asnjë dokumentacion se nga kanë ardhur të dhënat e mëparshme të trajnimit dhe të mësuesve për distilimin e brendshëm të modeleve të mësuesve.

Thënë ndryshe, raporti pretendon se Xiaomi regjistroi bisedat e përdoruesve me modelet e saj MiMo dhe më pas i futi ato në Claude për të nxjerrë të dhëna trajnimi, të njëjtat të dhëna që tani e kanë çuar atë në krye të renditjes së modeleve të hapura.