Új generatív mesterséges intelligencia modellcsaládot adott ki a Xiaomi, amelynek legerősebb tagja rögtön az élre került az Artificial Analysis nyílt súlyú modelleket összevető mérésében. A MiMo-V2.6-Pro ráadásul szöveget, képet, hangot és videót is képes feldolgozni, miközben egymillió tokenes kontextusablakot kínál.
A szeptember 22-én hivatalosan bejelentett MiMo-V2.6 család három fő változatból áll. A Pro a legnagyobb teljesítményű modell, a Flash a nagy mennyiségű és költségérzékeny feladatokra készült, míg a Pro-UltraSpeed változatnál a Xiaomi akár húszszoros kimeneti sebességet ígér. A Pro körülbelül ezermilliárd paraméteres, úgynevezett szakértőkeverékes architektúrát használ, amelyből egy-egy feldolgozás során csak a paraméterek egy része aktiválódik.
A legerősebb független visszaigazolást jelenleg az Artificial Analysis adja. A MiMo-V2.6-Pro 46 pontot ért el a szervezet összetett Intelligence Indexén, amivel az ellenőrzés időpontjában az első helyen állt az összevetett nyílt súlyú modellek között. Egy indexfeladat átlagos futtatási költségét 0,13 dollárra becsülték. Ez különösen erős ár-teljesítmény arány, de nem jelenti azt, hogy a modell minden egyes feladattípusban jobb lenne valamennyi riválisánál.
Az API-árazás is agresszív: egymillió, gyorsítótárból nem kiszolgált bemeneti token 0,435 dollárba, egymillió kimeneti token pedig 0,87 dollárba kerül. A Pro egymillió tokenes kontextusablakot és akár 128 ezer tokenes kimenetet támogat. A Xiaomi emellett MIT-licenc alatt tette elérhetővé a modell súlyait, így azok kereskedelmi projektekben és saját infrastruktúrán is felhasználhatók.
Olvasd el: Felére vágta két új GPT-6 modell API-árát az OpenAI

Eljutottunk oda, hogy a legnagyobb amerikai modelleknek már nemcsak más vállalatok, hanem letölthető kínai rendszerek is komoly ár-teljesítmény versenyt támasztanak?
A fejlesztés mögött szokatlanul nagy megerősítéses tanulási program áll. A Xiaomi szerint a Pro és a Flash utólagos tanítása egyaránt körülbelül harminc lépésben zajlott, összesen mintegy 750 ezer mesterségesen létrehozott feladatsorral és több mint hétezer tréningkörnyezettel. A vállalat a Pro megerősítéses tanításának számítási költségét körülbelül 2,62 millió dollárra becsüli. Ez nem tartalmazza a teljes modell alaptréningjének költségét, ezért nem szabad úgy értelmezni, mintha az egész modellt ennyiből készítették volna.
Az eredményeket ugyanakkor érdemes benchmarkonként külön kezelni. Bár az Artificial Analysis összesített nyílt súlyú rangsorában a MiMo-V2.6-Pro az élre került, több erős zárt modell magasabb összesített teljesítményt mutat, és az egyes kódolási, automatizálási vagy tudományos teszteken is eltérhet a sorrend. A 46 pontos index ezért erős független jelzés, nem univerzális bizonyíték arra, hogy minden feladatra ez lenne a világ legerősebb mesterséges intelligenciája.
A Xiaomi belépése azért lehet különösen fontos, mert egyszerre tolja lefelé az árakat és felfelé a nyíltan hozzáférhető modellek képességeit. Ha ez a tendencia folytatódik, egyre több vállalatnak nem az lesz az első kérdése, hogy melyik amerikai zárt modellt válassza, hanem az, hogy szüksége van-e egyáltalán zárt rendszerre. A generatív mesterséges intelligencia következő nagy versenye így nemcsak a képességekről, hanem az árakról, a saját üzemeltetés lehetőségéről és a fejlesztői szabadságról is szólhat.
Olvasd el ezt is: Hat váratlan generatív mesterséges intelligencia-viselkedést hozott nyilvánosságra az OpenAI
Források: Xiaomi MiMo, Artificial Analysis, The Next Web
CS.SZ.


