Claude Haiku 5.5 néven kiadta új legkisebb modelljét az Anthropic, amelyet nagy mennyiségű, költségérzékeny feladatra optimalizált. A vállalat szerint a generatív mesterséges intelligencia egy átlagos munkafolyamatban körülbelül 75 százalékkal olcsóbban működhet a Haiku 4.5-nél, miközben programozási, számítógép-használati és ügynöki feladatokban is jelentősen fejlődött.
Az Anthropic október elején tette elérhetővé a Claude Haiku 5.5-öt, amely az Opus és a Sonnet után lezárja a Claude 5.5 modellcsalád jelenlegi három fő teljesítményszintjét. A Haiku a család leggyorsabb és legolcsóbb tagja, ezért elsősorban olyan feladatokra készült, ahol nem egyetlen rendkívül összetett probléma megoldása, hanem nagy mennyiségű kérés gyors és gazdaságos feldolgozása a cél. Az új modell a Claude saját platformja mellett az Amazon Web Services, a Google Cloud és a Microsoft felhőkörnyezetében is használható.
A legnagyobb változás az árazás. Százezer token alatti bemenetnél egymillió bemeneti token 0,10 dollárba, egymillió kimeneti token pedig 0,50 dollárba kerül, ami a Haiku 4.5 megfelelő listaárainak tizede. Az Anthropic ugyanakkor nem azt állítja, hogy minden munkafolyamat pontosan 90 százalékkal lesz olcsóbb: saját számítása szerint a tényleges átlagos futtatási költség körülbelül 75 százalékkal csökkenhet. Az eltérés azért fontos, mert a végső költséget a feladat hossza, a felhasznált tokenek száma, a gyorsítótárazás és a modell gondolkodási mélysége egyaránt befolyásolja.
Az Anthropic saját benchmarkjai komoly képességjavulást mutatnak, különösen a számítógép-használati és ügynöki feladatoknál. A vállalat méréseiben a Haiku 5.5 az OSWorld 2.1 teszten 72,4 százalékot ért el, miközben elődje 15,7 százalékot teljesített. A Terminal-Bench 4.0 parancssori feladatain 39,2 százalékos eredményt közöltek. Ezek gyártói benchmarkok, tehát nem szabad őket úgy értelmezni, mintha minden valódi feladatban ugyanilyen arányú javulás lenne várható.
Olvasd el: Olcsóbb és gyorsabb lett a Claude legerősebb Opus modellje is

Eljuthatunk oda, hogy a generatív mesterséges intelligencia tömeges üzleti használatában már nem a legerősebb, hanem a megfelelően erős és lényegesen olcsóbb modell lesz a legértékesebb?
A Haiku 5.5 egyik fontos szerepe éppen az lehet, hogy nagyobb modellek alügynökeként dolgozzon. Egy összetettebb rendszerben például a drágább Opus vagy Sonnet meghatározhatja a feladat menetét, miközben a Haiku végzi el a nagy mennyiségű részfeladatot, adatfeldolgozást vagy ellenőrzést. Az Anthropic külön kiemeli az összefoglalást, adatbázis-lekérdezéseket, osztályozást, élő ügyfélszolgálatot és böngészőhasználatot. A modell egymillió tokenes kontextusablakot is támogat, így hosszabb dokumentumokkal és összetettebb háttéranyagokkal is dolgozhat.
Az olcsóbb ár ugyanakkor nem jelenti azt, hogy a Haiku minden esetben kiválthatja a nagyobb Claude-modelleket. Az Anthropic maga is eltérő szerepet szán az Opus, Sonnet és Haiku modelleknek, és az összetett kutatási, mérnöki vagy nehéz programozási munkában továbbra is a nagyobb rendszerek képessége lehet előnyösebb. A benchmarkok többsége ráadásul az Anthropic saját méréséből származik, ezért a valós költség- és teljesítményelőnyt különböző alkalmazásokban érdemes függetlenül is vizsgálni.
A Haiku 5.5 megjelenése így leginkább azt mutatja, hogy a generatív mesterséges intelligencia versenye már nem kizárólag a maximális intelligenciáról szól. Ahogy a technológia egyre több üzleti rendszerbe, ügyfélszolgálatba és automatizált munkafolyamatba kerül, a válaszonkénti költség, a sebesség és a skálázhatóság ugyanolyan fontos tényezővé válik, mint a benchmarkok csúcsteljesítménye. Ebben a versenyben egy olcsó, gyors és megfelelően erős modell akár több valódi munkát is megszerezhet, mint egy jóval drágább csúcsváltozat.
Olvasd el ezt is: Európa új csúcsmodellje lehet a Mistral Large 4 generatív mesterséges intelligencia
Források: Anthropic, DataCamp, The Indian Express
CS.SZ.


