Az Alibaba.com szerint a kifejezetten kereskedelmi feladatokra optimalizált Accio mesterséges intelligencia ügynök több mint 50 százalékkal alacsonyabb becsült költséggel teljesített egy 107 feladatból álló e-kereskedelmi tesztet, mint két általános célú versenytárs. A szeptember 9-én kibővített rendszer már a piackutatástól és beszállítókereséstől a webshop napi működtetéséig több munkafolyamatot egyetlen felületen fog össze.
Az Alibaba.com szeptember 9-én, a kisvállalkozásoknak és vállalkozóknak szervezett CoCreate rendezvényén mutatta be az Accio kibővített változatát és a Commerce Agent Bench nevű teszt eredményeit. Az Accio nem általános chatbotként működik, hanem kifejezetten kereskedelmi feladatokra épített mesterséges intelligencia ügynök. A vállalat célja, hogy egy kisebb vállalkozás ugyanazon rendszerben végezhessen piackutatást, termékkeresést, beszállító-értékelést és több napi e-kereskedelmi műveletet.
Az Alibaba saját benchmarkja 107, végponttól végpontig végrehajtandó kereskedelmi feladatot tartalmaz. A vállalat szerint a feladatsort 10 millió aktív kis- és középvállalkozói felhasználótól származó működési minták, 1,6 millió beszélgetés és 200 ezer végrehajtási folyamat alapján alakították ki. A feladatok többek között a beszerzéshez, logisztikához, terméklistázáshoz, teljesítéshez és értékesítés utáni ügyintézéshez kapcsolódnak.
A teljes 107 feladat becsült végrehajtási költsége az Alibaba mérése szerint Accióval 3,69 dollár volt, míg az OpenAI Codex esetében 9,27, az Anthropic Claude Code használatával pedig 9,51 dollárt számoltak. Az Alibaba ebből több mint 50 százalékos költségelőnyt állapított meg, hasonló teljesítési minőség mellett. A számokat azonban fontos vállalati benchmarkként kezelni: a tesztet maga az Alibaba dolgozta ki, és az Accio kereskedelmi feladatokra optimalizált rendszer, míg a két összehasonlított szolgáltatás szélesebb, általánosabb fejlesztői feladatokra készült.
Olvasd el: A telefonbeszélgetésből hamarosan jegyzet is készülhet a Telekom új rendszerével

A kisebb webáruházak számára nem az lehet a mesterséges intelligencia valódi áttörése, amikor a legerősebb modell válaszol nekik, hanem amikor egy olcsóbb rendszer ténylegesen végigviszi helyettük a napi kereskedelmi folyamatokat?
A költségcsökkentés mögött az Alibaba szerint az áll, hogy az Accio nem minden részfeladathoz ugyanazt a modellt használja. Az összetett munkát kisebb lépésekre bontja, majd a szükséges minőség, sebesség, adatigény és költség alapján választ megfelelő modellt és eszközt. Az egyszerűbb feladatokhoz kisebb modelleket alkalmazhat, míg a komolyabb következtetést igénylő lépésekhez nagyobb rendszert rendel. A gyorsítótárazás és a korábbi kontextus tömörítése szintén csökkentheti a felesleges számítási igényt.
Az Accio közben egy szélesebb e-kereskedelmi munkafelületté is bővül. A rendszerrel piackutatás végezhető, termékötletek kereshetők, beszállítók értékelhetők és napi kereskedelmi folyamatok szervezhetők. Az AI Magazine szerint az Accio többek között Amazon-, Shopify-, eBay-, TikTok Shop- és Walmart-folyamatokhoz is kapcsolódhat. Az Alibaba a Commerce Agent Bench tesztet nyíltan hozzáférhetővé is tette, így más fejlesztők elvileg saját rendszereikkel is megismételhetik az összehasonlítást.
A fejlemény a KKV-k szempontjából azért fontos, mert a mesterséges intelligencia versenye lassan a válaszok minőségéről a teljes feladat gazdaságos elvégzésére helyeződik át. Egy kis webáruháznál nem feltétlenül az számít, hogy egy modell a világ legjobb benchmarkeredményét hozza-e, hanem hogy mennyiért tud helyesen terméket kutatni, beszállítót összehasonlítani, adatokat feldolgozni és tényleges kereskedelmi folyamatot végrehajtani. Ha a specializált ügynökök ezen a területen tartós költségelőnyt tudnak elérni, a kisebb cégek számára is sokkal gyorsabban válhat mindennapi munkaeszközzé az automatizálás.
Olvasd el ezt is: Egyetlen felületre húzza a marketingmunkát a Canva az új mesterséges intelligencia eszközökkel
Források: Alibaba.com, AI Magazine, Sourcing Journal
CS.SZ.


