Új szintre léphet a képkészítés mesterséges intelligenciával az OpenAI új modelljének köszönhetően. A ChatGPT Images 2.5 részletesebb képeket, pontosabb szerkesztést és gyorsabb generálást kínál, sőt egy új funkcióval már saját vázlatból is készíthető fotó.
Bemutatta az OpenAI a ChatGPT Images 2.5 új képgeneráló modelljét, amely a vállalat szerint több területen is fejlődést hoz az előző változathoz képest.
A rendszer természetesebb fényviszonyokat és gazdagabb textúrákat képes létrehozni, miközben pontosabban őrzi meg a referenciaképeken szereplő személyek és tárgyak jellegzetességeit.
A generálás sebessége is javult: az OpenAI szerint a képek létrehozásának késleltetése akár 50 százalékkal alacsonyabb, mint a ChatGPT Images 2.0 esetében.
Pontosabban szerkeszti a képeket
A fejlesztés egyik fontos újdonsága a pontosabb képszerkesztés. A felhasználó egy adott részlet megváltoztatását kérheti úgy, hogy közben a kép többi része változatlan maradjon.
Ez különösen hasznos lehet például termékfotók, reklámanyagok vagy más üzleti tartalmak készítésénél. Az OpenAI szerint a rendszer egyetlen elemet – például egy terméket vagy hátteret – is képes módosítani anélkül, hogy a teljes kompozíciót újraalkotná.
Olvasd el: Gyorsabb és olcsóbb generatív mesterséges intelligenciát indított a DeepSeek

A hosszabb beszélgetések során végzett többszöri szerkesztésnél szintén javult a következetesség. A korábban végrehajtott módosítások nagyobb eséllyel maradnak meg, miközben az újabb változtatások nem rontják le fokozatosan a kép minőségét.
Saját rajzból is készíthet képet
Az OpenAI egy új funkciót is bemutatott, Sketch néven. Ennek segítségével a felhasználó közvetlenül a ChatGPT-ben rajzolhat egyszerű vázlatot, amelyet a mesterséges intelligencia vizuális útmutatóként használ fel.
Így akár egy szoba elrendezését, egy ruhadarab formáját vagy egy egyszerű ötletet is elég lehet néhány vonallal felvázolni. A rendszer ezután a rajzból és a hozzá adott szöveges leírásból készítheti el a végleges képet.
Az OpenAI kiemeli: ehhez nincs szükség művészi tudásra – vázlat csupán arra szolgál, hogy pontosabban megmutassa a mesterséges intelligenciának, mit szeretne látni a felhasználó.
Üzleti célokra is használható
A ChatGPT Images 2.5 az üzleti és kreatív munkafolyamatokban is bevethető. A rendszer jobban értelmez összetettebb vizuális utasításokat és pontosabban követheti a meghatározott stílust, elrendezést és részleteket.
Az OpenAI szerint ez például márkaanyagok, prezentációk, weboldalak, termékfotók és közösségi médiás tartalmak készítésénél is előnyt jelenthet.
A rendszerhez sablonok is megjelentek, így a felhasználók például poszterekhez vagy termékmegjelenítésekhez előre kialakított formátumokból indulhatnak ki.
Két új modell érkezett a fejlesztőknek
Az OpenAI nemcsak a ChatGPT-ben tette elérhetővé az új technológiát. A fejlesztők számára két új API-modell is megjelent: a GPT-Image-2.5 Flare és a GPT-Image-2.5 Sunburst.
A Flare a jobb minőséget, szerkesztést és sebességet kínáló általánosabb modell, amelyet a vállalat többek között közösségi tartalmakhoz, vizuális kereséshez, termékélményekhez és nagy mennyiségű képgeneráláshoz ajánl.
A Sunburst ezzel szemben azokhoz a professzionális munkafolyamatokhoz készült, amelyeknél különösen fontos a részletesebb kontroll és a pontos szerkesztés.
Egyre fontosabbá válik a generatív képkészítés
Az OpenAI szerint hetente már több mint 3 milliárd kép készül a ChatGPT Images és a GPT-Image modellek segítségével. A ChatGPT Images 2.5 ezért nem egyszerűen egy újabb képgeneráló modellként jelenik meg, hanem a vállalat szerint olyan eszközként, amely a gyorsabb ötleteléstől a professzionális kreatív munkáig számos területen használható.
Az új Images 2.5 már elérhető a ChatGPT felhasználói számára asztali gépen, mobilon és weben is, míg a Flare és a Sunburst az API-n keresztül használható.
Forrás: OpenAI
B.A.


