Kézzel firkált vázlatokból készít kidolgozott, részletgazdag képeket a ChatGPT legújabb képalkotó fejlesztése. Az OpenAI bemutatta a ChatGPT Images 2.5-öt, amely a pontosság és a sebesség növelése mellett egy vadonatúj beviteli lehetőséget is nyújt a felhasználóknak. A felületen közvetlenül rajzolt skiccek vizuális horgonyként szolgálnak a generált alkotásokhoz.
A tisztán szöveges utasítások gyakran nehezen írják le a pontos elrendezést, a tárgyak egymáshoz viszonyított elhelyezkedését vagy egy szoba téri viszonyait. Az új vizuális beviteli lehetőség ezt az akadályt hidalja át azzal, hogy a szándékot közvetlen rajzzal teszi egyértelművé az algoritmus számára.
Firka alapján születő vizuális alkotások
A Sketch névre keresztelt funkció használatához a felhasználóknak az @Sketch parancsot kell beírniuk a beszélgetőablakba. Ekkor egy beépített rajzvászon jelenik meg, ahová egérrel, érintőképernyőn ujjbeggyel vagy digitális tollal lehet feltüntetni a kívánt kompozíció alapjait. Az elnagyolt vonalakból álló vázlatot a rendszer csatolmányként kezeli, majd a hozzáadott leírás alapján készíti el a végleges, nagy felbontású képet.
A megoldás kiemelten hasznos belsőépítészeti elrendezések megtervezéséhez, ruházati koncepciók felvázolásához vagy akár képregényfigurák megformálásához. A puszta szövegértelmezés helyett a ChatGPT Images 2.5 a rajz szerkezeti elemeit követi, így a tárgyak pontosan oda kerülnek a végső képen, ahová a felhasználó szánta őket.
Gyorsabb generálás és pontosabb szerkesztés
A frissített modell az új beviteli forma mellett az előző változathoz képest akár 50 százalékkal gyorsabb képalkotásra képes. A fejlesztők finomították a természetes fények és a felületi textúrák ábrázolását, valamint javították a több lépésből álló szerkesztési műveletek stabilitását.
A korábbi rendszereknél gyakori probléma volt, hogy egy részlet módosításakor az egész kép szerkezete megváltozott. Az új modell képes megtartani a hivatkozási fotók vagy korábbi generálások kulcselemeit, miközben csak a kijelölt területeket módosítja. A felület emellett sablonokat kínál a legnépszerűbb formátumokhoz, és lehetővé teszi a közvetlen megjegyzések elhelyezését a képeken a célzott igazításokhoz.
Két különálló modell az alkalmazások számára
A fejlesztők az alkalmazásprogramozási felületen (API) keresztül is elérhetővé tették a technológiát, két eltérő igényekre szabott változatban:
- GPT-Image-2.5 Flare: A gyorsaságra optimalizált alapértelmezett modell, amely a korábbi változathoz képest akár négyszeres sebességgel hoz létre kiváló minőségű képeket, támogatva az átlátszó háttereket is.
- GPT-Image-2.5 Sunburst: A precíziós munkákhoz tervezett változat, amely hosszabb generálási idő árán biztosít magas pontosságot a komplex termékfotók és marketinganyagok elkészítéséhez.
- Felhasználói közösség: A rendszer hetente több mint 3 milliárd kép létrehozását szolgálja ki a lakossági és az üzleti előfizetők körében.
A frissítés elérhetővé vált a ChatGPT ingyenes és fizetős változataiban, valamint a munkahelyi és fejlesztői felületeken egyaránt. A vizuális visszajelzések bevezetése egyszerűsíti a kreatív munkafolyamatokat mindazok számára, akik a hosszas szöveges leírások helyett szívesebben mutatják meg elképzeléseiket egy gyors rajzon.








