Az OpenAI szakított a kizárólag szöveges válaszok irányába fektetett hangsúllyal: a cég szerdán bejelentette, hogy a GPT-6 modellek mostantól hozzáférést kapnak az új "intelligens interfész" (Intelligent UI) funkcióhoz. Ennek célja, hogy a chatbotok több vizuális és kevesebb hosszú szöveges elemet jelenítsenek meg a válaszaikban.
Milyen elemeket tesz lehetővé az új felület?
Az OpenAI szerint az Intelligent UI lehetővé teszi többek között:
- grafikák és ábrák megjelenítését,
- érinthető, kattintható gombok használatát,
- robbantott nézetek vagy más vizualizációk beágyazását,
- interaktív élmények biztosítását a válaszokon belül.
A cég kiemeli, hogy ezek az elemek a modell döntése alapján, automatikusan kerülnek be a ChatGPT-válaszokba, ha a modell úgy ítéli meg, hogy az adott helyzetben hasznosabbak a hagyományos, hosszú szövegnél.
Bemutató: kerékpár robbantott ábrája
A funkció demonstrálásához az OpenAI példaként egy kerékpárt használt: a chatbot egy robbantott ábrán minden alkatrészhez vizualizációt és kattintható gombot rendelt, amelyeken keresztül a felhasználó további információkat kérhet az egyes alkatrészekről — ezt a példát a Gizmodo ismertette.
Ki kapja meg először?
Az Intelligent UI funkció első körben a ChatGPT Plus, Pro, Business és Enterprise előfizetőinél válik elérhetővé.
Miért fontos ez?
A változás azt jelzi, hogy az OpenAI igyekszik a nyelvi modellek válaszait multimodálisabbá tenni: a vizuális és interaktív elemek segíthetnek a komplex információk gyorsabb megértésében, és csökkenthetik a hosszú, sok szöveget igénylő magyarázatok szükségességét. Ugyanakkor az automatikus beágyazás döntési mechanizmusai és a felhasználói élmény részletei továbbra is figyelmet igényelnek, ahogy a funkció szélesebb körű bevezetése megtörténik.



