A LifeSciBench benchmark szerint a GPT‑Rosalind minden hét vizsgált munkafolyamatban jobb pontszámot ért el, mint a GPT‑5.5; ez a kezdeti eredmény előrelépést jelez, ugyanakkor továbbra is gyengébben teljesít artefaktum‑igényes, tervezéscentrikus és operatív korlátokkal terhelt feladatokban.
GPT‑Rosalind jobb eredményt ért el a LifeSciBench hét munkafolyamatában, de vannak hiányosságok
A LifeSciBench benchmark szerint a GPT‑Rosalind minden hét vizsgált munkafolyamatban jobb pontszámot ért el, mint a GPT‑5.5; ez a kezdeti eredmény előrelépést jelez, ugyanakkor továbbra is gyengébben…



