Kutatás

GPT‑Rosalind jobb eredményt ért el a LifeSciBench hét munkafolyamatában, de vannak hiányosságok

A LifeSciBench benchmark szerint a GPT‑Rosalind minden hét vizsgált munkafolyamatban jobb pontszámot ért el, mint a GPT‑5.5; ez a kezdeti eredmény előrelépést jelez, ugyanakkor továbbra is gyengébben…

GPT‑Rosalind jobb eredményt ért el a LifeSciBench hét munkafolyamatában, de vannak hiányosságok

A LifeSciBench benchmark szerint a GPT‑Rosalind minden hét vizsgált munkafolyamatban jobb pontszámot ért el, mint a GPT‑5.5; ez a kezdeti eredmény előrelépést jelez, ugyanakkor továbbra is gyengébben teljesít artefaktum‑igényes, tervezéscentrikus és operatív korlátokkal terhelt feladatokban.