OpenAI pripravilo GeneBench-Pro pre náročnejšie testovanie vedeckých agentov
Nový benchmark má merať, či modely zvládnu nejednoznačné rozhodnutia v genomike a kvantitatívnej biológii, nielen mechanicky vykonať známy analytický postup.
Tag
Všetky publikované články, v ktorých sa téma vedecká AI objavuje ako dôležitý kontext. Aktuálne 3 textov v archíve.
Nový benchmark má merať, či modely zvládnu nejednoznačné rozhodnutia v genomike a kvantitatívnej biológii, nielen mechanicky vykonať známy analytický postup.
OpenAI a Molecule.one otestovali takmer autonómny systém nad laboratóriom Maria. GPT-5.4 navrhol experimenty pre náročnú Chanovu-Lamovu reakciu a výsledok následne overili ľudskí chemici.
GPT-Rosalind má podľa OpenAI priniesť silnejšie biologické uvažovanie, medicinálnu chémiu, genomiku a pomoc pri laboratórnych postupoch. Firma zároveň predstavuje LifeSciBench, benchmark zameraný na reálne vedecké úlohy.