OpenAI præsenterer Genebench-Pro: Nyt benchmark til evaluering af AI i biovidenskab
OpenAI Blog June 30, 2026
OpenAI har lanceret Genebench-Pro for at måle, hvordan AI-modeller kan assistere i kompleks biovidenskabelig forskning uden at kompromittere sikkerheden. For ledere i pharma- og biotech-sektoren betyder det en ny guldstandard for, hvordan man sikkert implementerer AI i laboratorier og R&D-processer.
Key Intelligence
•Genebench-Pro indeholder over 2.000 ekspertniveau-evalueringer, der spænder over biologi, genetik og laboratorieprotokoller.
•Systemet tester specifikt for 'dual-use' risici, så man kan skelne mellem nyttig videnskabelig assistance og potentielt farlig viden.
•OpenAI gør værktøjet open source for at skabe en fælles industristandard for sikker AI-udvikling i biovidenskab.
•Modeller testes på deres evne til at designe eksperimenter og fejlfinde komplekse biologiske processer.
•Resultaterne viser, at de nyeste modeller allerede udviser avanceret forståelse, der nærmer sig ph.d.-niveau i specifikke discipliner.
•Dette markerer et skifte fra generiske sprogmodeller til højtspecialiserede domæne-evalueringer i AI-kapløbet.