BENCHMARK (벤치마크)
OpenAI 생명과학 벤치마크 'LifeSciBench'·'GeneBench-Pro' 공개
전문가가 만들고 검토한 실제 연구 과제로 AI를 평가합니다.
핵심 사실
- OpenAI가 실제 생명과학 연구 과제와 판단을 AI가 얼마나 잘 다루는지 평가하는, 전문가가 작성·검토한 벤치마크 LifeSciBench를 공개했습니다.
- 6월 30일에는 복잡한 실제 데이터셋으로 유전체학·생물학 연구 성능을 시험하는 GeneBench-Pro를 공개했습니다.
왜 중요한가 · AI마중 해석
6월 3일 GPT-Rosalind 기능 강화와 함께, 생명과학 AI 성능을 재는 기준을 회사가 직접 만들고 있습니다. 자사 벤치마크라는 점은 감안해야 합니다.
그래서 나한테는?
벤치마크 공개라 서비스 변화는 없지만, 생명과학 AI 성능 주장을 볼 때 어떤 평가로 쟀는지 확인하는 기준이 늘었습니다.
SOURCE공식 원문 + 추가 출처
- 원문 · 공식Introducing LifeSciBenchOpenAI · openai.com · 발표 2026.06.17
- 추가 · 공식Introducing GeneBench-ProOpenAI · openai.com · 발표 2026.06.30
수집 2026.09.30 · 정리 2026.10.01 · 원문 본문은 옮기지 않았습니다.