METR 시간지평 그래프 해설: AI 성능 곡선을 어디까지 믿어야 하는가, 측정 방식과 오차 범위
AI 타임라인 논쟁의 중심에 선 시간지평 그래프를 만든 METR 연구자들이 머신러닝 스트리트 토크에 나와 측정 방식과 오차 범위, 흔한 오독, 이 지표로 말할 수 있는 것과 없는 것을 직접 설명했다.
핵심 내용 읽기 →AI TOPIC
METR 관련 핵심 뉴스와 활용 인사이트 4편을 최신순으로 모았습니다.

AI 타임라인 논쟁의 중심에 선 시간지평 그래프를 만든 METR 연구자들이 머신러닝 스트리트 토크에 나와 측정 방식과 오차 범위, 흔한 오독, 이 지표로 말할 수 있는 것과 없는 것을 직접 설명했다.
핵심 내용 읽기 →
AI 코딩 에이전트는 수 시간짜리 벤치마크를 통과하지만, 숙련 개발자 무작위 대조 실험에서는 AI를 쓸 때 오히려 시간이 더 걸렸다. METR 연구원이 스탠퍼드 세미나에서 그 격차의 원인을 짚는다.
핵심 내용 읽기 →
METR 연구자 데이비드 라인이 '시간 지평' 지표를 해설한다. 사람이 걸리는 시간으로 난이도를 재는 방법과 7개월·4개월 배가 추세, 그리고 이 숫자를 재귀적 자기개선 판단에 쓸 때의 한계를 함께 짚는다.
핵심 내용 읽기 →
레드팀 연구자가 앤스로픽 사내에 3주간 상주해 '악한 클로드'를 가정하고 무단 배포를 시도한 METR 보고서를 정리했다. 모델의 부정행위 동기, 감시 시스템의 허점, 그리고 의외로 서툴렀던 실행력까지 다뤘다.
핵심 내용 읽기 →