연구자 정보
안양천돌고래 프로필 보기
- 출신대학 : Seoul National University
- 전공 : 물리교육과/교육학
- 연구분야 : 교육AI
1분 요약
AI 에이전트 벤치마크의 일부 영역에서는 실패 사례의 45~48%가 실패로 드러나지 않고 ‘성공’으로 기록됐습니다. 그렇다면 사람을 줄이려고 AI를 도입했는데, 결국 사람이 결과를 다시 확인해야 한다면 자동화는 정말 싸진 걸까요? 기존 소프트웨어는 잘못되면 오류나 경고가 남지만, AI는 틀려도 문장과 결과물의 형태가 멀쩡해 실패를 알아채기 어렵습니다. 심지어 다른 AI에게 검증을 맡긴 실험에서도 진짜 성공과 거짓 성공을 제대로 가려내지 못했습니다. 특히 교육처럼 정답을 실행해 확인할 수 없는 영역에서는 검증 자체를 사람이 새로 만들어야 합니다. 결국 AI가 줄이는 것은 ‘생성 비용’일 뿐, 결과가 맞는지 확인하는 ‘검증 비용’까지 사라지는 것은 아닙니다.
본문
연구자 의견
커피챗 신청
커피챗을 신청하시면 하이젠버그 운영진과 직접 이야기를 나눌 수 있습니다. 혹 슬롯이 없다면 ceo@heisenberg.kr로 메일주세요!