앤트로픽이 'AI가 AI를 스스로 고치는' 자가개선 연구를 처음 열어 보였어. 시급 4달러 자동 연구자가 사람을 6시간 만에 이긴 흐름과 인디 빌더가 봐야 할 신호 3 가지
앤트로픽이 'AI가 AI를 스스로 고치는' 자가개선 연구를 처음 열어 보였어. 시급 4달러 자동 연구자가 사람을 6시간 만에 이긴 흐름과 인디 빌더가 봐야 할 신호 3 가지 📅 2026.08.29 | ✍️ 경제 흐름을 읽어주는 형 형이 오늘 아침 챙긴 소식은 앤트로픽 연구원 천위에한이 이끈 자가개선 AI 연구야. 사람이 하던 정렬 연구를 통째로 흉내 내는 자동 시스템을 만들었는데, 이름이 자동 정렬 연구자(AAR)야. 문헌을 뒤져 방법을 찾고, 개선안을 스스로 내놓고, 모델을 30분씩 훈련시켜 성적을 올리고, 되는 방법은 남기고 안 되는 건 버리는 과정을 알아서 돌려. 사람 연구자가 하던 일을 기계가 처음부터 끝까지 밟아본 셈이지. 형이 이 소식을 고른 이유는 형이 붙잡고 있던 자가검증이라는 생각과 정면으로 겹치기 때문이야. AI가 스스로를 되짚어 고친다는 건, 형이 MINDCHANGE 하네스로 매일 만지던 그 문제거든. 형이 읽은 신호 셋을 하나씩 풀어볼게. 【 핵심 체크포인트 】 1. AAR는 사람 연구 과정을 통째로 흉내 낸 자동 연구자야. 먼저 이게 뭘 하는 물건인지부터 볼게. AAR는 정렬 연구자가 평소에 밟는 순서를 그대로 따라 해. 관련 논문과 방법을 뒤져 읽고, 이걸 쓰면 나아지겠다는 개선안을 스스로 제안하고, 그 방법으로 모델을 30분 단위로 훈련시켜서 성적이 오르는지 확인해. 그러고는 효과 본 방법은 챙겨두고 헛돈 방법은 버리는 걸 계속 반복하지. 형이 이 대목을 제일 먼저 짚는 이유는, 이게 답 하나 툭 던지는 도구가 아니라 사람의 일하는 과정 자체를 옮겨 담은 첫 사례라서야. 결과물이 아니라 연구하는 방식을 기계에 넘긴 거지. 2. 정렬 벤치마크 10개를 전부 통과했고, 사람보다 빨랐어. 숫자가 형은 서늘했어. 어긋난 행동을 잡아내는 정렬 시험 10개를 붙였는데 하나도 안 빼고 전부 통과했어. 그러면서 전체 성능은 깎이지 않았지. 논문 표현을 그대로 옮기면, 가장 잘한 AAR 방법이...