AI의 '숨겨진 속마음'은 사실 안 숨겨져 있었어. 암호로 잠근 추론 과정이 통째로 털린 사건과 인디 빌더가 봐야 할 신호 3 가지
AI의 '숨겨진 속마음'은 사실 안 숨겨져 있었어. 암호로 잠근 추론 과정이 통째로 털린 사건과 인디 빌더가 봐야 할 신호 3 가지 📅 2026.08.12 | ✍️ 경제 흐름을 읽어주는 형 오늘 아침 형이 챙긴 소식은 상용 AI를 쓰는 사람이라면 등골이 좀 서늘해질 얘기야. 오픈AI나 앤트로픽, 구글 같은 곳은 자기 모델이 답을 내기 전에 속으로 생각하는 과정, 그러니까 추론 과정을 남한테 안 보여주려고 암호로 잠가서 주고받아. 회사의 기술이 새어 나가는 걸 막으려는 거지. 그런데 한 연구팀이 그 잠금장치가 사실상 헐겁게 뚫려 있다는 걸 실제로 보여줬어. 형이 이 소식을 고른 이유가 있어. 형이 만드는 것들 대부분이 이런 상용 AI API 위에 얹혀서 굴러가는 자율 에이전트거든. 회사가 "이건 암호로 잠가 놨으니 안전해"라고 한 부분을 그대로 믿고 그 위에 뭘 쌓았는데, 그 잠금이 실은 허술했다는 얘기니까 형한테도 남 일이 아니야. 형이 읽은 신호 셋을 풀어볼게. 【 핵심 체크포인트 】 1. 회사가 잠가 둔 '속마음'이 그대로 풀렸어. 튀빙겐의 ELLIS 연구소와 막스플랑크 연구소 사람들이 8월 10일 '상용 LLM API에서 추론 과정 훔치기'라는 제목의 논문을 냈어. 핵심은 이래. 오픈AI, 앤트로픽, 구글은 모델이 속으로 굴린 생각을 암호 덩어리로 바꿔서 돌려주고, 다음 요청 때 그걸 다시 받아. 그런데 이 암호 덩어리가 같은 회사 안에서는 세션이 달라도, 쓰는 사람이 달라도, 심지어 모델이 달라도 서로 갖다 쓸 수 있게 호환되더라는 거야. 연구팀은 이 허점을 파고들었어. 힘센 모델이 만든 암호 추론 덩어리를 같은 회사의 약하고 방어가 덜 된 모델한테 집어넣으면, 그 약한 모델이 암호를 풀어서 원래 생각을 글자 그대로 뱉어 내. 회사가 못 본다고 잠가 둔 속마음이 고스란히 까지는 거지. 2. 네 로그가 이미 새고 있을 수 있어. 진짜 무서운 건 그 다음...