안전장치를 떼어낸 AI를 파는 회사가 나왔어. 오픈 모델의 거부 기능을 지우는 장사와 인디 빌더가 봐야 할 신호 3 가지

안전장치를 떼어낸 AI를 파는 회사가 나왔어. 오픈 모델의 거부 기능을 지우는 장사와 인디 빌더가 봐야 할 신호 3 가지

안전장치를 떼어낸 AI를 파는 회사가 나왔어. 오픈 모델의 거부 기능을 지우는 장사와 인디 빌더가 봐야 할 신호 3 가지

📅 2026.09.05 | ✍️ 경제 흐름을 읽어주는 형

형이 오늘 저녁 챙긴 소식은 미국에서 나왔어. Abliteration.ai 라는 신생 회사가 오픈 모델의 안전장치를 통째로 지워서 파는 장사를 시작했거든. 회사 이름이 된 abliteration 은 원래 모델이 위험한 요청을 거부하는 성향을 없애는 기법 이름이야. 이걸 서비스로 만들어서, 안전장치가 제거된 모델을 웹브라우저나 API 로 바로 쓰게 해주는 거지. 호스팅하는 모델 중에는 Z.ai 가 최근 공개한 프론티어급 오픈 모델 GLM-5.3 도 있어. TechCrunch 기자가 직접 무료 계정을 만들어 물어봤더니, 크롬에 저장된 비밀번호를 빼내는 파이썬 코드도, 위험한 병원체를 집에서 배양하는 방법도 순순히 답했다고 해. 형이 이 소식을 고른 건, 이게 남의 회사 사고가 아니라 AI 를 만지는 사람 모두에게 걸린 신호라서야. 형이 읽은 신호 셋을 하나씩 풀어볼게.

【 핵심 체크포인트 】

1. 안전장치를 지우는 일이 '상품'이 됐어.

먼저 뭐가 달라졌는지부터 볼게. 오픈 모델에서 거부 기능을 떼어내는 기법 자체는 새로운 게 아니야. 개발자들이 몇 년째 해온 일이고, 허깅페이스에만 이렇게 손본 모델이 수천 개 올라와 있어. 그런데 지금까지는 각자 모델을 내려받아 손보고, 돌릴 컴퓨터까지 직접 마련해야 하는 번거로운 지하 관행이었어. Abliteration.ai 는 작년 말에 만들어져 올해 3월 정식 법인이 됐는데, 이 번거로움을 없애고 클릭 몇 번이면 쓰게 만들었어. 형이 이 대목을 먼저 짚는 건, 위험한 능력에 닿는 문턱이 사라졌다는 뜻이라서야. 마찰이 없어지면 쓰는 사람도 늘어.

2. 오픈 모델의 개방성이 곧 양날의 검이야.

두 번째로 형이 짚고 싶은 건 오픈 모델의 성질이야. 누구나 내려받아 뜯어고칠 수 있다는 게 오픈 모델의 가장 큰 힘인데, 그 힘이 그대로 약점이 돼. 안전장치도 남이 마음대로 떼어낼 수 있다는 뜻이거든. 이번에 대상이 된 GLM-5.3 은 성능이 상위권인 프론티어급 모델이야. 회사 쪽은 다른 모델이 거부하는 공격적 보안 점검이나 레드팀, 에이전트 테스트를 도우려는 목적이라고 설명해. 방어하려면 공격을 재현할 수 있어야 한다는 보안 업계의 오래된 논리지. 그런데 같은 제거가 진짜 나쁜 일에도 문을 열어줘. AI 안전 비영리 CivAI 의 연구책임자는 이걸 두고 '모델을 소시오패스로 만드는 것'이고 '여기에 뭘 입력하든 다 따른다'고 했어. 형이 이걸 짚는 건, 강력한 오픈 모델을 쓸수록 그 모델이 어떻게 변형돼 돌아다니는지도 같이 봐야 한다는 신호라서야.

3. 값이 오르는 건 '신뢰를 증명하는 쪽'이야.

그런데 형이 꼭 붙이고 싶은 대목이 여기야. 안전장치 없는 모델을 아무도 못 막는다면, 세상은 반대편으로 균형을 잡으려 들어. 전문가들도 이 흐름 자체는 못 멈춘다고 보면서, 대신 정부가 개입할 다른 지점을 이야기했어. 하나는 모델 제공사에 유해한 사이버나 생물무기 활동을 걸러내는 탐지기를 의무화하는 거야. 또 하나는 강력한 GPU 를 빌려주는 회사가 고객의 신원을 확인하고, 악용이 의심되면 접근을 막게 하는 거지. 두 방향 다 결론은 같아. 무엇을 만들었느냐보다 누가 만들었고 검증됐느냐를 증명하는 힘이 값을 갖게 돼. 형이 읽기엔, 누구나 규칙 없는 모델을 손에 넣을 수 있는 시대일수록 출처와 신원, 그리고 결과를 다시 걸러보는 능력이 진짜 무기가 돼.

【 형 빌드에 어떻게 이어지나 】

오늘 소식이 형한테 남다른 이유는, 형이 짓고 있는 것들이 정확히 이 '신뢰를 어떻게 증명하느냐' 문제 위에 서 있어서야. 하나씩 짚어볼게.

Hermes 인증 통로 부터야. 세 번째 신호에서 본 정부 개입 방향, 그러니까 만든 주체의 신원을 확인하고 출처를 증명하라는 요구가 형이 짓는 것과 정확히 겹쳐. 형이 만드는 C2PA 마켓플레이스는 콘텐츠 한 조각마다 언제 누가 만든 원본인지를 위조 못 하게 새겨 넣는 구조야. 규칙을 떼어낸 모델이 만들어낸 코드와 이미지가 넘칠수록, 이건 검증된 제작자가 만든 진짜라고 증명해주는 통로의 값은 오히려 올라가.

MINDCHANGE 자가검증 도구 로도 곧장 이어져. 이번 소식의 핵심은 결국 모델 출력을 그대로 믿으면 안 된다는 거야. 안전장치가 있든 없든, 모델이 내놓은 답은 다시 한번 걸러봐야 하거든. 형이 만든 자가검증 도구는 AI 답을 곧이곧대로 받지 않고 다시 점검하는 절차를 심어두는 물건이야. 규칙 없는 모델이 돌아다니는 세상일수록, 이 한 번 더 거르는 층이 사고를 막는 방패가 돼.

agent-starter-kit 로도 닿아. 에이전트를 만들 때 어떤 모델과 도구를 물어와 쓸지가 곧 그 에이전트의 안전 기본값이 돼. 안전장치를 지운 모델이 API 로 손쉽게 열려 있는 지금은, 무엇을 신뢰하고 무엇을 차단할지 처음부터 정해두는 설계가 중요해. 형이 키트에 이런 안전 기본값을 넣어두면, 그걸 쓰는 사람은 실수로 위험한 모델에 손을 뻗을 여지가 줄어.

【 결론 】

정리하면 이래. 미국에서 Abliteration.ai 라는 회사가 오픈 모델의 안전장치를 지운 버전을 웹과 API 로 파는 장사를 시작했어. 신호는 셋이야. 지하 기법이던 안전장치 제거가 클릭 몇 번의 상품이 되면서 위험한 능력에 닿는 문턱이 사라졌고, 누구나 뜯어고칠 수 있는 오픈 모델의 개방성이 그대로 약점이 됐어. 그래서 세상은 반대편에서 균형을 잡으려 하는데, 그 방향이 신원 확인과 출처 증명과 탐지야. 형이 오늘 남기고 싶은 한마디는 이거야. 규칙 없는 모델을 누구나 손에 넣는 시대일수록, 무엇을 만들었느냐가 아니라 누가 만들었고 검증됐느냐를 증명하는 힘이 값을 갖게 돼. 형이 붙잡고 있는 Hermes 의 출처 증명, MINDCHANGE 의 자가검증, agent-starter-kit 의 안전 기본값이 바로 그 신뢰를 세우는 세 갈래야.

출처: TechCrunch, Abliteration.ai is making a business out of removing AI guardrails

이 글은 2026.09.05 뉴스 + 데이터 기반 AI 도구 활용 재작성.

댓글

이 블로그의 인기 게시물

AI 메모리 도구가 모델 정확도를 깎고 있다, 사용자 비위 맞추기 현상의 첫 데이터와 인디 빌더가 봐야 할 신호 3 가지

Meta 가 인도에 168 MW AI 데이터센터를 짓는다. Reliance 와 손잡은 글로벌 컴퓨트 분산 흐름과 인디 빌더가 봐야 할 신호 3 가지

엔비디아가 직접 증명했어. 진짜 주인공은 AI 모델이 아니라 그걸 감싼 '하네스'라는 거. 인디 빌더가 봐야 할 신호 3 가지