PewDiePie unveils ‘uncensored’ Ajax AI model built to run on home PCs — creator says OpenAI banned him twice over model distillation used to build his product
PewDiePie, 가정용 PC에서 구동하는 ‘검열 없는’ AI 모델 Ajax 공개
PewDiePie가 Qwen3.5-9B를 미세 조정한 Ajax를 공개했습니다. 로컬 AI 작업 공간 Odysseus의 에이전트로 쓰이며, 거부 응답을 줄이는 과정에 Heretic을 활용했습니다. Reddit에서는 로컬 실행과 공개 모델 확산을 반기는 의견과 기술적 새로움이 크지 않다는 평가가 맞섰습니다.
- 주제
AI 요약
유튜버 PewDiePie가 가정용 PC에서 실행하는 AI 모델 Ajax를 공개했습니다. Ajax는 Qwen3.5-9B를 미세 조정한 모델로, 자체 호스팅 작업 공간 Odysseus에서 검색, 웹 탐색, 이메일, 일정 관리 같은 작업을 맡는 상시 실행 에이전트입니다. 제작자는 데이터를 외부 서비스에 보내지 않고 비공개로 쓸 수 있다고 소개했습니다.
모델 구성과 거부 응답 조정
Ajax는 OpenClaw와 Nous Research의 Hermes Agent처럼 에이전트 작업 공간에 연결해 사용하는 방식입니다. PewDiePie는 공개 오픈소스 도구 Heretic으로 모델의 거부 응답을 찾아 줄이는 자동 abliteration을 진행했습니다. 거부를 과도하게 없애면 모델 성능이 손상될 수 있다고 설명하며, 타인이나 자신을 해치는 요청은 선을 긋겠다고 밝혔습니다. 변호사의 조언에 따라 위험한 행동을 구체적으로 안내하도록 설계한 모델은 아니라고 했지만, 실제 제한 범위는 명확히 공개되지 않았습니다.
제작자는 모델을 개선하려고 다른 모델의 출력을 학습 데이터로 쓰는 distillation을 일부 시도하다 OpenAI 계정이 두 차례 차단됐다고 말했습니다. 공개한 이메일에는 한 차례 차단 사유가 ‘distillation’으로 적혀 있습니다. 두 번째 차단은 Ajax 실행 후 시드 데이터를 만들려던 때 발생했지만, 이메일에는 구체적인 사례가 없었습니다. OpenAI와 Anthropic 같은 모델 업체는 추론 과정이 드러나지 않도록 여러 조치를 취하며, 경쟁 모델의 출력을 이용한 학습을 위협으로 봅니다.
PewDiePie는 거대한 모델 대신 특정 작업 환경에 맞춘 작은 모델을 선호한다고 밝혔습니다. 이용자에게서 직접 데이터를 모으는 대신 학습 데이터를 기부해 달라고 요청했지만, 제출한 사람은 없었다고 전했습니다. 앞으로 이틀간 강화학습을 더 진행한 뒤 거부 응답 조정, 양자화, 벤치마크를 다시 할 계획입니다.
Reddit 반응
댓글에서는 대형 AI 업체가 자신들의 학습 데이터 수집은 정당화하면서 다른 이의 distillation은 막는다는 비판이 나왔습니다. 반면 모델 자체는 기존 Qwen 미세 조정판이라 새롭지 않다는 지적도 많았습니다. 일부 이용자는 기술적 성과보다 유명인이 로컬 AI와 셀프 호스팅을 직접 시도하고 과정을 알리는 점에 의미를 뒀습니다. 오픈 웨이트와 오픈소스의 차이, 공개 모델의 안전성, distillation의 법적 지위에 관한 논의도 이어졌습니다.
- @u/Holzkohlen — 도둑질 공장이 누군가 자기 것을 훔친다고 화를 내네요. 아이러니가 정말 맛있습니다.
- @u/TetraNeuron — OpenAI 모델도 어느 시점엔 PewDiePie 영상의 자막으로 학습했을 테니, 자기 것을 훔쳐 되찾는 셈이네요.
- @u/ACasualRead — OpenAI를 이용해 자기 모델을 학습했다고 인정하면서 이 모델을 판매하고 오픈소스로 공개하지 않는다면 위선자가 되겠네요. OpenAI도 우리 데이터로 학습했으니, 서로 훔친 뒤 우리에게 스테레오를 되파는 꼴입니다.
- @u/morganational — 오픈소스입니다. 무료로 공개하려고 하고 있습니다.
- @u/Remarkable-Host405 — 대부분은 오픈소스가 아니라 오픈 웨이트입니다. 둘은 같은 말이 아닙니다.
- @u/PrivateVasili — 오픈 웨이트는 모델을 공개하는 데 가깝습니다. 완전한 오픈소스라면 모델뿐 아니라 학습 코드와 가능하면 학습 데이터도 공개해야 합니다.
- @u/Nater5000 — 궁금한 분들을 위해 말하자면, 이 소식이 화제가 된 건 PewDiePie이기 때문입니다. 한 일 자체는 특별하거나 독특하지 않습니다. 검열 없는 모델은 쉽게 구해 실행할 수 있고, 이 모델은 Qwen3.5-9B를 미세 조정한 작은 모델입니다. 커스텀 하네스도 특별해 보이지 않으며, distillation 때문에 OpenAI에서 차단된 일은 독창성보다 그의 미숙함을 보여줍니다.
- @u/Wahngrok — 설명 감사합니다. Hugging Face에 검열 없는 모델이 많아서 왜 화제인지 궁금했습니다.
- @u/fadetoblackink — 모델 자체가 특별히 획기적이라고 생각하진 않습니다. 그래도 로컬 AI 대안을 알리는 점은 좋습니다. 거대한 팬층을 가진 사람이 셀프 호스팅 대안을 소개하고, 지난 몇 년간 Google과 빅테크의 데이터 수집에 반대하는 모습을 보여줬습니다.
- @u/mrdje — 검열된 LLM을 distillation으로 학습한 모델이 어떻게 ‘검열 없는’ 모델이 될 수 있나요?
- @u/ChipPungus — 그 과정은 abliteration이라고 합니다. 거부 반응은 LLM 활성화 공간의 특정 벡터와 연결되는 경우가 있습니다. 유해한 요청과 무해한 요청을 비교해 해당 벡터를 찾아 제거합니다.
- @u/odin_the_wiggler — 지금도 오픈 모델을 PC에서 실행할 수 있습니다. 문제는 전용 GPU가 필요한 경우가 많다는 점입니다.
- @u/rkcth — 메모리가 많거나 느린 실행을 감수해야 할 수도 있습니다. Qwen의 A3B 혼합 전문가 모델은 350억 개 매개변수 중 한 번에 30억 개만 활성화하지만, 전체 모델은 여전히 RAM에 올려야 합니다.
- @u/YouMeADD — 누가 PewDiePie AI를 원했나요?
- @u/mcslender97 — 아무도요. 그냥 본인이 좋아서 하는 것 같습니다. 백만장자의 장점이겠죠.
- @u/diamluke — 영업 문구는 간단합니다. 소수의 하이퍼스케일러에 의존하지 않고 각자 AI를 실행하자는 겁니다. 개인 데이터가 몇몇 민간 기업에 전부 넘어갈 이유는 없습니다.
원문: Tom's Hardware / 번역·요약: Trawling