Reddit

Elon Musk admits Grok isn’t as good as Anthropic’s Claude

머스크, 그록이 앤스로픽 클로드보다 뒤처진다고 인정

일론 머스크는 인터뷰에서 Grok 4.7이 Anthropic의 Opus 5.5보다 못하다며 내년에 따라잡을 것으로 예상한다고 말했습니다. 개발 속도와 저렴한 가격, SpaceX·Tesla의 물리 세계 데이터가 Grok의 경쟁 요소로 제시됐지만, Grok Bot의 월간 성장률은 회사가 이용자 수를 공개하지 않아 확인되지 않습니다.

AI 요약

일론 머스크는 중국중앙방송(CMG) 인터뷰에서 SpaceXAI의 최신 모델 Grok 4.7이 Anthropic의 Opus 5.5보다 성능이 낮다고 인정했습니다. Grok을 “든든한 실무형 모델”이라고 부르며, Anthropic보다 AI 개발을 시작한 시점이 늦었다고 설명했습니다. 다만 기사에는 Anthropic이 2021년에 설립돼 약 5년이 됐다는 정정도 담겼습니다.

성능 격차와 따라잡기 목표

머스크는 SpaceXAI가 한두 달 간격으로 새 모델을 내놓는다며, 내년쯤 최전선 모델 수준에 도달할 것으로 예상했습니다. Opus 5.5는 9월 22일 출시됐고, Grok 4.7은 주로 가격 경쟁력을 내세우고 있습니다.

Grok Bot과 실세계 데이터

머스크는 AI 에이전트 Grok Bot을 개인용 디지털 비서라고 소개하며 이용자가 매달 약 100%씩 늘고 있다고 말했습니다. SpaceXAI가 이용자 수를 공개하지 않아 이 성장률은 확인되지 않았습니다. 회사는 Grok Bot을 Tesla 차량에 넣고, 이용자가 만든 봇 템플릿 사용을 유도하는 보상과 Starship 발사 참관 기회를 제공하고 있습니다.

머스크는 Anthropic이 소프트웨어 엔지니어링에 강점을 보였지만, 실세계 엔지니어링을 잘하는 AI는 아직 없다고 주장했습니다. SpaceX와 Tesla가 가진 물리 세계 관련 데이터를 Grok의 차별점으로 삼겠다는 구상입니다. 중국 AI 연구소의 성능 대비 연산 효율을 높게 평가했고, 중국이 2~3년 안에 반도체 제조 제약을 해결할 것으로 전망했습니다. AI 규제에는 미·중 공동 협의체가 필요하다고도 말했습니다.

Reddit 반응

  • @u/GloriousLebron — 리더보드 1위가 10위보다 높다는 말인가요?
    • @u/trollsmurf — “하지만 1은 10보다 낮죠.” 누군가가 이렇게 말하겠네요.
  • @u/draft_final_final — 모르겠네요. Grok도 가끔 좋은 답을 합니다.
  • @u/One-Attempt-1232 — 이건 대단한 인정도 아닙니다. 당연히 더 못하니까요. 아주 어려운 문제라면 Opus 5.5가 Astra 6보다 낫고, 나머지 모델은 한참 뒤입니다. 기본적인 작업이라면 싼 모델을 쓰면 됩니다.
    • @u/crazybiga — 벤치마크를 알고 있고 Opus 5.5가 구원자라는 분위기에 동조하고 싶진 않지만, 저는 Fable 5.1을 더 믿을 만하다고 봅니다. Opus 5.5로 멋진 웹사이트나 앱을 처음부터 만드는 건 좋았습니다. 하지만 기업 환경에서 중요한 시스템의 몇 줄을 바꾸고 회귀 범위를 최소화해야 한다면 Fable이 훨씬 더 믿음직합니다.
  • @u/matroosoft — 최고는 아닙니다. 그래도 Cursor에서 쓰는데 Claude보다 훨씬 저렴하고, 중간 규모 작업에는 꽤 쓸 만합니다.
  • @u/CatsH8ai — 최고일 필요는 없습니다. 가장 저렴하면서 충분히 괜찮으면 됩니다.
  • @u/SobekRe — Grok을 처음 써봤는데, 생각보다 나쁘지 않은 점이 놀랍습니다. 슬라이드 자료나 백서의 구조를 잘 잡습니다. Grok에서 기본 틀을 만든 뒤 Claude나 ChatGPT로 가져가 내용을 다듬는 방식으로 쓰고 있습니다.

원문: Mad Robot Blog / 번역·요약: Trawling