Introducing Support for Local AI Models in the Antigravity SDK
Antigravity SDK, 로컬 AI 모델 지원 추가
Google이 Antigravity SDK에서 LiteRT 기반 Gemma 4 26B A4B를 비롯한 로컬 모델 실행을 지원합니다. 오프라인 에이전트와 클라우드·로컬 모델을 조합한 작업 흐름을 구성할 수 있으며, Ollama·LM Studio·vLLM 같은 OpenAI 호환 서버도 연결합니다.
- 주제
AI 요약
Google이 Antigravity SDK에 로컬 모델 실행 기능을 추가했습니다. 초기 지원 모델은 Google AI Edge의 LiteRT로 구동하는 Gemma 4 26B A4B입니다. 모델을 내려받아 로컬에서 실행하면 인터넷 연결 없이 에이전트 기능을 사용할 수 있습니다. Google은 24GB가 넘는 VRAM 또는 통합 메모리를 갖춘 컴퓨터를 권장합니다.
LiteRT 모델로 에이전트 실행
Python 환경에 google-antigravity와 litert-lm을 설치한 뒤, Hugging Face 저장소의 모델을 LiteRT-LM 형식으로 가져옵니다. 예제 코드는 LiteRTAgentConfig에 모델 경로를 지정하고 Agent를 시작해 현재 디렉터리의 파일 목록을 묻습니다. 응답은 토큰 단위로 출력합니다. 로컬 추론은 완료까지 몇 분이 걸릴 수 있다고 안내합니다.
클라우드와 로컬 모델을 나눠 쓰는 구성
Google은 클라우드 모델을 계획 담당자, 로컬 모델을 실제 작업 담당자로 두는 Architect-Builder 패턴도 소개합니다. 데모에서는 Gemini 3.8 Flash가 작업을 계획하고 여러 Gemma 4 26B 인스턴스가 기기 안에서 실행을 맡습니다. 세 개의 취약한 모듈인 auth.py, billing.py, database.py를 점검하고 수정하는 예제를 제공하며, 사용자는 예제 프로젝트의 테스트 절차를 실행하거나 자신의 Python 모듈과 테스트 스위트를 지정할 수 있습니다.
또 다른 예제에서는 Gemma 4 26B 에이전트에 한 번의 프롬프트를 입력해 CPU·메모리 사용량과 메모리 사용량 상위 프로세스를 표시하는 터미널 모니터를 만듭니다. 에이전트는 psutil과 rich를 사용하는 Python 스크립트와 requirements.txt를 작성하고, 코드가 작동하는지 테스트합니다. 이 작업은 로컬에서 수행합니다. 예제 설정에는 에이전트가 파일을 쓸 작업 디렉터리와 허용 정책도 포함됩니다.
다른 로컬 추론 서버 연결
LiteRT 외에도 LocalOpenAIAgentConfig를 사용하면 Ollama, LM Studio, vLLM처럼 OpenAI 호환 API를 제공하는 서버를 연결할 수 있습니다. 이 경우 모델 실행 백엔드를 바꿔도 에이전트 오케스트레이션, 도구, 작업 흐름은 그대로 유지하는 구성을 제시합니다.
Reddit 반응
- @u/kaliku — 누군가 분위기를 읽고 있군요.
- @u/jreoka1 — Google은 우리를 위해 Gemma를 만들기도 하니, 로컬 모델에 반대하는 것은 아니겠죠.
- @u/LightBroom — 그저 파이의 몫을 차지하고 싶은 겁니다. 어떤 파이든요.
- @u/eli_pizza — 무료 웹 브라우저를 제공한 일이 그들에게 큰 도움이 됐는데, 무료 LLM 모델이라고 다를 이유가 있을까요.
- @u/Illustrious_Car344 — Google의 사업은 서비스입니다. 로컬 모델로 자사 서비스를 쓰게 하면 호스팅과 추론 비용을 줄일 수 있으니 그들에게도 이득입니다. Gemma는 Gemini만큼 강력하지 않을 수 있지만, 허용적인 라이선스로 공개했고 괜찮은 모델입니다.
- @u/Superb-Pair-2000 — 그들의 사업은 여러분의 데이터입니다.
- @u/Hot_Masterpiece_3668 — Google이 다른 일부 기술 회사보다 덜 악하다고 해도, 신뢰할 수 있다고 착각하지는 않겠습니다.
- @u/DoorStuckSickDuck — 아쉽네요. Antigravity IDE 자체에서는 로컬 LLM을 실행할 수 없군요.
- @u/dryadofelysium — 아직은요.
- @u/ambassadortim — 꽤 큰 소식이고 좋습니다. 기업이 AI 모델을 더 잘 통제하고, 적어도 언제 모델을 바꿀지 결정할 수 있겠네요. 작업 흐름을 배포한 뒤 기반 모델이 업데이트돼 고객 경험이 달라지는 일은 달갑지 않습니다.
- @u/Cool-Chemical-5629 — 저는 LiteRT-LM 버전 Gemma 4 26B를 실행할 수 없습니다. GGUF 양자화 버전은 실행되니 아쉽네요. Gemma 4에 표면적으로 드러난 것보다 더 많은 잠재력이 있다고 생각했습니다. 일반적인 방식으로 에이전트 코딩을 시도했을 때는 답답했는데, Gemini가 뼈대를 만드는 식으로 보조하더라도 이 방식이 실제로 작동한다면 Gemma에 에이전트 코딩 잠재력이 있다는 뜻입니다.
- @u/ThePrimeClock — 첫 출시 당시 서비스 약관은 무료 요금제를 쓰면 세션을 학습 데이터로 사용한다는 내용이었습니다. 데이터 수집을 명확히 알리지 않았습니다. Gemini CLI는 Gemini 웹 인터페이스와 별도 제품이었고, 유료 Google 계정에서 학습 데이터 제공을 꺼도 CLI에서는 무료 요금제로 취급돼 데이터가 수집·사용됐습니다. 매우 오해를 부르는 방식이었습니다.
- @u/dryadofelysium — Google AI Edge Gallery는 LiteRT-LM으로 Gemma 4를 실행하는 앱입니다. 이번에 새로 추가된 점은 Antigravity 하네스에서 사용할 수 있다는 겁니다.
원문: Google Developers Blog / 번역·요약: Trawling