Opengeni — Ship AI agents within minutes. Infrastructure for Agents
Opengeni — AI 에이전트를 빠르게 출시하는 인프라
Opengeni는 세션 복구, 격리 샌드박스, OAuth 연동, 사람 승인, 실행 기록과 비용 추적을 묶은 오픈소스 AI 에이전트 인프라입니다. 장시간 실행과 서버리스 연동 방식, PostgreSQL 부하에 관한 개발팀의 답변도 공개됐습니다.
- 주제
AI 요약
Opengeni는 제품에 AI 에이전트를 넣으려는 팀을 위한 인프라입니다. Cloudgeni 팀은 지난 2년간 실제 운영 환경에서 에이전트를 돌리며 모델 자체보다 실행 실패 복구, 안전한 코드 실행 공간, 사용자별 OAuth 토큰 연결, 위험 작업 승인, 실행 내역과 비용 파악에 더 많은 작업이 든다고 설명합니다. 이런 기반 기능을 반복해서 만들다가 Opengeni로 분리했습니다.
에이전트 실행에 필요한 기능
세션은 오류가 나도 이어서 실행하며, 기록을 재생해 이전 작업을 확인하고 다시 연결할 수 있습니다. 에이전트가 작업할 격리 샌드박스에는 자격 증명 처리와 메모리가 포함됩니다. OpenAPI나 GraphQL 명세, MCP 서버를 연결할 수 있고, 100개 이상의 통합 기능과 내장 OAuth도 제공합니다. 위험한 작업에는 사람이 승인할 수 있으며, 대시보드와 실행 추적으로 단계별 기록과 토큰·비용을 확인합니다. 고객별 워크스페이스를 지원하고 모델 선택도 제한하지 않습니다.
제품에 연결하려면 서버에 API 키를 추가하고, 기존 인증을 사용하는 핸들러를 마운트한 뒤, 자체 UI나 Opengeni의 React 컴포넌트로 에이전트를 표시하면 됩니다. 임베딩하기 전에 Opengeni 앱에서 같은 세션 기능을 시험할 수도 있습니다. Apache-2.0 라이선스로 공개하며 무료 자체 호스팅을 지원합니다. 관리형 클라우드는 모델 비용에 5%를 더하고 플랫폼·좌석 요금은 받지 않는다고 안내합니다. 출시 시점에는 첫 100명에게 클라우드 크레딧 100달러를 제공합니다.
장시간 실행과 확장 방식
개발팀은 장시간 실행을 위해 클라이언트 연결을 계속 열어둘 필요가 없다고 답했습니다. 메시지를 보내면 202 응답을 받은 뒤 백그라운드 워커가 작업을 이어갑니다. 스트림을 닫아도 작업은 취소되지 않으며, 하위 에이전트는 연결이 아니라 PostgreSQL을 통해 결과를 보고합니다. 스트리밍 대신 웹훅을 받아 이벤트를 조회할 수도 있습니다. SSE 연결을 서버리스 함수로 중계하면 연결이 열린 채 비용이 발생하므로 웹훅 사용을 권했습니다. MCP 엔드포인트는 Streamable HTTP를 지원합니다.
Opengeni 코어는 현재 스케일 투 제로(scale-to-zero)를 지원하지 않습니다. 워커가 계속 실행돼야 하며 Kubernetes나 네이티브 클라우드 환경에 배포합니다. 반면 SDK를 사용하는 고객 백엔드는 엣지 런타임에서 서버리스로 실행할 수 있습니다.
PostgreSQL 부하에 관한 질문에는 유휴 세션은 데이터베이스에 행으로 남을 뿐, 열린 워크플로나 주기적 조회를 만들지 않는다고 설명했습니다. 실제 부하는 턴이 스트리밍되는 동안 발생합니다. 토큰 기록은 33밀리초마다 또는 이벤트 50개마다 묶어 저장하며, 이 작업은 기본 세션 행을 갱신하지 않아 활성 스트림끼리 해당 행을 놓고 경쟁하지 않습니다. 실시간 구독자에게는 NATS 알림을 보내고 데이터는 PostgreSQL에서 읽습니다. API는 무상태 구조라 복제본을 추가해 확장한다고 밝혔습니다.
적용 대상과 공개 상태
개발팀은 기존 SaaS 제품에 에이전트를 추가하려는 팀을 주요 사용자로 들었습니다. 사용자와 조직의 경계를 유지하면서 간단한 시작부터 확장까지 이어가려는 경우를 겨냥합니다. 제품은 초기 공개 프리뷰 단계이며, 팀은 사용자 피드백을 요청했습니다.
Product Hunt 반응
- @priya_kushwaha1 — 활성 세션이 수천 개로 늘어날 때 PostgreSQL 성능에 어떤 영향이 있는지 물었습니다.
- @davletdz — 유휴 세션은 사실상 비용이 들지 않습니다. 워크플로를 열어두거나 PostgreSQL을 계속 조회하지 않고 행만 남겨둡니다. 실제 작업은 턴을 스트리밍할 때 발생합니다. 토큰 기록을 33밀리초마다 또는 이벤트 50개마다 묶어 저장하고, 기본 세션 행은 건드리지 않아 여러 스트림이 그 행을 두고 경쟁하지 않습니다. 실시간 구독자에게는 NATS 알림을 보내고 PostgreSQL에서 읽습니다. API는 무상태라 복제본을 추가하면 됩니다.
- @prastik — 현재 SSE를 지원하는 것으로 보이는데, 장시간 실행하는 멀티 에이전트 작업에 연결을 계속 열어두지 않는 효율적인 스트리밍 방식이 있는지 물었습니다. 서버리스 배포 지원 여부도 질문했습니다.
- @davletdz — 장시간 작업은 연결을 열어두지 않아도 됩니다. 메시지를 보내면 202 응답을 받고, 백그라운드 워커가 에이전트 작업을 이어갑니다. 스트림을 닫아도 취소되지 않습니다. 웹훅을 쓰면 필요할 때 이벤트를 가져올 수 있고, 다시 스트리밍하면 이어서 볼 수 있습니다. MCP 엔드포인트는 Streamable HTTP를 지원합니다. 코어는 현재 스케일 투 제로가 되지 않아 워커를 계속 실행해야 합니다. 자체 백엔드는 SDK가 엣지 런타임에서 동작하므로 서버리스로 운영할 수 있습니다. SSE를 함수로 중계하면 연결이 계속 열려 비용이 들 수 있어 웹훅을 권합니다.
- @hakon_hogetveit1 — LangGraph 같은 프레임워크나 클라우드 제공업체를 이용해 직접 에이전트 인프라를 구축하는 팀과 Opengeni가 어떻게 다른지 물었습니다.
- @benyhh — 팀이 직접 만들 수도 있지만, 실제로 해보면 AI 인프라에는 시작한 뒤에야 드러나는 고려 사항이 많습니다. 이미 마련된 인프라를 쓰면 제품 자체에 집중할 수 있습니다. 오픈소스라 자체 호스팅하고 필요에 맞게 수정할 수도 있습니다.
- @aymi_malik — 에이전트와 세션별 지출을 확인하는 기능을 좋게 봤습니다. 예산 한도를 설정하고 한도에 도달하면 실행을 멈추는 기능이 있는지 물었습니다.
- @davletdz — 사용자와 세션별 비용을 포함해 모든 항목을 추적하고, 한도와 가드레일도 갖추고 있습니다. 두 기능을 결합하는 제안은 GitHub에 남겨달라고 답했습니다.
- @simona_o_neill3 — 어떤 유형의 회사나 제품이 Opengeni를 가장 유용하게 쓸지 질문했습니다.
- @davletdz — 기존 SaaS 제품에 에이전트를 도입하면서 사용자·조직 경계를 깨뜨리지 않고 아키텍처를 설계하는 데 어려움을 겪는 팀을 언급했습니다. 간단한 시작점에서 개념 검증(PoC)을 넘어 확장할 수 있도록 돕는다고 답했습니다.
- @atlemk — We Are Learning이 1년 동안 Opengeni를 사용했으며, 보안을 갖추고 에이전트를 도입하려는 스타트업과 성장 기업에 추천한다고 밝혔습니다.
- @davletdz — 함께 일한 기업과 성장하는 조직의 요구에 맞춰 의미 있는 영향을 만드는 일이 좋았다고 답했습니다.
원문: Product Hunt / 번역·요약: Trawling