Product Hunt

Eclatira — Conversational Video Agent That Plugs Into Any Stack

Eclatira — 어떤 기술 스택에도 연결하는 대화형 비디오 에이전트

Eclatira는 실시간 음성 대화와 카메라·화면 인식, API 실행을 하나의 엔진으로 묶은 개발자용 서비스입니다. 제작사는 MCP와 3,000개 이상의 앱 연동을 지원하며, 영상 스트림을 저장하지 않는다고 밝혔습니다.

에디터 노트

말하고 보고 실행하는 걸 하나의 엔진에 넣겠다는 제안입니다. 음성은 voice-to-voice, 영상은 카메라·화면 스트림을 같은 양방향 세션으로 처리하고, 행동은 API·MCP·3천 개 앱 연동으로 내보냅니다. 공식 수치는 초당 30프레임, 800ms 미만 지연입니다. 다만 이 수치는 제작사 주장이고, PH 댓글의 어려운 질문들—지연, 화면 일부만 보기, 셀프 호스팅—에는 답이 엇갈립니다. 실시간 스트림을 저장하지 않는 건 좋지만 셀프 호스팅은 없고 데이터 레지던시는 "계획 중"입니다. OpenAI 음성 모드의 끼어들기 문제를 의식한 듯 끼어들기 민감도를 낮췄다는 점은 눈여겨볼 만합니다.

AI 요약

Eclatira는 앱에 실시간 대화형 비디오 AI를 연결하는 개발자용 엔진입니다. 음성 입력을 듣고 말하는 동시에 카메라나 화면을 살피며, 사용자 대신 API와 외부 서비스를 실행하도록 설계했습니다. 제작사는 음성·영상·비전·도구 연동을 각각 구성하는 작업을 줄이고, 개발자가 제품 경험에 집중하도록 돕는다고 설명합니다.

제공 기능

음성과 영상, 행동 실행을 한 엔진에서 처리합니다. 음성 대화는 voice-to-voice 방식이며, 영상 입력은 카메라나 화면 스트림으로 받습니다. 외부 작업은 사용자 API, MCP 서버, 3,000개 이상의 앱 연동을 통해 실행합니다. 고객 지원, 인터랙티브 코파일럿, 화면을 보며 안내하는 도우미 등이 활용 사례로 제시됐습니다.

제작사가 밝힌 구현과 데이터 처리

제작사는 화면 변화 처리가 초당 30프레임이며, 여러 입력과 작업은 비동기로 실행한다고 답했습니다. 특정 LLM에 종속되지 않는다고 밝혔고, 대화 중 끼어들기 민감도를 낮추며 배경의 무관한 소리를 걸러낸다고 설명했습니다. 음성 상호작용은 100개 언어와 약 400개 억양을 지원한다고 답했습니다.

현재 라이브 영상 스트림은 저장하지 않으며, 셀프 호스팅은 지원하지 않습니다. 다만 지역별 데이터 레지던시 제어를 추가할 계획이라고 밝혔습니다. API나 MCP 연결의 특정 행동을 제한하고, 에이전트에 가드레일을 설정할 수 있다고 답했습니다. 외부 앱 인증과 권한 관리는 제3자 연동 서비스가 맡습니다.

Product Hunt 반응

  • @atul15 — 에이전트가 동시에 듣고 보고 작업할 때 지연을 어떻게 처리하나요? 입력 처리에 눈에 띄는 지연이 있나요?
    • @moad_rahali_semlali — 아니요. 기술이 정말 놀랍습니다!
  • @dipanshu_kushwaha5 — 음성 상호작용에서 여러 언어를 지원하나요?
    • @moad_rahali_semlali — 네. 100개 언어와 약 400개 억양을 지원합니다.
  • @hemendra_khatik — 여러 입력 스트림과 외부 API 실행 사이의 상태를 어떻게 동기화해, 지연이 커져도 대화의 일관성을 유지하나요?
    • @moad_rahali_semlali — 비동기로 실행합니다.
  • @isaac__ — 에이전트가 응답 전에 대상을 직접 살펴야 하는 작업에 유용해 보입니다. 화면이 바뀌는 상황은 얼마나 잘 처리하나요?
    • @moad_rahali_semlali — 초당 30프레임으로 처리해 변화가 빠르게 포착됩니다. 스크린샷을 복사해 턴 방식 챗봇에 붙이는 것보다 훨씬 쉽습니다. 웹사이트에 영상도 올려뒀습니다.
  • @odeth_negapatan1 — OpenAI 음성 모드가 사용자의 말이 끝나기 전에 말하기 시작하는 문제가 있었습니다. 어떤 모델을 사용하나요? 대화에 끼어들지, 사용자가 설명을 마칠 때까지 기다릴지는 어떻게 정하나요?
    • @moad_rahali_semlali — 특정 LLM에 종속되지 않아 모델을 바꾸고 있으며, 나중에는 사용자가 모델을 고르는 기능도 출시할 예정입니다. 자연스러운 대화를 위해 양쪽의 끼어들기 민감도를 낮췄습니다. 무관한 소리를 최대한 걸러내고, LLM이 배경 대화에 반응하지 않도록 처리합니다.
  • @krutiparekh16 — 에이전트가 실시간 카메라나 화면 스트림에 접근할 때 개인정보는 어떻게 보호하나요? 화면의 일부만 보도록 제한할 수 있나요?
    • @moad_rahali_semlali — 현재 라이브 스트림을 저장하지 않습니다. 사용자가 충분히 요청하지 않는 한 저장 기능을 추가하지 않을 계획이며, 추가하더라도 기본값은 꺼짐으로 두겠습니다.
  • @alira_salu — 민감한 영상 데이터를 Eclatira에 전달할 때 셀프 호스팅이나 데이터 저장 지역을 통제할 수 있나요?
    • @moad_rahali_semlali — 현재 셀프 호스팅은 지원하지 않습니다. 지역별 데이터 레지던시 제어를 출시할 예정입니다. 현재 영상 피드는 저장하지 않으며, 데이터 통제 기능도 추가할 계획입니다.
  • @james_frank9 — 에이전트가 할 수 있는 행동을 제한할 수 있나요?
    • @moad_rahali_semlali — LLM이 따를 가드레일을 설정하고, MCP나 API 연결에서 특정 행동을 제한할 수 있습니다.
  • @subhash_kanagamani — 3,000개 이상의 연동 앱에서 인증과 권한을 어떻게 처리하나요? 지원 앱 목록도 있나요?
    • @moad_rahali_semlali — 제3자 서비스와 연동해 인증과 권한 관리를 맡기고 있습니다.

원문: Product Hunt / 번역·요약: Trawling