Product Hunt

Speechka — Real-time voice translation that sounds like you

Speechka — 내 목소리로 들려주는 실시간 음성 번역

Speechka는 말하는 내용을 실시간으로 번역해 사용자의 목소리로 전달하는 서비스입니다. 44개 언어를 지원하며 macOS와 Windows 앱, 무료 브라우저 버전을 제공합니다. 제작자는 평균 번역 전달 시간이 약 1.5초라고 밝혔습니다.

AI 요약

Speechka는 사용자가 자연스럽게 말하면 내용을 실시간으로 번역하고, 상대에게 사용자의 목소리로 전달하는 음성 번역 서비스입니다. 회의와 통화, 라이브 방송, 발표, 컨퍼런스에서 쓸 수 있으며 44개 언어를 지원합니다. macOS와 Windows용 앱이 있고, 설치 없이 브라우저에서 무료로 사용해 볼 수도 있습니다.

번역 지연과 음성 처리

제작자는 제품과 인터페이스, 기술 구현을 직접 맡았으며 번역 품질과 음성 품질, 지연 시간 사이의 균형을 맞추는 데 많은 작업을 들였다고 설명합니다. 최신 버전의 평균 번역 전달 시간은 약 1.5초입니다. 음성 출력이 시작된 뒤에는 구간 사이 지연이 거의 없고, 발화를 끝까지 기다리지 않고 의미가 분명해지는 시점부터 번역을 시작한다고 밝혔습니다. 제작자는 이 방식으로 문맥을 유지한다고 설명하지만, 겹쳐 말하기나 긴 중간 멈춤이 있는 상황의 처리 방식은 댓글에서 질문으로 남았습니다.

요금과 지원 언어

댓글에서 크레딧 사용 방식도 소개됐습니다. 번역 모드를 사용할 때 크레딧이 차감되며, 1크레딧은 사용 시간 1분에 해당합니다. 구독에 포함된 크레딧을 다 쓰면 추가 구매가 가능하고, 제작자는 먼저 무료 체험을 권했습니다. 한 이용자는 다른 번역 도구에서 보기 드문 펀자브어 지원을 반겼습니다.

Product Hunt 반응

  • @dmytro_ivanchenko — 언어 장벽 때문에 실시간 대화가 불필요하게 어려운 문제를 해결하고 싶어 Speechka를 만들었습니다. 번역 도구 대부분은 멈춰서 입력하거나, 읽거나, 별도의 번역 음성을 들을 시간이 있을 때 잘 작동합니다. 저는 대화 자체의 일부가 되는 도구를 원했습니다. 자연스럽게 말하면 Speechka가 실시간으로 번역하고, 상대방은 제 목소리로 번역된 말을 듣습니다. 제품과 인터페이스부터 기술 구현까지 전 과정을 직접 만들었습니다. 번역 품질, 음성 품질, 지연 시간의 적절한 균형을 찾는 데 많은 작업이 들었습니다. 최신 버전은 음성을 자연스럽게 유지하면서 평균 번역 전달 시간을 약 1.5초로 줄였습니다. 현재 44개 언어를 지원하고 macOS와 Windows에서 사용할 수 있습니다. 설치 없이 무료로 체험할 브라우저 버전도 만들었습니다. 특히 여러분의 언어와 억양에서 Speechka가 어떻게 작동하는지 의견을 듣고 싶습니다. 피드백을 환영합니다.
  • @tahir21 — 며칠 전 고객과 회의했는데 상대방의 영어 실력이 그리 좋지 않았고 제 영어도 완벽하지 않아 소통이 조금 어려웠습니다. 그때 Speechka가 있었다면 회의가 훨씬 수월했을 것 같습니다. 여러 번역 도구에서 보기 힘든 펀자브어를 포함해 44개 언어를 지원하는 점도 반갑습니다. 크레딧은 어떻게 계산하나요? 회의 시간이나 사용한 분을 기준으로 하나요? 제품이 정말 좋다고 생각합니다. 출시를 응원합니다.
    • @dmytro_ivanchenko — 따뜻한 응원에 정말 감사드립니다. 번역 모드를 실행하면 크레딧을 사용하며, 1크레딧은 1분 사용에 해당합니다. 구독에 포함된 크레딧을 다 쓰면 추가로 구매할 수 있습니다. 먼저 무료 체험으로 앱이 잘 맞는지 확인해 보시길 권합니다.
  • @igorgurovich — 평균 전달 시간 1.5초라는 수치가 눈에 띄었습니다. 저는 매일 고령의 부모님에게 전화를 거는 음성 AI Callie Care를 만들고 있습니다. 침묵이 2초를 넘으면 어르신은 전화가 끊겼다고 생각하고 말을 시작하기도 합니다. 그 정도 지연에서 발화 순서를 어떻게 처리하나요? 발화 종료 감지에 의존하나요, 아니면 중간 번역을 스트리밍한 뒤 수정하나요? 말이 느린 사람이 문장 중간에 길게 멈추면 단순한 VAD 임계값은 제대로 작동하지 않습니다. 번역까지 더해지면 상황이 더 어려워질 것 같습니다.
    • @dmytro_ivanchenko — 음성 출력 스트림이 시작된 뒤에는 구간 사이에 사실상 지연이 없어 스트림이 매끄럽게 느껴집니다. 발화가 끝날 때까지 기다리지 않고 생각의 의미가 분명해지는 순간 시작합니다. 이렇게 이어지는 방식으로 조각난 말이 아니라 전체 문맥을 유지합니다.
  • @galdayan — 저희도 음성 AI 제품을 운영해서 겹쳐 말하기 상황을 특히 시험해 보고 싶습니다. 실제 통화에서는 사람들이 말을 끊거나 동시에 말하는 일이 흔합니다. 상대가 문장 중간에 끼어들면 번역이 자연스럽게 처리되나요, 아니면 깔끔하게 번역하려면 화자가 완전히 멈춰야 하나요? 실제 상황에서는 이런 부분에서 실시간 음성 도구가 데모 대본만큼 잘 작동하지 않는 경우가 많습니다.

원문: Product Hunt / 번역·요약: Trawling