Product Hunt

Invofox Self Serve — 99% accurate document extraction, SLA guaranteed

Invofox Self Serve — SLA로 보장하는 문서 데이터 추출 정확도 99%

Invofox Self Serve는 문서를 구조화된 JSON으로 변환하는 개발자용 문서 파싱 API입니다. OCR부터 분류·추출·검증까지 한 엔드포인트에서 처리하며, 정확도 SLA를 제공하고 추출 오류가 난 문서는 요금을 받지 않습니다.

AI 요약

Invofox Self Serve는 다양한 형식의 문서를 구조화된 JSON으로 바꾸는 문서 파싱 API입니다. 파일을 엔드포인트 하나에 보내면 OCR, 분류, 데이터 추출, 검증, 예외 처리와 모니터링을 수행합니다. Invofox는 정확도 99% 이상을 내세우며, 추출 오류가 난 문서는 요금을 청구하지 않는다고 설명합니다.

처리 파이프라인과 요금

제품 소개 댓글에 따르면 파이프라인은 문서 접수, 이중 패스 OCR, 문서 분할, 분류, 추출, 필드 간 검증, 신뢰도 점수 산정, 출처 정보 기록, 피드백 반영으로 구성됩니다. 저품질 스캔에는 방향 보정, 기울기 교정, 노이즈 제거, 대비 개선을 적용한 뒤 문서 품질에 따라 OCR 엔진을 선택합니다. 고객 피드백도 추출 개선에 반영합니다.

요금은 페이지 단위이며 사용량이 늘면 페이지당 가격이 낮아집니다. 무료 이용량은 기본 500페이지이며, Product Hunt 가입자에게는 출시 기간에 1,000페이지를 추가해 총 1,500페이지를 제공합니다. 신용카드 등록은 필요하지 않습니다. 표준 문서용 사전 정의 스키마와 사용자 정의 스키마를 모두 지원합니다. 민감한 문서 처리를 위해 데이터 보존 없는 설정과 온프레미스 배포도 제공한다고 밝혔습니다.

Product Hunt 반응

  • @alberto_gimeno — 안녕하세요, Product Hunt 여러분 👋 문서 처리를 맡은 좋은 엔지니어링 팀들이 분기 전체를 허비하는 모습을 계속 보면서 Invofox를 시작했습니다. 주말에 만든 시제품은 늘 잘 작동합니다. 그러다 스캔 팩스, 여러 문서가 섞인 PDF, 세 페이지에 걸친 표, 각주에만 나오는 납세자 번호가 등장하면 엔지니어 두 명이 제품을 만드는 대신 OCR 파이프라인을 유지보수하게 됩니다. 그래서 파이프라인을 한 번 제대로 만들었습니다. 문서 접수, 이중 패스 OCR, 분할, 분류, 추출, 필드 간 검증, 신뢰도 점수 산정, 출처 정보 기록, 피드백 반영까지 갖췄습니다. 파일을 엔드포인트 하나에 POST하면 검증된 JSON을 돌려줍니다. 지난 몇 년 동안 이 기능은 기업 계약을 맺은 고객만 쓸 수 있었습니다. 유럽과 미국의 대형 기술 기업과 대기업을 지원하느라 바빴고, 소규모 팀이 영업 통화 없이 직접 시험하는 방법은 만들지 못했습니다. 그 점이 늘 마음에 걸렸습니다. 오늘 바뀝니다. Invofox Self Serve는 기존 파이프라인과 같은 정확도 기준을 유지하면서 가입 양식만으로 시작할 수 있습니다. 저희가 가장 중요하게 여기는 점은 두 가지입니다. 정확도를 SLA에 포함하고, 오류가 난 문서는 전액 무료로 처리합니다. 요금은 페이지 단위이고 사용량이 많을수록 낮아지며, 복잡한 크레딧 체계는 없습니다. Product Hunt 무료 요금제는 신용카드 없이 500페이지를 제공하고, 여기서 가입하면 1,000페이지를 더 드립니다. 가장 까다로운 문서를 보내주세요. 기존 파서가 망가졌던 문서도 좋습니다. 직접 보고 싶습니다. 하루 종일 댓글을 확인하겠습니다.
    • @james_kerr2 — 예전에는 대기업만 쓸 수 있었다는 점을 솔직히 밝혀주시고 서비스를 공개해주셔서 감사합니다, 팀 여러분! 카드 없이 무료 500페이지를 쓸 수 있으니 시험하기 편하네요.
    • @priya_kushwaha1 — POST 요청 한 번으로 깔끔한 JSON을 받으면 보일러플레이트 코드가 많이 줄겠네요.
    • @nachogaldon — 감사합니다, Priya. Invofox의 목표는 기술팀이 문서 추출을 간단하게 처리하고 제품 로드맵과 핵심 기능에 집중하게 하는 것입니다.
    • @priya_kushwaha1 — 기술팀에 실질적인 차이를 만드는 간편함이 바로 이런 거네요.
  • @alieksia — 좋은 아이디어네요 :) 민감한 정보를 로컬에서 처리할 수 있나요?
    • @alberto_gimeno — 네, 데이터 보존 없는 설정과 온프레미스 배포를 지원합니다! 팀에 문의하시면 기꺼이 도와드리겠습니다.
    • @nachogaldon — 물론입니다! 데이터 보존 없는 설정과 온프레미스 배포도 제공합니다.
  • @new_usergreg3 — 소규모 팀도 쓸 수 있게 해주셔서 감사합니다, 하하. 시험 삼아 써보려고 영업 통화를 예약하는 일은 귀찮았는데, 카드 없이 무료 500페이지를 제공하니 시작하기 쉽네요.
    • @alberto_gimeno — 고맙습니다, Greg! 출시 기간에는 실제로 1,500페이지를 드립니다. 사용해보신 뒤 의견을 듣고 싶습니다!
  • @rohit62661 — 문서 파싱에서 늘 어려운 부분은 지저분하거나 품질이 낮은 스캔인데, Invofox는 그런 문서를 얼마나 잘 처리하나요?
    • @nachogaldon — 동감합니다. 테스트용으로 만든 깔끔한 PDF는 실제 운영 환경을 반영하지 못합니다. 저품질 스캔을 처리할 때는 먼저 방향 보정, 기울기 교정, 노이즈 제거, 대비 개선을 합니다. 그런 다음 문서 품질에 맞춰 OCR 엔진을 선택합니다. 각 고객의 피드백도 시간이 지나면서 추출을 조정하는 데 씁니다. 필요한 데이터를 정확히 추출하지 못하면 해당 문서에는 요금을 받지 않습니다.
  • @aymi_malik — 좋은 아이디어네요! 문서 유형마다 직접 스키마를 만들 수 있나요, 아니면 송장, 영수증, 은행 명세서 같은 사전 정의 스키마를 선택해야 하나요? @nachogaldon, @alberto_gimeno와 Invofox Self Serve 팀 축하합니다 ✌️🚀
    • @nachogaldon — 응원해주셔서 감사합니다! 두 가지 모두 가능합니다. 송장, 영수증, 은행 명세서 같은 일반 문서에는 사전 정의 스키마를 바로 쓸 수 있습니다. 사용자 정의 양식이나 추출할 특정 필드가 있다면 업무 흐름에 맞춰 스키마를 직접 정의하면 됩니다.
    • @aymi_malik — 설명해주셔서 감사합니다 :)
  • @angelaaa — 여러 국가와 형식의 송장을 대상으로 추출 정확도를 비교한 실제 벤치마크를 보고 싶습니다.
    • @alberto_gimeno — 제안 감사합니다, Angela! 바로 그런 자료를 만들고 있으며 곧 공개할 예정입니다. 가입하면 공개 시 자동 알림을 받습니다.
  • @monir_ — 검증과 피드백 기능이 눈에 들어왔습니다. 보통 신뢰할 만한 구조화 데이터를 얻는 일은 문서 내용을 읽는 것보다 어렵습니다.
    • @alberto_gimeno — 맞습니다! 어떤 문서를 처리하려고 하시나요?
    • @nachogaldon — 정말 그렇습니다!

원문: Product Hunt / 번역·요약: Trawling