1P by ethanfeng | ★ favorite | 댓글 1개

안녕하세요. 회의나 인터뷰를 녹음해 두고도, 나중에 필요한 문장 하나를 찾으려면 결국 파일을 처음부터 다시 들어야 하는 불편이 있었습니다.

이 문제를 줄여보려고 ToText를 만들었습니다.

처음에는 음성을 텍스트로 변환하는 기능만 있으면 충분하다고 생각했습니다. 그런데 실제 파일을 사용해 보니 전사 이후에 하는 일이 더 많았습니다.

사람 이름이나 숫자를 수정해야 했고, 여러 명이 대화한 경우에는 화자를 정리해야 했습니다. 정확한 문장을 확인하려면 원본 녹음의 해당 위치도 다시 찾아야 했습니다.

그래서 결과 화면에서 원본 파일과 전사 내용을 함께 볼 수 있도록 만들었습니다. 각 문장에는 타임스탬프가 있고, 문장을 클릭하면 해당 구간부터 바로 재생됩니다.

현재 지원하는 기능은 다음과 같습니다.

  • MP3, MP4, M4A, MOV, WAV, WebM 등 음성·영상 파일 업로드
  • 자동 언어 감지
  • 타임스탬프가 포함된 편집 가능한 전사 결과
  • 화자 인식과 화자 이름 수정
  • 텍스트 검색 및 원본 구간 재생
  • 요약, 회의록, 자동 챕터, 액션 아이템 생성
  • TXT, DOCX, PDF, SRT, VTT, CSV, JSON 내보내기

인터뷰, 팟캐스트, 회의 녹음은 MP3 to Transcript 흐름으로 처리할 수 있고, 웨비나나 강의·회의 영상은 MP4 to Transcript 흐름으로 같은 편집 화면에서 작업할 수 있습니다.

현재 신규 계정에는 신용카드 등록 없이 무료 전사 3회를 제공하고 있습니다.

아직 계속 개선 중이라 다음 부분에 대한 의견을 듣고 싶습니다.

  1. 긴 전사 내용을 검토할 때 가장 필요한 기능
  2. 요약, 회의록, 자막 중 실제로 가장 자주 사용하는 결과물
  3. 편집 화면에서 불편하거나 이해하기 어려운 부분

직접 사용해 보시고 버그나 개선 의견을 남겨주시면 감사하겠습니다.

댓글과 토론

영상 , 녹음 모두 서버로 서빙되는 건가요?