Speech in the operatory. Text in your system.

Speech-to-Text Agent — 치과 진료 음성을 치과 문맥에 맞는 텍스트로

진료실 소음, 마스크 발화, 겹치는 대화 속에서도 치의학 용어를 알아듣도록 학습됐습니다.

파일 업로드와 실시간 스트리밍을 모두 지원하고, 단어·세그먼트 단위 타임스탬프를 반환합니다.

hygienist00:12.4파노라마 촬영 완료되었습니다.
dentist00:15.1파노라마상 우측 하악 임플란트 주변 상태는 안정적으로 보입니다.

핵심 기능

api reference →
realtime · file

파일·실시간 전사

녹음 파일과 WebSocket 실시간 음성을 모두 전사하며, 발화 중에는 부분 결과를 반환합니다.

domain-tuned

치과 음성 인식

치의학 전문 용어와 진료실 발화에 특화된 모델에 용어 바이어싱을 적용합니다.

diarization · timestamps

화자·시간 정보

의료진과 환자의 발화를 구분하고 단어·구간별 타임스탬프를 함께 제공합니다.

KO · EN · ZH · JA · ES

다국어 인식

한국어·영어·중국어·일본어·스페인어와 한 대화 안에서 언어가 바뀌는 발화를 지원합니다.

치과 현장에서 이렇게 활용할 수 있습니다

의료진이 말한 소견을 실시간으로 전사해 차팅 초안에 활용할 수 있습니다.

진료실 발화

CHAIRSIDE SPEECH

파노라마 촬영이 완료됐습니다.

46번 교합면에 우식이 의심됩니다. 냉검사에는 반응했지만 통증은 바로 가라앉았습니다.

치료할 때 많이 아플까요?

오늘 바로 치료해야 하나요?

치료 전에 해당 부위를 한 번 더 확인하겠습니다.

오늘은 검사 결과를 설명드리고 다음 내원 때 치료하겠습니다.

실시간 전사문

TRANSCRIPT
hygienist00:08

파노라마 촬영이 완료됐습니다.

dentist00:14

46번 교합면에 우식이 의심됩니다. 냉검사에는 반응했지만 통증은 바로 가라앉았습니다.

patient00:26

치료할 때 많이 아플까요?

guardian00:31

오늘 바로 치료해야 하나요?

hygienist00:36

치료 전에 해당 부위를 한 번 더 확인하겠습니다.

dentist00:42

오늘은 검사 결과를 설명드리고 다음 내원 때 치료하겠습니다.

이 Agent를 사용하는 솔루션AI Perio NoteAI ScribeTransEra →

치과 환경에서 측정한 결과

치과 진료 음성을 대상으로 한 덴컴 내부 평가입니다. 조건과 비교군을 함께 적었습니다.

지표Densper비교군
치과 진료 음성인식 오류율영어 치과 도메인 음성을 대상으로 측정한 전체 음성인식 오류율입니다. 값이 낮을수록 좋습니다.2.66%7.30% / 8.29%
전문용어 가중치 적용 후 오류 감소각 서비스가 용어 가중치를 켰을 때 자기 기준선 대비 오류율이 줄어든 폭입니다. 기준선이 서비스마다 달라 감소 폭끼리만 견줍니다. 값이 높을수록 좋습니다.↓ 55.5%↓ 50.0% / ↓ 7.1% / ↓ 0.0%
화자분리 처리 시간i7-13700K 8코어 CPU에서 13분 37초 오디오의 화자분리를 7.72초에 처리했습니다. 비교군은 동일 조건에서 174초 / 348초였습니다. 인식 속도가 아니라 화자분리 단계의 처리 시간입니다.7.72s174s / 348s

세 수치는 서로 다른 지표라 합산하거나 서로 비교할 수 없으며, 모두 덴컴 내부 평가 기준입니다.

치과 현장의 다국어 음성인식

한국어·영어·중국어·일본어·스페인어를 지원하며, 지원 언어를 지속적으로 확대하고 있습니다. 도입에 필요한 언어가 있다면 문의해 주세요.

Korean · 한국어English · 영어中文 · 중국어日本語 · 일본어Español · 스페인어

API 입력과 결과 예시

input
오디오 소스 
샘플 오디오 
언어 
화자분리 
result
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

고정된 예시입니다. 실제 호출 결과가 아닙니다.

코드 예시 보기
// 예시 요청. 전체 요청 스키마는 docs 참조
curl https://api.denthub.ai/stt \
  -H "X-License-Key: $DENSPER_KEY" \
  -F audio=@visit.wav -F language=ko
# → text, words[], timestamps[]
read docs

도입은 이렇게 시작합니다

01

도입 문의

적용할 제품과 진료 환경을 확인합니다.

02

PoC 설계

샘플 데이터와 연동 범위를 함께 정합니다.

03

연동 및 배포

API 또는 기관 환경에 맞는 방식으로 적용합니다.

자주 묻는 질문

실시간과 파일 전사의 차이는 무엇인가요?

실시간(WebSocket)은 발화 중 부분 결과를 즉시 반환해 자막·차팅 같은 라이브 시나리오에 맞고, 파일(File STT)은 녹음 완료 후 업로드해 전체 결과를 받는 방식입니다.

오디오 입력 형식은 무엇을 지원하나요?

입력 오디오 포맷과 스트리밍 규격은 개발자 문서의 Endpoints 항목을 참조하세요.

일반 STT와 무엇이 다른가요?

치의학 전문용어와 실제 진료실 발화 환경(소음·마스크·겹침 발화)으로 학습된 도메인 모델이며, 용어 바이어싱으로 현장 어휘를 우선 인식합니다.

한국어 외 언어도 되나요?

한국어·영어·중국어·일본어·스페인어를 지원하며, 한 대화 안에서 언어가 바뀌는 경우에도 이어서 인식합니다.

엔드포인트별 언어 지정 방식과 파라미터 값은 개발자 문서를 참조하세요.

Speech-to-Text Agent, 직접 확인해 보세요

도입 검토·PoC 설계를 파트너 엔지니어가 돕습니다.