모든 모델
ElevenLabs

Scribe v2

ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다.

일반 영어 개요

Scribe v2는 실제로 무엇입니까?

Scribe v2는 언어 감지, 단어 타임스탬프, 화자 분할 및 음성 이외의 이벤트에 대한 오디오 태그를 통해 긴 오디오 또는 비디오를 구조화된 기록으로 변환합니다. 핵심 용어 프롬프트는 팀이 일반 인식 모델이 종종 놓치는 이름, 제품 및 어휘를 보존하는 데 도움이 됩니다.

ElevenLabs는 파일 전사 및 별도 가격의 실시간 경로를 제공합니다. 더 폭넓은 플랫폼은 또한 단일 공급업체 오디오 파이프라인을 단순화할 수 있는 음성 및 에이전트 제품을 제공하지만 각 기능에는 자체 청구 및 데이터 제어 기능이 있습니다.

다음에 적합

  • 다국어 미디어 전사
  • 여러 스피커 또는 사운드 이벤트가 포함된 녹음
  • 이미 ElevenLabs를 사용하고 있는 오디오 스택

카테고리 비교

전사 모델에 중요한 사실

이는 Cody 벤치마크 점수가 아닌 공급자가 게시한 사양입니다. 현재 제한 및 엔드포인트별 예외는 연결된 소스를 따르세요.

전사 가격
$0.22 / 오디오 시간; 실시간은 별도로 나열됨나열된 처리 경로에 대한 오디오 시간 또는 분당 현재 공급자 가격입니다.
라이브 또는 배치
일괄 및 긴 오디오; 별도의 실시간 경로모델이 실시간 스트림, 업로드된 녹음 또는 둘 다를 처리하는지 여부입니다.
언어
90개 이상의 언어공급자가 게시한 언어 적용 범위, 필요한 경우 특별히 검증된 언어와 훈련되거나 광고된 적용 범위를 분리합니다.
화자 라벨
최대 32개의 스피커모델이 발언한 사람과 발표된 발언자 수 제한을 식별하는지 여부입니다.
타임스탬프
단어 수준 타임스탬프사용 가능한 단어, 세그먼트 또는 발화 수준 타이밍 정보.
어휘 통제
최대 1,000개의 핵심 용어; 오디오 태그 및 언어 감지키워드 부스팅, 맞춤 철자법, 문맥, 프롬프트 또는 도메인 용어를 개선하는 기타 방법입니다.
사용처
ElevenLabs 음성-텍스트 API공급자가 문서화한 다이렉트 API, 클라우드 카탈로그, 애플리케이션 또는 지역 엔드포인트입니다.

요금 및 비교

비용 예상하기

사용량을 입력하면 예상 비용이 바로 업데이트됩니다.

녹음 길이를 시간 단위로 입력합니다. 30분은 0.5시간입니다. 추가 기능과 최소 요금에 따라 청구액이 달라질 수 있습니다.

Scribe v2

ElevenLabs

예상 총액 (USD)

검토된 요금 없음

위 사용량 기준 · USD · 구독료가 아닌 API 요금

예상 비용 계산 방식

세금, 도구, 캐시 저장·쓰기, 무료 할당량, 개별 할인은 제외됩니다. 이미지 비용은 출력만 포함하며 프롬프트와 참조 이미지 비용은 제외됩니다. 품질 모드는 모델마다 다릅니다. 미등록 설정은 무료로 간주하지 않습니다.

API 및 공급자 액세스

Scribe v2를 얻을 수 있는 곳

가용성

지역 및 액세스 단계

ElevenLabs 음성-텍스트 API 및 제품 인터페이스를 통해 사용 가능합니다. 실시간은 별도의 모델 경로를 사용합니다.

글로벌 및 데이터 상주 옵션은 ElevenLabs 계획, 엔드포인트 및 엔터프라이즈 구성에 따라 달라집니다.

실시간 가용성 확인

데이터 및 교육

경로가 중요합니다.

ElevenLabs를 통해 적격 API 고객은 데이터 사용 기본 설정을 관리할 수 있습니다. Enable_logging=false를 통한 제로 데이터 보존은 Scribe v2를 포함하여 적격 엔터프라이즈 구성 및 지원 모델로 제한됩니다. 실시간 계획과 지역 엔드포인트를 확인하세요.

이는 법적 조언이 아닌 인용된 제공자 자료에 대한 간략한 설명입니다. 타사 게이트웨이는 모델 제작자의 직접 API와 다른 스토리지, 라우팅, 교육 및 상주 조건을 가질 수 있습니다.

공급자 정책 읽기

자주 묻는 질문

Scribe v2 FAQ

Scribe v2란 무엇입니까?

ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다. Scribe v2는 언어 감지, 단어 타임스탬프, 화자 분할 및 음성 이외의 이벤트에 대한 오디오 태그를 통해 긴 오디오 또는 비디오를 구조화된 기록으로 변환합니다. 핵심 용어 프롬프트는 팀이 일반 인식 모델이 종종 놓치는 이름, 제품 및 어휘를 보존하는 데 도움이 됩니다.

Scribe v2는 언제 출시되었나요?

Scribe v2는 인용된 공급자 자료에 따라 2026년 1월 9일에서 릴리스되었습니다.

Scribe v2에 어디서 접속할 수 있나요?

ElevenLabs 음성-텍스트 API 및 제품 인터페이스를 통해 사용 가능합니다. 실시간은 별도의 모델 경로를 사용합니다. 이 가이드에 나열된 액세스 경로는 ElevenLabs 및 ElevenLabs API입니다.

Scribe v2의 가격은 얼마입니까?

Scribe v2의 경우 $0.22/오디오 시간. ElevenLabs에는 배치 Scribe v2 및 Scribe v2 Realtime에 대한 별도의 가격이 나와 있습니다. 엔터티 감지 및 수정 비용은 별도로 청구될 수 있습니다.

Scribe v2는 어디에서 사용할 수 있나요?

ElevenLabs 음성-텍스트 API 및 제품 인터페이스를 통해 사용 가능합니다. 실시간은 별도의 모델 경로를 사용합니다. 글로벌 및 데이터 상주 옵션은 ElevenLabs 계획, 엔드포인트 및 엔터프라이즈 구성에 따라 달라집니다.

내 Scribe v2 API 데이터가 교육에 사용됩니까?

ElevenLabs를 통해 적격 API 고객은 데이터 사용 기본 설정을 관리할 수 있습니다. Enable_logging=false를 통한 제로 데이터 보존은 Scribe v2를 포함하여 적격 엔터프라이즈 구성 및 지원 모델로 제한됩니다. 실시간 계획과 지역 엔드포인트를 확인하세요. 정책은 공급자 경로 및 계정 조건에 속하므로 프로덕션 사용 전에 다시 확인하십시오.