Scribe v2
ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다.
ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다.
일반 영어 개요
Scribe v2는 언어 감지, 단어 타임스탬프, 화자 분할 및 음성 이외의 이벤트에 대한 오디오 태그를 통해 긴 오디오 또는 비디오를 구조화된 기록으로 변환합니다. 핵심 용어 프롬프트는 팀이 일반 인식 모델이 종종 놓치는 이름, 제품 및 어휘를 보존하는 데 도움이 됩니다.
ElevenLabs는 파일 전사 및 별도 가격의 실시간 경로를 제공합니다. 더 폭넓은 플랫폼은 또한 단일 공급업체 오디오 파이프라인을 단순화할 수 있는 음성 및 에이전트 제품을 제공하지만 각 기능에는 자체 청구 및 데이터 제어 기능이 있습니다.
카테고리 비교
이는 Cody 벤치마크 점수가 아닌 공급자가 게시한 사양입니다. 현재 제한 및 엔드포인트별 예외는 연결된 소스를 따르세요.
요금 및 비교
사용량을 입력하면 예상 비용이 바로 업데이트됩니다.
녹음 길이를 시간 단위로 입력합니다. 30분은 0.5시간입니다. 추가 기능과 최소 요금에 따라 청구액이 달라질 수 있습니다.
Scribe v2
ElevenLabs
예상 총액 (USD)
위 사용량 기준 · USD · 구독료가 아닌 API 요금
세금, 도구, 캐시 저장·쓰기, 무료 할당량, 개별 할인은 제외됩니다. 이미지 비용은 출력만 포함하며 프롬프트와 참조 이미지 비용은 제외됩니다. 품질 모드는 모델마다 다릅니다. 미등록 설정은 무료로 간주하지 않습니다.
API 및 공급자 액세스
가용성
ElevenLabs 음성-텍스트 API 및 제품 인터페이스를 통해 사용 가능합니다. 실시간은 별도의 모델 경로를 사용합니다.
글로벌 및 데이터 상주 옵션은 ElevenLabs 계획, 엔드포인트 및 엔터프라이즈 구성에 따라 달라집니다.
실시간 가용성 확인데이터 및 교육
ElevenLabs를 통해 적격 API 고객은 데이터 사용 기본 설정을 관리할 수 있습니다. Enable_logging=false를 통한 제로 데이터 보존은 Scribe v2를 포함하여 적격 엔터프라이즈 구성 및 지원 모델로 제한됩니다. 실시간 계획과 지역 엔드포인트를 확인하세요.
이는 법적 조언이 아닌 인용된 제공자 자료에 대한 간략한 설명입니다. 타사 게이트웨이는 모델 제작자의 직접 API와 다른 스토리지, 라우팅, 교육 및 상주 조건을 가질 수 있습니다.
공급자 정책 읽기자주 묻는 질문
ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다. Scribe v2는 언어 감지, 단어 타임스탬프, 화자 분할 및 음성 이외의 이벤트에 대한 오디오 태그를 통해 긴 오디오 또는 비디오를 구조화된 기록으로 변환합니다. 핵심 용어 프롬프트는 팀이 일반 인식 모델이 종종 놓치는 이름, 제품 및 어휘를 보존하는 데 도움이 됩니다.
Scribe v2는 인용된 공급자 자료에 따라 2026년 1월 9일에서 릴리스되었습니다.
ElevenLabs 음성-텍스트 API 및 제품 인터페이스를 통해 사용 가능합니다. 실시간은 별도의 모델 경로를 사용합니다. 이 가이드에 나열된 액세스 경로는 ElevenLabs 및 ElevenLabs API입니다.
Scribe v2의 경우 $0.22/오디오 시간. ElevenLabs에는 배치 Scribe v2 및 Scribe v2 Realtime에 대한 별도의 가격이 나와 있습니다. 엔터티 감지 및 수정 비용은 별도로 청구될 수 있습니다.
ElevenLabs 음성-텍스트 API 및 제품 인터페이스를 통해 사용 가능합니다. 실시간은 별도의 모델 경로를 사용합니다. 글로벌 및 데이터 상주 옵션은 ElevenLabs 계획, 엔드포인트 및 엔터프라이즈 구성에 따라 달라집니다.
ElevenLabs를 통해 적격 API 고객은 데이터 사용 기본 설정을 관리할 수 있습니다. Enable_logging=false를 통한 제로 데이터 보존은 Scribe v2를 포함하여 적격 엔터프라이즈 구성 및 지원 모델로 제한됩니다. 실시간 계획과 지역 엔드포인트를 확인하세요. 정책은 공급자 경로 및 계정 조건에 속하므로 프로덕션 사용 전에 다시 확인하십시오.
관련 비교
라이브 캡션, 긴 오디오, 다수의 화자, 코드 전환 및 도메인 인식 전사를 위한 Meta의 스트리밍 음성 인식 모델입니다.
전체 비교 열기긴 녹음, 화자 레이블, 단어 타이밍, 키워드 편향 및 깔끔한 또는 축어적 대본을 위한 Microsoft의 빠른 일괄 대본 모델입니다.
전체 비교 열기다양한 언어와 지역에서 스트리밍, 파일 및 저렴한 동적 배치 전사를 위한 Google Cloud의 일반 음성-텍스트 모델입니다.
전체 비교 열기코드 전환, 화자 레이블, 타임스탬프 및 상황에 맞는 프롬프트를 갖춘 파일 및 라이브 오디오용 AssemblyAI의 정확성 중심 전사 모델입니다.
전체 비교 열기