Scribe v2
Wielojęzyczny model zamiany mowy na tekst ElevenLabs umożliwiający szczegółowe transkrypcje z wieloma mówcami, synchronizacją słów, zdarzeniami audio i dużymi niestandardowymi listami kluczowych terminów.
Wielojęzyczny model zamiany mowy na tekst ElevenLabs umożliwiający szczegółowe transkrypcje z wieloma mówcami, synchronizacją słów, zdarzeniami audio i dużymi niestandardowymi listami kluczowych terminów.
Przegląd w prostym języku angielskim
Scribe v2 zamienia długi dźwięk lub wideo w ustrukturyzowane transkrypcje z wykrywaniem języka, znacznikami czasu słów, diaaryzacją mówiącego i znacznikami audio dla zdarzeń wykraczających poza mowę. Podpowiadanie terminów kluczowych pomaga zespołom zachować nazwy, produkty i słownictwo, których często brakuje w modelach ogólnego rozpoznawania.
ElevenLabs oferuje transkrypcję plików i oddzielnie płatną trasę w czasie rzeczywistym. Szersza platforma zapewnia także produkty głosowe i agentowe, które mogą uprościć potoki audio pochodzące od jednego dostawcy, chociaż każda funkcja ma własne zasady rozliczeń i kontroli danych.
Porównanie kategorii
Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.
Ceny i porównania
Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.
Używa czasu nagrania w godzinach: 30 minut = 0,5 godziny. Dodatkowe funkcje i opłaty minimalne mogą zmienić rachunek.
Scribe v2
ElevenLabs
Szacowany koszt (USD)
Dla podanego użycia · USD · Cena API, nie abonamentu
Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.
Dostęp do API i dostawcy
Dostępność
Dostępne za pośrednictwem interfejsu API zamiany mowy na tekst ElevenLabs i interfejsów produktu; Realtime wykorzystuje oddzielną trasę modelu.
Opcje globalne i miejsca przechowywania danych zależą od planu ElevenLabs, punktu końcowego i konfiguracji przedsiębiorstwa.
Sprawdź dostępność na żywoDane i szkolenia
ElevenLabs umożliwia uprawnionym klientom API zarządzanie preferencjami dotyczącymi wykorzystania danych. Zerowe przechowywanie danych za pomocą opcji Enable_logging=false jest ograniczone do kwalifikujących się konfiguracji korporacyjnych i obsługiwanych modeli, w tym Scribe v2; sprawdź aktywny plan i regionalny punkt końcowy.
Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.
Przeczytaj politykę dostawcyCzęsto zadawane pytania
Wielojęzyczny model zamiany mowy na tekst ElevenLabs umożliwiający szczegółowe transkrypcje z wieloma mówcami, synchronizacją słów, zdarzeniami audio i dużymi niestandardowymi listami kluczowych terminów. Scribe v2 zamienia długi dźwięk lub wideo w ustrukturyzowane transkrypcje z wykrywaniem języka, znacznikami czasu słów, diaaryzacją mówiącego i znacznikami audio dla zdarzeń wykraczających poza mowę. Podpowiadanie terminów kluczowych pomaga zespołom zachować nazwy, produkty i słownictwo, których często brakuje w modelach ogólnego rozpoznawania.
Według materiałów cytowanego dostawcy Scribe v2 został wydany na 9 stycznia 2026.
Dostępne za pośrednictwem interfejsu API zamiany mowy na tekst ElevenLabs i interfejsów produktu; Realtime wykorzystuje oddzielną trasę modelu. Drogi dostępu wymienione w tym przewodniku to ElevenLabs i ElevenLabs API.
0,22 USD za godzinę dźwięku dla Scribe v2. ElevenLabs zawiera osobne ceny dla partii Scribe v2 i Scribe v2 Realtime. Wykrywanie i redagowanie jednostek może być rozliczane osobno.
Dostępne za pośrednictwem interfejsu API zamiany mowy na tekst ElevenLabs i interfejsów produktu; Realtime wykorzystuje oddzielną trasę modelu. Opcje globalne i miejsca przechowywania danych zależą od planu ElevenLabs, punktu końcowego i konfiguracji przedsiębiorstwa.
ElevenLabs umożliwia uprawnionym klientom API zarządzanie preferencjami dotyczącymi wykorzystania danych. Zerowe przechowywanie danych za pomocą opcji Enable_logging=false jest ograniczone do kwalifikujących się konfiguracji korporacyjnych i obsługiwanych modeli, w tym Scribe v2; sprawdź aktywny plan i regionalny punkt końcowy. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.
Powiązane porównania
Model Meta do strumieniowego rozpoznawania mowy dla napisów na żywo, długiego dźwięku, wielu głośników, przełączania kodów i transkrypcji uwzględniającej domeny.
Otwórz pełne porównanieModel szybkiej transkrypcji wsadowej Microsoft do długich nagrań, etykiet głośników, synchronizacji słów, stronniczości słów kluczowych i czystych lub dosłownych transkrypcji.
Otwórz pełne porównanieOgólny model zamiany mowy na tekst Google Cloud do przesyłania strumieniowego, plików i taniej dynamicznej transkrypcji wsadowej w wielu językach i regionach.
Otwórz pełne porównanieModel AssemblyAI zorientowany na dokładność transkrypcji plików i dźwięku na żywo, z przełączaniem kodów, etykietami głośników, znacznikami czasu i podpowiedziami kontekstowymi.
Otwórz pełne porównanie