Wszystkie modele
NVIDIA

NVIDIA Nemotron 3.5 Lightning

Kompaktowy model NVIDIA 30B, będący mieszanką ekspertów, przeznaczony dla wydajnych agentów specjalistycznych i obiegów pracy z dużą ilością tekstów.

Przegląd w prostym języku angielskim

Czym właściwie jest NVIDIA Nemotron 3.5 Lightning

Nemotron 3.5 Lightning ma łącznie 30 miliardów parametrów, ale aktywuje około trzech miliardów na każdy token. NVIDIA zaprojektował go jako szybki koń pociągowy do wyspecjalizowanych zadań w większych systemach agentów, zachowując jednocześnie okno kontekstowe zawierające do miliona tokenów.

Podgląd jest dostępny w postaci wag do pobrania oraz dla NVIDIA, OpenRouter i infrastruktury partnerów. Jego mniejszy obszar aktywny sprawia, że ​​kontrolowane wdrożenia są bardziej przystępne niż w trybie Ultra, chociaż długi kontekst i współbieżność mogą nadal dominować w zużyciu pamięci.

Dobre dopasowanie do

  • Podzadania agentów o dużej liczbie zadań
  • Skuteczne rozumowanie samodzielne
  • Długokontekstowy RAG i przepływy pracy instrukcji

Porównanie kategorii

Fakty, które mają znaczenie w przypadku modeli tekst

Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.

Okno kontekstowe
Do 1 miliona tokenówMaksymalny łączny kontekst podpowiedzi i pracy udokumentowany przez dostawcę.
Maksymalna wydajność
Nie publikowane oddzielnieLimit odpowiedzi opublikowany przez dostawcę, jeśli jest dostępny.
Odcięcie wiedzy
Szkolenie wstępne do września 2025 r.; po szkoleniu do maja 2026 rNajnowsza wiarygodna data wyraźnie opublikowana przez dostawcę modelu. Wyszukiwanie i połączone narzędzia mogą pobierać nowsze informacje, ale nie zmieniają wbudowanego odcięcia modelu.
Cena wejściowa
Darmowy prototyp lub koszt wdrożeniaAktualna standardowa cena katalogowa za milion tokenów wejściowych, chyba że zaznaczono inaczej.
Cena wyjściowa
Darmowy prototyp lub koszt wdrożeniaAktualna standardowa cena katalogowa za milion tokenów wyjściowych, chyba że zaznaczono inaczej.
Wejścia
TekstTypy multimediów akceptowane przez wymieniony punkt końcowy modelu.
Narzędzia i agenci
Narzędzia agentowe i długotrwałe przepływy pracyWybrane natywne narzędzia i możliwości budowania agentów, a nie wyczerpująca lista.

Ceny i porównania

Oszacuj koszt

Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.

Przykład: 6000 tokenów wejścia dla 10 stron i 500 na podsumowanie. Długość stron bywa różna; dostosuj wartości.

Jedno wykonanie wysyła dane do modelu i odbiera odpowiedź. Tokeny to fragmenty tekstu: wejście to treść wysłana, a wyjście to otrzymana odpowiedź.

Opcje zaawansowane

NVIDIA Nemotron 3.5 Lightning

NVIDIA

Szacowany koszt (USD)

Brak zweryfikowanej stawki

Dla podanego użycia · USD · Cena API, nie abonamentu

Jak działa ten szacunek

Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.

Dostęp do API i dostawcy

Gdzie zdobyć NVIDIA Nemotron 3.5 Lightning

Dostępność

Regiony i etap dostępu

Dostępne w kompilacjach NVIDIA, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM oraz u partnerów w chmurze lub wnioskowaniu.

Karta modelu opisuje wdrożenie globalne; rzeczywisty region przetwarzania zależy od wybranego dostawcy lub infrastruktury hostowanej samodzielnie.

Sprawdź dostępność na żywo

Dane i szkolenia

Trasa ma znaczenie.

Własne wagi przechowują dane żądań pod kontrolą operatora. Wersje próbne API NVIDIA, OpenRouter i partnerzy w chmurze stosują oddzielne zasady rejestrowania, przechowywania i użytkowania szkoleniowego.

Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.

Przeczytaj politykę dostawcy

Często zadawane pytania

Często zadawane pytania dotyczące NVIDIA Nemotron 3.5 Lightning

Co to jest NVIDIA Nemotron 3.5 Lightning?

Kompaktowy model NVIDIA 30B, będący mieszanką ekspertów, przeznaczony dla wydajnych agentów specjalistycznych i obiegów pracy z dużą ilością tekstów. Nemotron 3.5 Lightning ma łącznie 30 miliardów parametrów, ale aktywuje około trzech miliardów na każdy token. NVIDIA zaprojektował go jako szybki koń pociągowy do wyspecjalizowanych zadań w większych systemach agentów, zachowując jednocześnie okno kontekstowe zawierające do miliona tokenów.

Kiedy wypuszczono NVIDIA Nemotron 3.5 Lightning?

Według materiałów cytowanego dostawcy NVIDIA Nemotron 3.5 Lightning został wydany na 11 sierpnia 2026.

Gdzie mogę uzyskać dostęp do NVIDIA Nemotron 3.5 Lightning?

Dostępne w kompilacjach NVIDIA, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM oraz u partnerów w chmurze lub wnioskowaniu. Drogi dostępu wymienione w tym przewodniku to NVIDIA NIM i NVIDIA.

Ile kosztuje NVIDIA Nemotron 3.5 Lightning?

Darmowy prototypowy punkt końcowy NVIDIA; Koszty produkcji i samodzielnego hostowania są różne. Podgląd jest dostępny w formie ciężarów do pobrania oraz poprzez NVIDIA i trasy partnerskie. Ceny sprzętu, NIM i dostawców są odrębne.

Gdzie jest dostępny NVIDIA Nemotron 3.5 Lightning?

Dostępne w kompilacjach NVIDIA, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM oraz u partnerów w chmurze lub wnioskowaniu. Karta modelu opisuje wdrożenie globalne; rzeczywisty region przetwarzania zależy od wybranego dostawcy lub infrastruktury hostowanej samodzielnie.

Czy moje dane API NVIDIA Nemotron 3.5 Lightning są wykorzystywane do szkolenia?

Własne wagi przechowują dane żądań pod kontrolą operatora. Wersje próbne API NVIDIA, OpenRouter i partnerzy w chmurze stosują oddzielne zasady rejestrowania, przechowywania i użytkowania szkoleniowego. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.

Porównanie cen

USD za milion tokenów dla podanych API przy standardowej długości kontekstu. Stawki cache i długiego kontekstu mogą się różnić. Pomijamy modele bez zgodnych, sprawdzonych cen; niższy koszt nie oznacza lepszej jakości.

Koszt tokenów wejściowychza 1 mln tokenów · USD
  1. 0,15 USD
    Mistral Small 4

    Mistral AI

  2. 0,75 USD
    Gemini 3.8 Flash

    Google

  3. 4,00 USD
    GPT-5.6 Sol

    OpenAI

  4. 10,00 USD
    GPT-6 Astra

    OpenAI

  5. 10,00 USD
    Claude Fable 5.1

    Anthropic

Koszt tokenów wyjściowychza 1 mln tokenów · USD
  1. 0,60 USD
    Mistral Small 4

    Mistral AI

  2. 3,75 USD
    Gemini 3.8 Flash

    Google

  3. 20,00 USD
    GPT-5.6 Sol

    OpenAI

  4. 50,00 USD
    GPT-6 Astra

    OpenAI

  5. 50,00 USD
    Claude Fable 5.1

    Anthropic

Powiązane porównania

Porównania bezpośrednie

  1. NVIDIA Nemotron 3.5 Lightning vs GPT-6 Astra

    Najbardziej wydajny model OpenAI do trudnej, kompleksowej pracy, łączący rozumowanie pionierskie z oknem kontekstowym obejmującym milion tokenów i szerokim zestawem narzędzi agenta.

    Otwórz pełne porównanie
  2. NVIDIA Nemotron 3.5 Lightning vs GPT-5.6 Sol

    Flagowy ogólny model OpenAI do trudnego kodowania, analiz i pracy zawodowej, z bardzo dużym oknem kontekstowym i szerokim natywnym zestawem narzędzi.

    Otwórz pełne porównanie
  3. NVIDIA Nemotron 3.5 Lightning vs Claude Fable 5.1

    Frontierowy model Anthropic do ambitnych, długotrwałych prac agentowych i programistycznych, z silną wizją i dostępnością na rynku korporacyjnym.

    Otwórz pełne porównanie
  4. NVIDIA Nemotron 3.5 Lightning vs Gemini 3.8 Flash

    Stabilny, wysokowydajny model multimodalny Google do zastosowań agentów, pracy z oprogramowaniem i dużych danych wejściowych z różnych multimediów w początkowej cenie warstwy Flash.

    Otwórz pełne porównanie
  5. NVIDIA Nemotron 3.5 Lightning vs Grok 4.6

    Frontierowy model tekstu i obrazu SpaceXAI do kodowania, zadań agentowych i pracy opartej na wiedzy, z narzędziami Direct Web, X i kodowaniem.

    Otwórz pełne porównanie
  6. NVIDIA Nemotron 3.5 Lightning vs Grok 4.20 Multi-Agent Beta

    Specjalistyczny model Groka, który wysyła kilku agentów AI równolegle do zbadania trudnego pytania, a następnie łączy ich pracę w jedną zbadaną odpowiedź.

    Otwórz pełne porównanie
  7. NVIDIA Nemotron 3.5 Lightning vs Inkling

    Duży model z otwartymi ciężarami Thinking Machines Lab umożliwiający dostosowywanie procesów wnioskowania, kodowania, narzędzi, wizji i dźwięku.

    Otwórz pełne porównanie
  8. NVIDIA Nemotron 3.5 Lightning vs Mistral Medium 3.5

    Model frontierowy firmy Mistral o otwartej wadze, przeznaczony do wymagających przepływów pracy multimodalnych, kodowania, wnioskowania i agentów, z oknem kontekstowym o wielkości 256 tys.

    Otwórz pełne porównanie
  9. NVIDIA Nemotron 3.5 Lightning vs Mistral Small 4

    Tańszy, otwarty model Mistral, który łączy w jednym punkcie końcowym normalne wykonywanie instrukcji, rozumowanie, kodowanie, wizję i narzędzia agenta.

    Otwórz pełne porównanie
  10. NVIDIA Nemotron 3.5 Lightning vs Qwen3.8 Max

    Frontierowy model Alibaba Qwen do wnioskowania w długim kontekście, kodowania, narzędzi i rozumienia tekstu, obrazów i wideo.

    Otwórz pełne porównanie
  11. NVIDIA Nemotron 3.5 Lightning vs MiniMax M3

    Multimodalny model MiniMax z milionem tokenów do kodowania, agentów, korzystania z komputera i długich projektów w niskiej cenie bezpośredniego interfejsu API.

    Otwórz pełne porównanie
  12. NVIDIA Nemotron 3.5 Lightning vs GLM-5.3

    Otwarty model wnioskowania o długim kontekście Z.ai do kodowania, narzędzi i pracy agentowej w ramach tras hostowanych samodzielnie i zarządzanych.

    Otwórz pełne porównanie
  13. NVIDIA Nemotron 3.5 Lightning vs Kimi K3

    Frontierowy model multimodalny Moonshot AI do kodowania milionów tokenów, wnioskowania, pracy opartej na wiedzy i agentów opartych na narzędziach.

    Otwórz pełne porównanie
  14. NVIDIA Nemotron 3.5 Lightning vs Falcon-H1R-7B

    Kompaktowy, otwarty model wnioskowania TII do zadań tekstowych, długich kontekstów i samodzielnie hostowanych przepływów pracy z wywołaniami funkcji.

    Otwórz pełne porównanie
  15. NVIDIA Nemotron 3.5 Lightning vs Falcon-H1-34B-Instruct

    Model otwartych instrukcji TII 34B do wielojęzycznego tekstu, kodowania i kontrolowanych aplikacji hostowanych samodzielnie.

    Otwórz pełne porównanie
  16. NVIDIA Nemotron 3.5 Lightning vs Muse Spark 1.3

    Najnowszy multimodalny model wnioskowania Meta dla długotrwałych agentów, kodowania, narzędzi i złożonej współpracy użytkowników.

    Otwórz pełne porównanie
  17. NVIDIA Nemotron 3.5 Lightning vs Celeris-1 Magnus

    Model języka dyfuzyjnego skoncentrowanego na agentach Celeris umożliwiający szybkie wnioskowanie, pętle narzędzi, działania strukturalne i integrację kompatybilną z OpenAI.

    Otwórz pełne porównanie
  18. NVIDIA Nemotron 3.5 Lightning vs NVIDIA Nemotron 3 Ultra

    Największy model wnioskowania Nemotron 3 firmy NVIDIA do obsługi złożonych agentów, kodowania, planowania, narzędzi, RAG i analizy milionów tokenów.

    Otwórz pełne porównanie
  19. NVIDIA Nemotron 3.5 Lightning vs Qwen3.8-Flash

    Wydajny wielomodalny model Alibaba z milionem kontekstów do szybkich agentów, kodowania, pracy z dokumentami, wizji, rozumienia wideo i korzystania z narzędzi.

    Otwórz pełne porównanie
  20. NVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Pro

    Flagowy model tekstu DeepSeek z milionem kontekstów do trudnego wnioskowania, kodowania, długotrwałych agentów, narzędzi i bardzo dużych wyników.

    Otwórz pełne porównanie
  21. NVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Flash

    Tańszy model V4 DeepSeek do dużych obciążeń związanych z wnioskowaniem, kodowaniem, agentami i milionami tokenów tekstowych.

    Otwórz pełne porównanie