Sprawni Cyfrowo
Sprawni Cyfrowo

Nemotron 3.5 Content Safety: NVIDIA wydaje otwarty model do moderacji treści AI

Nemotron 3.5 Content Safety: NVIDIA wydaje otwarty model do moderacji treści AI

NVIDIA udostępniła Nemotron 3.5 Content Safety — otwarty model do moderacji treści w aplikacjach AI. Klasyfikator ocenia zapytanie użytkownika, opcjonalny obraz oraz odpowiedź asystenta i wydaje werdykt bezpieczeństwa. Premiera odbyła się 4 czerwca 2026 roku, a wagi modelu są dostępne na licencji NVIDIA Open Model License, również do zastosowań komercyjnych.

Model liczy 4 miliardy parametrów i bazuje na Google Gemma 3 4B. Ocenia tekst, obraz i odpowiedź w jednym przebiegu, dzięki czemu wychwytuje naruszenia wynikające z połączenia obrazu z poleceniem. Twórcy deklarują wyraźne wsparcie dla 12 języków oraz generalizację zero-shot do około 140 kolejnych, w tym polskiego.

Co oferuje Nemotron 3.5 Content Safety

Najważniejsza zmiana to własne polityki podawane jako dane wejściowe. Firma może dodać kategorie typowe dla swojej branży zamiast polegać wyłącznie na wbudowanej taksonomii 13 kategorii zgodnej z MLCommons Aegis 2.0. Opcjonalny tryb THINK zwraca uzasadnienie werdyktu krok po kroku, co ułatwia audyt. Według NVIDIA model osiąga 96,5% trafności w wielojęzycznym teście Aegis i działa z około połową opóźnienia modelu LlamaGuard-4-12B. Jest dostępny przez Hugging Face, mikroserwis NVIDIA NIM oraz dostawców inferencji, takich jak DeepInfra czy OpenRouter.

Co to znaczy dla polskich firm

Dla polskich zespołów wdrażających chatboty i asystentów AI to gotowy element warstwy bezpieczeństwa. Otwarte wagi i licencja komercyjna pozwalają uruchomić model na własnej infrastrukturze lub w prywatnej chmurze, co ma znaczenie przy danych wrażliwych i wymogach RODO. Wsparcie polskiego oznacza, że moderacja nie ogranicza się do treści anglojęzycznych. Branże regulowane, czyli ochrona zdrowia, finanse i edukacja, zyskują dodatkowo ślad audytowy dzięki trybowi z uzasadnieniem. Model nie zwalnia z własnych testów, ale obniża próg wejścia w bezpieczne wdrożenie generatywnej AI.

Źródło: Hugging Face — NVIDIA Nemotron 3.5 Content Safety (EN), 4 czerwca 2026.

Pomożemy Ci wdrożyć sztuczną inteligencję w Twojej firmie.

Konsultacje i wdrożenia AI

Powiązane artykuły