Free-LLMs

Llama 3.1 Nemotron Ultra 253B

Бесплатно сейчас Флагман
ИнструментыОткрытые веса

Llama 3.1 Nemotron Ultra 253B — языковая модель на 253B параметров от NVIDIA. Сейчас она доступна бесплатно у 1 провайдер с контекстом до — токенов. Модель поддерживает вызов инструментов. Веса модели открыты, её можно запустить и локально.

Разработчик
NVIDIA
Параметры
253B
Тип
Текст
Лицензия
Открытые веса

Где использовать Llama 3.1 Nemotron Ultra 253B бесплатно

Каждая строка — отдельный бесплатный эндпоинт со своими лимитами.

ПровайдерКонтекстЛимитКарта
NVIDIA Build
nvidia/llama-3.1-nemotron-ultra-253b-v1
— Бесплатный serverless-инференс для разработки; лимиты и список моделей могут меняться. Не нужна Открыть

Быстрый старт

curl https://integrate.api.nvidia.com/v1/chat/completions \
  -H "Authorization: Bearer $NVIDIA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/llama-3.1-nemotron-ultra-253b-v1",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Пример для NVIDIA Build. Подойдёт любой OpenAI-совместимый клиент: Cursor, Cline, OpenCode, Open WebUI.

Бенчмарки

Intelligence Index
7.5
GPQA Diamond
72.8%
Humanity's Last Exam
7.4%
Terminal-Bench Hard
2.3%
τ²-Bench
11.4%

Источник: Artificial Analysis · Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)

Похожие бесплатные модели

Частые вопросы

Llama 3.1 Nemotron Ultra 253B бесплатна?

Да. На 26 сентября 2026 г. Llama 3.1 Nemotron Ultra 253B доступна бесплатно у NVIDIA Build. Лимиты у каждого провайдера свои — смотрите таблицу выше.

Как подключить Llama 3.1 Nemotron Ultra 253B по API?

Используйте любой OpenAI-совместимый клиент: base URL https://integrate.api.nvidia.com/v1, ID модели nvidia/llama-3.1-nemotron-ultra-253b-v1 и ключ NVIDIA Build.

Насколько Llama 3.1 Nemotron Ultra 253B сильная?

Artificial Analysis Intelligence Index: 7.5, GPQA Diamond: 73%. Для сравнения, лучшая бесплатная модель в каталоге сейчас — GLM 5.3.

Llama 3.1 Nemotron Ultra 253B — открытая модель?

Да, веса опубликованы — модель можно скачать и запустить локально, например через Ollama или LM Studio.