Llama 3.1 Nemotron Ultra 253B
Llama 3.1 Nemotron Ultra 253B — языковая модель на 253B параметров от NVIDIA. Сейчас она доступна бесплатно у 1 провайдер с контекстом до — токенов. Модель поддерживает вызов инструментов. Веса модели открыты, её можно запустить и локально.
- Разработчик
- NVIDIA
- Параметры
- 253B
- Тип
- Текст
- Лицензия
- Открытые веса
Где использовать Llama 3.1 Nemotron Ultra 253B бесплатно
Каждая строка — отдельный бесплатный эндпоинт со своими лимитами.
| Провайдер | Контекст | Лимит | Карта | |
|---|---|---|---|---|
NVIDIA Build nvidia/llama-3.1-nemotron-ultra-253b-v1 |
— | Бесплатный serverless-инференс для разработки; лимиты и список моделей могут меняться. | Не нужна | Открыть |
Быстрый старт
curl https://integrate.api.nvidia.com/v1/chat/completions \
-H "Authorization: Bearer $NVIDIA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nvidia/llama-3.1-nemotron-ultra-253b-v1",
"messages": [{"role": "user", "content": "Hello!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://integrate.api.nvidia.com/v1",
api_key="YOUR_NVIDIA_API_KEY",
)
reply = client.chat.completions.create(
model="nvidia/llama-3.1-nemotron-ultra-253b-v1",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://integrate.api.nvidia.com/v1",
apiKey: process.env.NVIDIA_API_KEY,
});
const reply = await client.chat.completions.create({
model: "nvidia/llama-3.1-nemotron-ultra-253b-v1",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(reply.choices[0].message.content);Пример для NVIDIA Build. Подойдёт любой OpenAI-совместимый клиент: Cursor, Cline, OpenCode, Open WebUI.
Бенчмарки
Источник: Artificial Analysis · Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
Похожие бесплатные модели
Частые вопросы
Llama 3.1 Nemotron Ultra 253B бесплатна?
Да. На 26 сентября 2026 г. Llama 3.1 Nemotron Ultra 253B доступна бесплатно у NVIDIA Build. Лимиты у каждого провайдера свои — смотрите таблицу выше.
Как подключить Llama 3.1 Nemotron Ultra 253B по API?
Используйте любой OpenAI-совместимый клиент: base URL https://integrate.api.nvidia.com/v1, ID модели nvidia/llama-3.1-nemotron-ultra-253b-v1 и ключ NVIDIA Build.
Насколько Llama 3.1 Nemotron Ultra 253B сильная?
Artificial Analysis Intelligence Index: 7.5, GPQA Diamond: 73%. Для сравнения, лучшая бесплатная модель в каталоге сейчас — GLM 5.3.
Llama 3.1 Nemotron Ultra 253B — открытая модель?
Да, веса опубликованы — модель можно скачать и запустить локально, например через Ollama или LM Studio.