Llama — бесплатное API

Обновлено:

Открытые модели Meta Llama, доступные бесплатно через облачных провайдеров. От легковесных 8B до мощных 70B+ вариантов.

Подробнее

Список формируется из актуальных ответов API-провайдеров. Одна модель может встречаться несколько раз: это отдельные точки доступа с собственными лимитами, контекстом и правилами бесплатного тарифа. Вложенные страницы моделей имеют постоянные URL и обновляются автоматически.

Найдено 44 моделей

Мощность
Модель Мощность Провайдер Параметры Контекст Лимит Статус
1 LLaMA 3.3 70B Versatilellama-3.3-70b-versatile 🚀 Groq 70B 128K 1 000 req/day Кэш Открыть
2 LLaMA 3.1 8B Instantllama-3.1-8b-instant Groq 8B 128K 14 400 req/day Кэш Открыть
3 DeepSeek R1 Distill LLaMA 70Bdeepseek-r1-distill-llama-70b 🚀 Groq 70B 128K 1 000 req/day Кэш Открыть
4 nim/meta/llama-3.2-11b-vision-instructnim/meta/llama-3.2-11b-vision-instruct Together AI 11B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
5 nim/meta/llama-3.2-90b-vision-instructnim/meta/llama-3.2-90b-vision-instruct 🚀 Together AI 90B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
6 nim/meta/llama-3.3-70b-instructnim/meta/llama-3.3-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
7 nim/nvidia/llama-3.1-nemotron-70b-instructnim/nvidia/llama-3.1-nemotron-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
8 nim/meta/llama-3.1-8b-instructnim/meta/llama-3.1-8b-instruct Together AI 8B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
9 nim/meta/llama-3.1-70b-instructnim/meta/llama-3.1-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
10 nim/nvidia/llama-3.3-nemotron-super-49b-v1nim/nvidia/llama-3.3-nemotron-super-49b-v1 ⚖️ Together AI 49B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
11 meta-llama/Llama-2-7b-chat-hfmeta-llama/Llama-2-7b-chat-hf Together AI 7B 4K Fair Use (По мере нагрузки серверов) Онлайн Открыть
12 Cogito V1 Preview Llama 8Bdeepcogito/cogito-v1-preview-llama-8B Together AI 8B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
13 Cogito V1 Preview Llama 70Bdeepcogito/cogito-v1-preview-llama-70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
14 Cogito V1 Preview Llama 70B Turbodeepcogito/cogito-v1-preview-llama-70B-Turbo 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
15 Meta Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
16 Llama 3.1 70Bmeta-llama/Meta-Llama-3.1-70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
17 Llama 3.2 1Bmeta-llama/Llama-3.2-1B Together AI 1B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
18 Llama 3.1 405Bmeta-llama/Llama-3.1-405B 🚀 Together AI 405B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
19 Llama 4 Scout (17Bx16E)meta-llama/Llama-4-Scout-17B-16E ⚖️ Together AI 17B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
20 Meta Llama 3.1 8B Instruct Awq Int4togethercomputer/meta-llama-3.1-8B-Instruct-AWQ-INT4 Together AI 8B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
21 Llama 3.3 70B Instruct FP8 Lorameta-llama/Llama-3.3-70B-Instruct-FP8-Lora 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
22 Llama 4 Scout 17B 16E Instruct Fp8 Lorameta-llama/Llama-4-Scout-17B-16E-Instruct-FP8-Lora ⚖️ Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Онлайн Открыть
23 Llama 4 Maverick 17B 128E Instruct Nvfp4meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP4 ⚖️ Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Онлайн Открыть
24 LLaMA 3.1 8Bllama3.1-8b Cerebras 8B 128K 14 400 req/day · 30 req/min Кэш Открыть
25 LLaMA 3.1 70Bllama3.1-70b 🚀 Cerebras 70B 128K 14 400 req/day · 30 req/min Кэш Открыть
26 Llama 3.1 8B Instruct@cf/meta/llama-3.1-8b-instruct Cloudflare 8B 131K 10 000 req/day Кэш Открыть
27 Llama 3.1 8Bmeta-llama/Llama-3.1-8B-Instruct HuggingFace 8B 128K Fair Use (По мере нагрузки серверов) Кэш Открыть
28 Codellama 70bmeta/codellama-70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
29 LLAMA 3.1 70b Instructmeta/llama-3.1-70b-instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
30 LLAMA 3.1 8b Instructmeta/llama-3.1-8b-instruct NVIDIA Build 8B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
31 LLAMA 3.1 Nemotron 51b Instructnvidia/llama-3.1-nemotron-51b-instruct ⚖️ NVIDIA Build 51B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
32 LLAMA 3.1 Nemotron 70b Instructnvidia/llama-3.1-nemotron-70b-instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
33 LLAMA 3.1 Nemotron Nano 8b V1nvidia/llama-3.1-nemotron-nano-8b-v1 NVIDIA Build 8B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
34 LLAMA 3.1 Nemotron Nano VL 8b V1nvidia/llama-3.1-nemotron-nano-vl-8b-v1 NVIDIA Build 8B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
35 LLAMA 3.1 Nemotron Ultra 253b V1nvidia/llama-3.1-nemotron-ultra-253b-v1 🚀 NVIDIA Build 253B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
36 LLAMA 3.2 11b Vision Instructmeta/llama-3.2-11b-vision-instruct NVIDIA Build 11B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
37 LLAMA 3.2 1b Instructmeta/llama-3.2-1b-instruct NVIDIA Build 1B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
38 LLAMA 3.2 3b Instructmeta/llama-3.2-3b-instruct NVIDIA Build 3B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
39 LLAMA 3.2 90b Vision Instructmeta/llama-3.2-90b-vision-instruct 🚀 NVIDIA Build 90B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
40 LLAMA 3.3 70b Instructmeta/llama-3.3-70b-instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
41 LLAMA 3.3 Nemotron Super 49b V1nvidia/llama-3.3-nemotron-super-49b-v1 ⚖️ NVIDIA Build 49B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
42 LLAMA 3.3 Nemotron Super 49b V1.5nvidia/llama-3.3-nemotron-super-49b-v1.5 ⚖️ NVIDIA Build 49B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
43 Llama2 70bmeta/llama2-70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть
44 Llama3 Chatqa 1.5 70bnvidia/llama3-chatqa-1.5-70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Онлайн Открыть