Llama 4 Maverick
текстvisiontoolsmeta-llama/llama-4-maverick
Llama 4 Maverick 17B Instruct (128E) — это высокопроизводительная мультимодальная языковая модель от Meta, построенная на архитектуре mixture-of-experts (MoE) со 128 экспертами и 17 миллиардами активных параметров на проход...
Контекст
1.049M токенов
вход и выход вместе
Маршрут
OpenRouter
резервный маршрут · скороВозможности
текст · vision · tools
Модальность
мультимодальная
текст и изображения на входе
Вышла
5 апреля 2025 г.
у провайдера
Знания
31 августа 2024 г.
дата обрыва знаний
Цена
курс ЦБ + спред 3 % · 1 $ = 86,72 ₽
Вход
19,51 ₽
промпт, изображения, системные сообщения
цена провайдера 16,26 ₽ · наценка + 20 %
Выход
67,9 ₽
сгенерированный ответ модели
цена провайдера 56,59 ₽ · наценка + 20 %
| Направление | Цена провайдера ₽/1M | Наценка | Итого ₽/1M |
|---|---|---|---|
Вход промпт, изображения, системные сообщения | 16,26 ₽ | + 20 % | 19,51 ₽ |
Выход сгенерированный ответ модели | 56,59 ₽ | + 20 % | 67,9 ₽ |
цены пересчитываются при обновлении курса ЦБ · наценка на эту модель · публичный тариф, у вашего аккаунта цена может отличаться
Сколько стоит один запрос
итого за запрос
0,09 ₽
0,04 ₽ вход · 0,05 ₽ выход
Оценка по токенной цене. Списывается стоимость, которую сообщил провайдер, — в неё могут входить веб-поиск, картинки, звук и ступенчатые тарифы. Резервируем под максимум, после ответа возвращаем разницу.
Как обратиться
вся документация →from openai import OpenAI
client = OpenAI(
api_key="sk-air-…",
base_url="https://api.aireplica.ru/v1"
)
resp = client.chat.completions.create(
model="meta-llama/llama-4-maverick",
messages=[{"role": "user", "content": "Привет"}]
)
Куда слать запрос
базовый адрес
https://api.aireplica.ru/v1
заголовок авторизации
Authorization: Bearer sk-air-…
Резервный маршрут в обход OpenRouter скоро
Похожие модели
весь каталог →Muse Glimmer 30B (batch)
meta/muse-glimmer-30b:batch
текст
18,21 ₽ / 78,05 ₽ за 1M
Llama 3.1 70B Instruct
meta-llama/llama-3.1-70b-instruct
текст
41,63 ₽ / 41,63 ₽ за 1M
Llama 3.2 3B Instruct
meta-llama/llama-3.2-3b-instruct
текст
5,2 ₽ / 34,34 ₽ за 1M
Llama 3.3 70B Instruct
meta-llama/llama-3.3-70b-instruct
текст
10,41 ₽ / 33,3 ₽ за 1M
| Модель | Возможности | Контекст | Вход ₽/1M | Выход ₽/1M |
|---|---|---|---|---|
| Muse Glimmer 30B (batch)meta/muse-glimmer-30b:batch | текст | 131K | 18,21 ₽ | 78,05 ₽ |
| Llama 3.1 70B Instructmeta-llama/llama-3.1-70b-instruct | текст | 131K | 41,63 ₽ | 41,63 ₽ |
| Llama 3.2 3B Instructmeta-llama/llama-3.2-3b-instruct | текст | 131K | 5,2 ₽ | 34,34 ₽ |
| Llama 3.3 70B Instructmeta-llama/llama-3.3-70b-instruct | текст | 131K | 10,41 ₽ | 33,3 ₽ |
Ограничения частоты
Своих ограничений частоты запросов у нас нет. Если частоту ограничит провайдер, его ответ 429 придёт к вам как есть.
Что происходит с данными
Тела запросов и ответов мы не сохраняем. Для биллинга остаётся идентификатор модели, количество токенов, сумма и время.
Если модель снимут
Провайдеры снимают модели с публикации. Каталог сверяется с провайдером каждую ночь: снятая модель гаснет, и её страница перестаёт предлагать запросы.