Llama 3.2 1B Instruct
meta-llama/llama-3.2-1b-instruct
- Вход / 1 млн токенов
- 10 ₽
- Выход / 1 млн токенов
- 40 ₽
КАТАЛОГ НЕЙРОСЕТЕЙ
Найдите модель по названию, разработчику или идентификатору. Сравните характеристики перед подключением API.
600 моделей в снимке от 13 сентября 2026. Поиск по названию, разработчику и идентификатору.
По объёму обработанных токенов, не по продажам или качеству. Публичный рейтинг. Данные по 2026-09-13. Снимок публичного топ-10. Модели без данных идут далее по алфавиту; версии учитываются отдельно. Источник: публичный рейтинг поставщика, CC BY 4.0.
meta-llama/llama-3.2-1b-instruct
meta-llama/llama-3.2-3b-instruct
meta-llama/llama-3.3-70b-instruct
meta-llama/llama-4-maverick
meta-llama/llama-4-scout
meta-llama/llama-guard-4-12b
meta/muse-glimmer-30b
meta/muse-glimmer-30b:batch
meta/muse-spark-1.1
meta/muse-spark-1.2
meta/muse-spark-1.2-contributor
meta/muse-spark-1.3
meta/muse-spark-1.3-contributor
microsoft/phi-4
minimax/minimax-m1
minimax/minimax-m2
minimax/minimax-m2-her
minimax/minimax-m2.1
minimax/minimax-m2.5
minimax/minimax-m2.7
minimax/minimax-m3
minimax/minimax-m3:batch
minimax/minimax-01
mistralai/mistral-large
mistralai/mistral-large-2407
mistralai/codestral-2508
mistralai/codestral-2508:batch
mistralai/devstral-2512
mistralai/ministral-14b-2512
mistralai/ministral-3b-2512
Для каких задач подходят модели, какие у них ограничения и что учитывать перед подключением API.
Qwen3 8B — компактная открытая текстовая модель Qwen с переключением thinking и non-thinking. Здесь она работает во внутреннем помощнике по регламентам: ищет источник, объясняет шаг и передаёт исключение ответственному сотруднику.
Читать обзор →ВОЗМОЖНОСТИ И ПРИМЕНЕНИЕQwen3 14B — текстовая dense-модель Qwen среднего размера с thinking и non-thinking. Её сценарий — готовить передачу сложного многоязычного обращения второй линии: восстановить факты, перевести без потери терминов и предложить безопасные проверки.
Читать обзор →ВОЗМОЖНОСТИ И ПРИМЕНЕНИЕQwen2.5 VL 72B Instruct — крупная vision-language модель Qwen. На странице она переносит элементы инженерной схемы в проверяемый реестр: локализует обозначения, связывает подписи и отмечает неразборчивые соединения для инженера.
Читать обзор →ВОЗМОЖНОСТИ И ПРИМЕНЕНИЕGemini Embedding 001 — текстовая embedding-модель Google для semantic search, классификации и RAG. На странице она индексирует многоязычную документацию с разными task types и готовит контролируемую миграцию к новому embedding-пространству.
Читать обзор →ВОЗМОЖНОСТИ И ПРИМЕНЕНИЕGemini 3 Flash Preview Batch — пакетный маршрут preview-модели Google для мультимодальных и агентных задач. Здесь он сопоставляет записи UX-тестов с событиями интерфейса и формирует проверяемые наблюдения для продуктовой команды.
Читать обзор →ВОЗМОЖНОСТИ И ПРИМЕНЕНИЕText Embedding Ada 002 — старая embedding-модель OpenAI, которая может оставаться в действующем векторном индексе. Страница посвящена безопасной миграции: измерить качество старого поиска, полностью перестроить новый индекс и переключиться без смешения пространств.
Читать обзор →Выберите модель и изучите её характеристики, ограничения и состояние тарифа.
Сопоставьте задачу с размером контекста и форматом ответа. Оцените качество на примерах из своего приложения перед выбором основной модели.
Семейство для текстовых задач и многошаговых ответов. Выбирайте конкретную версию и параметры в каталоге.
Подробнее →Автоматизация и кодСемейство моделей для обработки текста и разработки. В каталоге будут отдельные версии, а не плавающий псевдоним.
Подробнее →Документы и агентыКандидат для сценариев с документами и инструментами. Доступность и реальные ограничения зависят от выбранной версии.
Подробнее →