Сравнение моделей Llama 3.2 11B Vision Instruct vs Mistral Small 3.2 24B

Сравнение моделей Llama 3.2 11B Vision Instruct vs Mistral Small 3.2 24B по цене, контексту и дате релиза.

meta-llama

Llama 3.2 11B Vision Instruct

meta-llama/llama-3.2-11b-vision-instruct

Llama 3.2 11B Vision — мультимодальная модель на 11 млрд параметров для задач, сочетающих визуальные и текстовые данные. Она хорошо подходит для описания изображений, visual Q&A и других сценариев, где требуется объединить генерацию языка с визуальными рассуждениями. Модель обучена на большом наборе пар «изображение‑текст» и подходит для анализа изображений, создания контента, клиентских ассистентов и исследовательских задач.

Контекст 131K

Вход / 1M ₽5.59

Выход / 1M ₽5.59

Выпущена 25 Sep 2024

К модели

mistralai

Mistral Small 3.2 24B

mistralai/mistral-small-3.2-24b-instruct

Mistral-Small-3.2-24B-Instruct-2506 — обновлённая 24B‑модель от Mistral, оптимизированная для следования инструкциям, снижения повторов и улучшенного вызова функций. По сравнению с релизом 3.1 версия 3.2 заметно повышает точность на WildBench и Arena Hard, уменьшает бесконечные генерации и улучшает работу с инструментами и задачами структурированных выходов. Поддерживает входы изображение+текст со структурированными выходами, вызов функций/инструментов и сильные результаты в программировании (HumanEval+, MBPP), STEM (MMLU, MATH, GPQA) и vision‑бенчмарках (ChartQA, DocVQA).

Контекст 128K

Вход / 1M ₽8.55

Выход / 1M ₽22.80

Выпущена 20 Jun 2025

К модели