Сравнение моделей Llama-3.3-70B-Instruct-Turbo vs Qwen3 30B A3B

Сравнение моделей Llama-3.3-70B-Instruct-Turbo vs Qwen3 30B A3B по цене, контексту и дате релиза.

meta-llama

Llama-3.3-70B-Instruct-Turbo

meta-llama/Llama-3.3-70B-Instruct-Turbo

Llama 3.3-70B Instruct Turbo — ускоренная версия Llama 3.3-70B с FP8‑квантизацией, оптимизированная для более быстрого инференса при небольшом компромиссе по точности. Модель ориентирована на полезные, безопасные и гибкие ответы и подходит для диалоговых сценариев, генерации текста и перевода. Это хороший вариант, когда нужен баланс между качеством 70B‑класса и более высокой пропускной способностью.

Контекст 131K

Вход / 1M ₽11.40

Выход / 1M ₽36.48

Выпущена —

К модели

qwen

Qwen3 30B A3B

qwen/qwen3-30b-a3b

Qwen3, новое поколение в серии крупных языковых моделей Qwen, сочетает плотные и mixture‑of‑experts (MoE) архитектуры, чтобы превосходно справляться с рассуждениями, многоязычной поддержкой и продвинутыми агентными задачами. Её уникальная способность бесшовно переключаться между режимом thinking для сложных рассуждений и режимом non‑thinking для эффективного диалога обеспечивает универсальную, высококачественную работу. Существенно превосходя предыдущие модели вроде QwQ и Qwen2.5, Qwen3 обеспечивает более сильные результаты в математике, программировании, здравом смысле, творческом письме и интерактивном диалоге. Вариант Qwen3‑30B‑A3B включает 30.5 млрд параметров (3.3 млрд активных), 48 слоёв, 128 экспертов (8 активируются на задачу) и поддерживает контекст до 131K токенов с YaRN, задавая новый стандарт среди open‑source моделей.

Контекст 40K

Вход / 1M ₽9.12

Выход / 1M ₽31.92

Выпущена 28 Apr 2025

К модели