Сравнение моделей Gemini 2.5 Flash vs Qwen3 32B

Сравнение моделей Gemini 2.5 Flash vs Qwen3 32B по цене, контексту и дате релиза.

google

Gemini 2.5 Flash

google/gemini-2.5-flash

Gemini 2.5 Flash — универсальная модель Google для задач рассуждений, программирования, математики и науки. Она поддерживает режим thinking, что помогает давать более точные ответы и лучше работать со сложным контекстом. Подходит для широкого круга продакшн‑сценариев, где нужен баланс между скоростью и качеством reasoning.

Контекст 1M

Вход / 1M ₽34.20

Выход / 1M ₽285.00

Выпущена 17 Jun 2025

К модели

qwen

Qwen3 32B

qwen/qwen3-32b

Qwen3‑32B — плотная причинная языковая модель на 32.8B параметров из серии Qwen3, оптимизированная для сложных рассуждений и эффективного диалога. Она поддерживает бесшовное переключение между режимом «thinking» для задач математики, программирования и логических выводов и режимом «non‑thinking» для более быстрого общения общего назначения. Модель демонстрирует высокую производительность в следовании инструкциям, использовании инструментов агентами, творческом письме и многоязычных задачах на 100+ языках и диалектах. Она нативно поддерживает контекст до 32K токенов и может расширяться до 131K токенов с помощью YaRN‑масштабирования.

Контекст 40K

Вход / 1M ₽9.12

Выход / 1M ₽31.92

Выпущена 28 Apr 2025

К модели