Сравнение моделей DeepSeek V3.1 vs Qwen3 Coder 480B A35B

Сравнение моделей DeepSeek V3.1 vs Qwen3 Coder 480B A35B по цене, контексту и дате релиза.

deepseek

DeepSeek V3.1

deepseek/deepseek-chat-v3.1

DeepSeek‑V3.1 — крупная гибридная модель рассуждений с режимами thinking и non‑thinking, построенная на базе DeepSeek‑V3 и дообученная для длинного контекста. Она использует FP8‑microscaling для более эффективного инференса, улучшает работу с инструментами и генерацию кода и подходит для сложных агентных сценариев. Модель поддерживает structured tool calling, code agents и search agents, а режим рассуждений можно контролировать через параметр `reasoning.enabled`. Она приходит на смену [DeepSeek V3‑0324](/deepseek/deepseek-chat-v3-0324) и хорошо подходит для исследований, программирования и общего аналитического использования.

Контекст 32K

Вход / 1M ₽23.94

Выход / 1M ₽90.06

Выпущена 21 Aug 2025

К модели

qwen

Qwen3 Coder 480B A35B

qwen/qwen3-coder

Qwen3-Coder-480B-A35B-Instruct — MoE‑модель генерации кода, разработанная командой Qwen. Она оптимизирована для агентных задач программирования, таких как вызов функций, использование инструментов и рассуждения на длинном контексте по репозиториям. Модель содержит 480 млрд параметров, из которых 35 млрд активируются за проход (8 из 160 экспертов). Цены на эндпоинтах Alibaba зависят от длины контекста. Если запрос превышает 128k входных токенов, применяется повышенная тарификация.

Контекст 262K

Вход / 1M ₽45.60

Выход / 1M ₽182.40

Выпущена 23 Jul 2025

К модели