Qwen3.8-Flash обошла Claude-Opus в программировании
Alibaba представила Qwen3.8-Flash — открытую модель, которая служит «тест-драйвом» перед выходом Qwen4. Она оптимизирована специально для программирования и офисной автоматизации.
Доступно две версии: Qwen3.8-Flash-Next открыта для исследователей на Hugging Face и ModelScope, а Qwen3.8-Flash работает через QwenCloud API с поддержкой контекста до 1 миллиона токенов.
Технические преимущества и выгоды
Модель работает очень быстро благодаря гибридному вниманию, которое сжимает данные и снижает затраты ресурсов при обработке длинных текстов. Главный плюс — доступность: этот AI запускается на одной видеокарте NVIDIA RTX 4090 (24 ГБ памяти), обеспечивая скорость до 21 токена в секунду.
Для работы с массивными документами используется технология YaRN, что позволяет загружать файлы объемом до 1 миллиона токенов целиком.
Результаты и бизнес-кейсы
- Программирование: в тестах SWE-bench Pro модель обошла DeepSeek-V4-Flash и Claude-Opus-4.6 Max.
- Офисная работа: интеграция в QwenWork ускорила выполнение задач в два раза.
- Экономия: расход токенов на одну операцию снизился на 75%.
Стоимость через API остается крайне низкой: входные токены стоят $0.16, а выходные — $0.47 за миллион.
Что ожидать дальше?
Возможность запускать мощный AI на домашнем ПК открывает новые горизонты, хотя для сложного профессионального кодинга всё еще рекомендуются облачные решения.
Релиз Qwen4 ожидается до конца года. В новой версии разработчики обещают значительно улучшить 3D-кодинг и работу с различными типами данных.
Ранее по теме
Qwen3.8-Flash от Alibaba поддерживает 1 млн токенов
Больше новостей в нашем Телеграм. Подпишись!
Ссылка на источник тык.