Model Release
Alibaba представила Qwen3.8-Flash с расширяемым контекстом и низкой ценой API
Alibaba выпустила мультимодальную модель Qwen3.8-Flash, которая поддерживает до 1 миллиона токенов в контексте и предлагает API по очень низкой цене — около $0,15 за миллион входных токенов.
AS1 News
Модель предназначена для задач программирования, обработки больших документов и длинных диалогов. Alibaba также опубликовала веса экспериментальной архитектуры Qwen4, что дает разработчикам возможность изучать будущие направления модели. Стоимость обучения модели значительно ниже предыдущих версий, что делает её конкурентоспособной на рынке дешевых inference решений.
Рынок моделей с длинным контекстом и низкой стоимостью inference получает мощный стимул для развития и конкуренции.