📰 IT Дайджест

#qwen

14 материалов

8. Qwen3.8 A95B повторяет рассуждения GPT-5.5 Pro при префилле

В эксперименте v1.1 в reasoning-канал Qwen3.8 A95B подставляли первые 1% рассуждений GPT-5.5 Pro — совпадение с ответом учителя выросло на +18.18 п.п., особенно на STEM (+26.99 п.п.) и синтетических головоломках (+14.75 п.п.). Автор считает, что Qwen могла учиться у GPT-5.5 Pro или близкой модели, а не у Opus. Kimi K3 показала наибольшее перекрытие с GPT-5.5 Pro и без префилла (31.11%), но прирост от префилла всего +4.54 п.п.

gist.github.com · #ai #llm #qwen #reasoning

14. Alibaba показала Qwen3.8-Flash-Next — превью архитектуры Qwen 4

125B MoE-модель с 6B активных параметров на токен, 51B N-gram эмбеддингов, выгружаемых в RAM/SSD, и гибридным механизмом Gated DeltaNet + Qwen Sparse Attention. На контексте в 1M токенов Prefill ускорился в 8.6x. Нативное окно — 262K токенов.

habr.com · #ai #architecture #llm #qwen

12. Qwen3.8-Flash-Next: MoE на 125B с 6B активных

Qwen выложила open-weights Qwen3.8-Flash-Next — мультимодальную MoE-модель, которую называют ранним превью архитектуры Qwen4. При суммарном размере 125B активны только 6B; Саймон Уиллисон уже гонял её на DGX Spark в квантованиях Unsloth (72.5GB UD-IQ1_S и 78.9GB UD-Q2_K_XL).

simonwillison.net · #ai #ai #llm #moe #qwen

6. Qwen3.8-27B на RTX 5090: 120 токенов/с с 451K KV-cache

По заголовку, модель Qwen3.8-27B в формате NVFP4 с поддержкой зрения работает на одной RTX 5090 (ограничение 400 Вт) со средней скоростью 120 токенов/с и кэшем ключей/значений на 451K токенов. Подробности не раскрыты.

www.reddit.com · #ai #ai #gpu #llm #qwen

6. Alibaba выпустила Qwen3.8-27B: dense-модель на 27 млрд параметров, которая влезает в домашнюю видеокарту и обгоняет Claude Opus 4.6 на некоторых бенчмарках

Qwen3.8-27B (Apache 2.0) — мультимодальная dense-модель с 27,78 млрд параметров, гибридной архитектурой (16 слоёв full attention, 48 слоёв Gated DeltaNet) и контекстом 262K токенов. По бенчмаркам (Terminal-Bench 2.1, SWE-bench Pro, LiveCodeBench v6) в ряде тестов обходит Claude Opus 4.6 Max, хотя сравнительные таблицы от Qwen включают внутренние бенчмарки и не всегда честно перегоняют Opus.

habr.com · #ai #ai #llm #qwen #release

4. Alibaba выпустила Qwen3.8-Max — 2,4 трлн параметров, контекст 1 млн токенов, открытые веса

Флагманская модель Qwen с архитектурой Mixture-of-Experts (активны ~95 млрд на запрос). Alibaba впервые открывает веса Max-класса. В демонстрациях модель автономно писала код 16 дней, воспроизвела научную статью и обошла оригинал на +2,7 балла на AIME24, а на симуляции торговли за год заработала 4,16x к стартовому капиталу.

habr.com · #ai #alibaba #llm #qwen

2. Qwen3.8-Max: Alibaba дразнит новой моделью для кода, деталей нет

Alibaba/Qwen анонсировали Qwen3.8-Max, позиционируя её как новый стандарт для программирования и совместной работы. Подробностей о модели пока не раскрыто — известно только название и ажиотаж на Hacker News (211 очков, 74 комментария).

qwen.ai · #ai #coding #llm #qwen

1. Alibaba выпускает Qwen 3.8 с 2.4 трлн параметров — открытые веса скоро

Alibaba анонсировала Qwen 3.8 с заявленными 2.4 трлн параметров. Компания утверждает, что модель уступает только Fable 5. Preview-версия Qwen3.8-Max-Preview уже доступна на платформах Token Plan, Qoder и QoderWork. Дата открытия весов не объявлена.

twitter.com · #ai #llm #qwen #release

9. Пользователь протестировал новую модель Qwen 3.8 с 2.4 трлн параметров — подробностей нет

На Reddit появился пост о тестировании Qwen 3.8 с 2.4 трлн параметров. Детали тестирования не раскрыты. Из заголовка известно только, что модель протестирована, но конкретные результаты или сравнения не приведены.

www.reddit.com · #ai #llm #qwen #release

11. Готовьте VRAM: Qwen 3.8 с 2.4 трлн параметров на подходе

На Reddit появился пост с призывом готовить видеопамять к выходу Qwen 3.8 — модели с 2.4 трлн параметров. Подробностей о дате релиза или требованиях к железу нет. Очевидно, что запуск такой модели локально потребует значительных ресурсов, но конкретные цифры не раскрыты.

www.reddit.com · #ai #llm #qwen #vram

7. Qwen 3.6 27B: локальная модель, которую хвалят за размер

В посте Qwen 3.6 27B называют sweet spot для локальной разработки, и комментарии на HN это, судя по всему, проглотили с аппетитом: 727 очков и 548 комментариев. Самое занятное тут не маркетинг, а то, что люди всерьёз обсуждают 27B-модель как удобный вариант для запуска у себя, а не только в облачной империи.

quesma.com · #ai #llm #local #quantization #qwen

8. Alex Ellis: локальный Qwen — не «хуже Opus», а просто другой инструмент

Alex Ellis написал пост с довольно здравой мыслью: локальный Qwen не надо сравнивать с Opus как с уменьшенной копией дорогой модели. Логика простая и немного неприятная для любителей единой шкалы «качества»: если задача другая, то и модель нужна другая, особенно когда локальный запуск важнее максимального уровня ответа.

blog.alexellis.io · #ai #llm #local #qwen #workflow