#qwen
14 материалов
В эксперименте v1.1 в reasoning-канал Qwen3.8 A95B подставляли первые 1% рассуждений GPT-5.5 Pro — совпадение с ответом учителя выросло на +18.18 п.п., особенно на STEM (+26.99 п.п.) и синтетических головоломках (+14.75 п.п.). Автор считает, что Qwen могла учиться у GPT-5.5 Pro или близкой модели, а не у Opus. Kimi K3 показала наибольшее перекрытие с GPT-5.5 Pro и без префилла (31.11%), но прирост от префилла всего +4.54 п.п.
gist.github.com · #ai #llm #qwen #reasoning
Заявлена работа Qwen3.8-Flash-Next с контекстом 170K токенов на одной 96 ГБ видеокарте со скоростью около 110 токенов в секунду. Подробности не раскрыты.
www.reddit.com · #ai #gpu #inference #llm #qwen
125B MoE-модель с 6B активных параметров на токен, 51B N-gram эмбеддингов, выгружаемых в RAM/SSD, и гибридным механизмом Gated DeltaNet + Qwen Sparse Attention. На контексте в 1M токенов Prefill ускорился в 8.6x. Нативное окно — 262K токенов.
habr.com · #ai #architecture #llm #qwen
Qwen выложила open-weights Qwen3.8-Flash-Next — мультимодальную MoE-модель, которую называют ранним превью архитектуры Qwen4. При суммарном размере 125B активны только 6B; Саймон Уиллисон уже гонял её на DGX Spark в квантованиях Unsloth (72.5GB UD-IQ1_S и 78.9GB UD-Q2_K_XL).
simonwillison.net · #ai #ai #llm #moe #qwen
По заголовку, модель Qwen 3.8 27B объявлена значительным прорывом. Детали не раскрыты.
www.reddit.com · #ai #ai #llm #qwen
По заголовку, модель Qwen3.8-27B в формате NVFP4 с поддержкой зрения работает на одной RTX 5090 (ограничение 400 Вт) со средней скоростью 120 токенов/с и кэшем ключей/значений на 451K токенов. Подробности не раскрыты.
www.reddit.com · #ai #ai #gpu #llm #qwen
Qwen3.8-27B (Apache 2.0) — мультимодальная dense-модель с 27,78 млрд параметров, гибридной архитектурой (16 слоёв full attention, 48 слоёв Gated DeltaNet) и контекстом 262K токенов. По бенчмаркам (Terminal-Bench 2.1, SWE-bench Pro, LiveCodeBench v6) в ряде тестов обходит Claude Opus 4.6 Max, хотя сравнительные таблицы от Qwen включают внутренние бенчмарки и не всегда честно перегоняют Opus.
habr.com · #ai #ai #llm #qwen #release
Флагманская модель Qwen с архитектурой Mixture-of-Experts (активны ~95 млрд на запрос). Alibaba впервые открывает веса Max-класса. В демонстрациях модель автономно писала код 16 дней, воспроизвела научную статью и обошла оригинал на +2,7 балла на AIME24, а на симуляции торговли за год заработала 4,16x к стартовому капиталу.
habr.com · #ai #alibaba #llm #qwen
Alibaba/Qwen анонсировали Qwen3.8-Max, позиционируя её как новый стандарт для программирования и совместной работы. Подробностей о модели пока не раскрыто — известно только название и ажиотаж на Hacker News (211 очков, 74 комментария).
qwen.ai · #ai #coding #llm #qwen
Alibaba анонсировала Qwen 3.8 с заявленными 2.4 трлн параметров. Компания утверждает, что модель уступает только Fable 5. Preview-версия Qwen3.8-Max-Preview уже доступна на платформах Token Plan, Qoder и QoderWork. Дата открытия весов не объявлена.
twitter.com · #ai #llm #qwen #release
На Reddit появился пост о тестировании Qwen 3.8 с 2.4 трлн параметров. Детали тестирования не раскрыты. Из заголовка известно только, что модель протестирована, но конкретные результаты или сравнения не приведены.
www.reddit.com · #ai #llm #qwen #release
На Reddit появился пост с призывом готовить видеопамять к выходу Qwen 3.8 — модели с 2.4 трлн параметров. Подробностей о дате релиза или требованиях к железу нет. Очевидно, что запуск такой модели локально потребует значительных ресурсов, но конкретные цифры не раскрыты.
www.reddit.com · #ai #llm #qwen #vram
В посте Qwen 3.6 27B называют sweet spot для локальной разработки, и комментарии на HN это, судя по всему, проглотили с аппетитом: 727 очков и 548 комментариев. Самое занятное тут не маркетинг, а то, что люди всерьёз обсуждают 27B-модель как удобный вариант для запуска у себя, а не только в облачной империи.
quesma.com · #ai #llm #local #quantization #qwen
Alex Ellis написал пост с довольно здравой мыслью: локальный Qwen не надо сравнивать с Opus как с уменьшенной копией дорогой модели. Логика простая и немного неприятная для любителей единой шкалы «качества»: если задача другая, то и модель нужна другая, особенно когда локальный запуск важнее максимального уровня ответа.
blog.alexellis.io · #ai #llm #local #qwen #workflow