📰 IT Дайджест

← К выпуску 31.08.2026

Qwen3.8-Flash-Next: 170K контекст на одной 96 ГБ карте, ~110 токен/с

www.reddit.com · #ai #gpu #inference #llm #qwen

Заявлена работа Qwen3.8-Flash-Next с контекстом 170K токенов на одной 96 ГБ видеокарте со скоростью около 110 токенов в секунду. Подробности не раскрыты.

Открыть оригинал →