<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Qwen on Tsingular — Стратегия внедрения ИИ для бизнеса</title><link>https://www.tsingular.ru/tags/qwen/</link><description>Recent content in Qwen on Tsingular — Стратегия внедрения ИИ для бизнеса</description><generator>Hugo -- gohugo.io</generator><language>ru</language><managingEditor>Михаил Малышев (mbmalyshev (a) yandex.ru)</managingEditor><webMaster>Михаил Малышев (mbmalyshev (a) yandex.ru)</webMaster><lastBuildDate>Sat, 19 Sep 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://www.tsingular.ru/tags/qwen/index.xml" rel="self" type="application/rss+xml"/><item><title>JetBrains объединили два Qwenа в один: локальный агент Junie стал умнее, генерируя на 71% меньше токенов</title><link>https://www.tsingular.ru/blog/2026-09-19-jetbrains-junie-local-qwen-blend/</link><pubDate>Sat, 19 Sep 2026 00:00:00 +0000</pubDate><author>Михаил Малышев (mbmalyshev (a) yandex.ru)</author><guid>https://www.tsingular.ru/blog/2026-09-19-jetbrains-junie-local-qwen-blend/</guid><description>&lt;p>&lt;img src="https://www.tsingular.ru/images/posts/2026-09-19-jetbrains-junie-local-qwen-blend/jetbrains-junie-local-qwen-blend-cover.png" alt="2026-09-19-jetbrains-junie-local-qwen-blend">&lt;/p>
&lt;p>&lt;a href="https://blog.jetbrains.com/junie/2026/09/smarter-local-al/">&lt;strong>JetBrains объединили два Qwenа в один: локальный агент Junie стал умнее, генерируя на 71% меньше токенов&lt;/strong>&lt;/a>&lt;/p>
&lt;p>JetBrains опубликовали обновление Junie Local, - кодового-агента, работающего локально на вашей машине. В первом релизе приходилось выбирать: быстрая Qwen3.6 без рассуждений или умная Qwen3.8, которая думала в четыре раза дольше за счёт рассуждений.&lt;br>
Команда JB усреднила веса двух моделей. Без дообучения или дистилляции, - получили микс Qwen3.8-3.6-27B и опубликовали его на&lt;a href="https://huggingface.co/JetBrains/Qwen3.8-3.6-27B-blend"> Hugging Face&lt;/a>.&lt;/p>
&lt;p>&lt;strong>🧪 Ключевые цифры:&lt;/strong>&lt;br>
Внутренний бенчмарк из 100 задач: модель закрыла 37 задач против 34 у быстрой Qwen3.6 и почти догнал умную Qwen3.8 с ее 39.&lt;br>
При чём на задачах, с которыми новая микс-модель справилась так же как и Qwen 3.8, она тратит всего 279K токенов против 935K у Qwen3.8, - экономия получается около 70%, - это и быстрее и дешевле.&lt;br>
На LiveCodeBench за 4 прогона бленд взял 85.47% против 83.29% у Qwen3.8 при схожей цене вывода.&lt;/p>
&lt;p>&lt;strong>⚙️ Инженерия рантайма:&lt;/strong>&lt;br>
В модели используют MTP с 2мя токенами на раунд предсказания и получают на MacBook M5 прирост к скорости в 60%. Если поставить 4 токена, то прирост скорости проседает до 36%.&lt;br>
Деталь: 4-битная голова MTP принимает 63.&lt;strong>0&lt;/strong>% гипотез против 63.&lt;strong>6&lt;/strong>% у 8-битной, - разницы в скорости нет, поэтому выбрали Q4 ради экономии памяти.&lt;/p>
&lt;p>&lt;strong>🐛 Ловушка воспроизводимости:&lt;/strong>&lt;br>
Интересный баг: фиксированный сид для повторяемости тестов вызывал числовую нестабильность, - модель заклинивало на неудачном действии.&lt;br>
Фикс: продвигать сид на каждом шаге агента.&lt;/p>
&lt;p>&lt;strong>🪟 Что доступно:&lt;/strong>&lt;br>
Apple M5: обновите Junie, модель переключается командой /model.&lt;br>
Windows: ночные сборки с экспериментальной поддержкой RTX (Ampere и новее, от 24 ГБ видеопамяти).&lt;/p>
&lt;p>Неожиданно смесь весов дала дешёвый и значительный прирост в эффективности моделей.&lt;/p>
&lt;p>#Junie #локальныемодели #слияниемоделей #Qwen #ИИ&lt;br>
———&lt;br>
&lt;a href="https://t.me/tsingular">@tsingular&lt;/a> | &lt;a href="https://max.ru/tsingular">Max&lt;/a> | &lt;a href="https://www.youtube.com/@tsingular">YouTube&lt;/a> | &lt;a href="https://rutube.ru/channel/25379731/">RuTube&lt;/a> | &lt;a href="https://vk.ru/tsingular">VK&lt;/a> | &lt;a href="https://vkvideo.ru/@tsingular">VK Video&lt;/a> | &lt;a href="https://dzen.ru/tsingular">Дзен&lt;/a>&lt;/p></description></item></channel></rss>