Новые модели Ollama за последний месяц: преимущества и отличия
Август 2026 года ознаменовался не только жарой и очередным обновлением IDE, но и настоящим пополнением в каталогеOllama. Если вы всё ещё думаете, что локальные модели — это «запустить 3B на старом ноутбуке и молиться», пора выйти из пещеры. На сцену вышли три тяжеловеса:Qwen 3.8 27B,NVIDIA Nemotron 3.5 LightningиMuse Glimmer. Один универсал, второй хитрый MoE-инженер, третий — яблочный фанат кодинга. Разбираем, кто из них что умеет и зачем вам это на рабочем ноутбуке.
<h1>Новые модели Ollama за последний месяц: преимущества и отличия</h1> <p class="lead">Август 2026 года ознаменовался не только жарой и очередным обновлением IDE, но и настоящим пополнением в каталоге <a href="https://ollama.com/library">Ollama</a>. Если вы всё ещё думаете, что локальные модели — это «запустить 3B на старом ноутбуке и молиться», пора выйти из пещеры. На сцену вышли три тяжеловеса: <strong>Qwen 3.8 27B</strong>, <strong>NVIDIA Nemotron 3.5 Lightning</strong> и <strong>Muse Glimmer</strong>. Один универсал, второй хитрый MoE-инженер, третий — яблочный фанат кодинга. Разбираем, кто из них что умеет и зачем вам это на рабочем ноутбуке.</p> <h2>Qwen 3.8 27B — универсальный солдат с китайскими корнями</h2> <p>Qwen уже давно перестал быть «той моделью, которую все скачивают ради китайского перевода». Версия 3.8 в варианте 27B — это, по сути, швейцарский нож для локального AI: кодит, рассуждает, вызывает функции и даже ведёт себя как агент без нервного тика.</p> <h3>Что внутри и зачем</h3> <ul> <li><strong>27 миллиардов параметров</strong> — золотая середина между «умеет думать» и «умещается на одну видеокарту».</li> <li><strong>Кодинг на уровне</strong>: от генерации скриптов до рефакторинга легаси, которое вы боялись трогать.</li> <li><strong>Агентные возможности</strong>: планирование, вызов инструментов, многошаговые задачи — без необходимости городить костыли вокруг API.</li> <li><strong>Поддержка Apple Silicon через MLX</strong>: на MacBook Pro с M-серией модель летает как родная, а не как эмуляция Windows на Parallels.</li> <li><strong>Мультиязычность</strong>: русский, английский, китайский и ещё пара десятков языков — для тех, кто не любит переводить промпты.</li> </ul> <p>Если вам нужна одна модель «на все случаи жизни» — от написания README до автоматизации рутины — Qwen 3.8 27B претендует на роль главного питомца в вашем <code>ollama list</code>.</p> <h3>Как запустить</h3> <p>Скачать и погонять можно одной командой:</p> <p><code>ollama run qwen3.8:27b</code></p> <p>Если хотите сначала просто приглядеться:</p> <p><code>ollama pull qwen3.8:27b</code></p> <p>Больше деталей — на <a href="https://ollama.com/library/qwen3.8">карточке Qwen 3.8 в библиотеке Ollama</a>.</p> <h2>NVIDIA Nemotron 3.5 Lightning — MoE, который обманывает разумно</h2> <p>NVIDIA, как всегда, не смогла удержаться и выпустила собственную модель. Но вместо очередного «всё сожжём за 80B» они пошли по пути смешанных экспертов: <strong>30B параметров всего, но активных на каждый токен всего 3B</strong>. Звучит как маркетинг, но на практике это означает скорость маленькой модели и качество модели большой. Магия? Нет, просто математика, которую мы не будем здесь расписывать — вы и так пришли за практикой.</p> <h3>Главные фишки</h3> <ul> <li><strong>30B MoE / 3B active</strong>: быстрый инференс без необходимости покупать второй блок питания.</li> <li><strong>Агентные сценарии</strong>: Nemotron заточен под tool use и многоходовые рабочие процессы.</li> <li><strong>Генерация синтетических данных</strong>: отлично подходит, если вы хотите накрутить датасет, не прося стажёра писать JSON вручную.</li> <li><strong>Дисциплина от NVIDIA</strong>: модель обучена с акцентом на полезность, инструктаж и безопасность — меньше галлюцинаций, больше дела.</li> </ul> <p>Это выбор для тех, кто хочет «умную» модель, но не готов ждать по 30 секунд на токен. Особенно если ваши задачи — агенты, RAG-пайплайны или автоматизация внутри компании.</p> <h3>Как запустить</h3> <p><code>ollama run nemotron3.5-lightning:30b-moe</code></p> <p>Или, если вы из тех, кто сначала читает инструкцию:</p> <p><code>ollama pull nemotron3.5-lightning:30b-moe</code></p> <p>Подробности — на странице <a href="https://ollama.com/library/nemotron3.5-lightning">Nemotron 3.5 Lightning</a>.</p> <h2>Muse Glimmer — когда у вас Mac, а задачи — код</h2> <p>Третий участник нашего парада — <strong>Muse Glimmer</strong>. Эта модель не пытается быть всем для всех. Она честно говорит: «Дайте мне кодинг и агентов, и не мешайте». При этом сделана с любовью к владельцам Apple Silicon: оптимизация под <strong>MLX</strong> позволяет выжать из M1/M2/M3/M4 больше, чем выжимает из них даже Safari с сотней вкладок.</p> <h3>Почему стоит обратить внимание</h3> <ul> <li><strong>Узкая специализация</strong>: кодинг и кодинг-агенты. Не пишет стихи, зато редко пишет баги.</li> <li><strong>MLX-оптимизация</strong>: работает на Mac быстро и без лишнего нагрева. Ваши колени при работе с ноутбуком на коленях скажут спасибо.</li> <li><strong>Низкая латентность</strong>: удобно для интерактивного дополнения кода и быстрых итераций.</li> <li><strong>Хорошая совместимость с популярными стеками</strong>: Python, JavaScript, Swift, Go — всё, что обычно лежит в типичном проекте.</li> </ul> <p>Muse Glimmer — это не модель для философских бесед о смысле жизни. Это рабочая лошадка, которая знает, где ставить точку с запятой, и умеет вызвать нужный инструмент.</p> <h3>Как запустить</h3> <p><code>ollama run muse-glimmer:latest</code></p> <p>Для консерваторов:</p> <p><code>ollama pull muse-glimmer:latest</code></p> <p>Карточка модели — <a href="https://ollama.com/library/muse-glimmer">Muse Glimmer в Ollama</a>.</p> <h2>Таблица для тех, кто любит сравнивать быстро</h2> <p>Если читать абзацы лень, вот краткая сводка. Мы не осуждаем — иногда и сами такие.</p> <ul> <li><strong>Qwen 3.8 27B</strong>: универсал, кодинг + агенты + MLX + мультиязычность. Лучший выбор, если нужна одна модель на все случаи.</li> <li><strong>Nemotron 3.5 Lightning</strong>: MoE-архитектура, 30B/3B active, агенты и синтетические данные. Лучший выбор, если важна скорость и корпоративная дисциплина.</li> <li><strong>Muse Glimmer</strong>: узкая заточка под код и агентов, топовая MLX-оптимизация для Apple Silicon. Лучший выбор, если вы живёте в Xcode/VS Code и не хотите универсалов.</li> </ul> <h2>Как выбрать свою модель</h2> <p>Выбор, как всегда, зависит от того, что вы делаете больше всего:</p> <ul> <li><strong>Нужен универсальный помощник</strong> — берите Qwen 3.8 27B. Он не блестит в одной нише, но умеет почти всё.</li> <li><strong>Важна скорость, агенты и работа с данными</strong> — Nemotron 3.5 Lightning. MoE здесь не ради красивых слайдов, а ради реальной производительности.</li> <li><strong>Кодите на Mac и хотите минимум задержек</strong> — Muse Glimmer. MLX-оптимизация делает его чувствительнее к вашим капризам, чем средний open-source проект.</li> </ul> <p>И да, не забывайте про <code>ollama ps</code>, чтобы видеть, кто сожрал вашу VRAM, и <code>ollama rm</code>, чтобы избавиться от моделей, которые вы скачали «на всякий случай» три месяца назад.</p> <h2>Вывод</h2> <p>Август 2026 показал, что локальные модели перешли из разряда «игрушка для гиков» в разряд «можно ставить на боевой ноутбук». Qwen 3.8 27B, Nemotron 3.5 Lightning и Muse Glimmer закрывают разные сценарии: от универсальной работы до узкого кодинга на Apple Silicon. Попробуйте каждую — Ollama позволяет менять модели быстрее, чем вы меняете темы в VS Code. Удачных экспериментов, и пусть ваши токены будут быстрыми, а галлюцинации — редкими.</p>