Copilot на Copilot+ PC начнёт считать часть задач локально
Microsoft сжимает до 3 бит модель на 137 миллиардов параметров, из которых одновременно работают 6,8 миллиарда, и запускает её прямо на ПК без потери контекста в 256K. Тут же Copilot для Windows научится пользоваться локальными моделями, вашими файлами и действиями в системе, о чём компания рассказала в блоге Microsoft.
Коротко
- Copilot на Copilot+ PC получит три локальных навыка: с вашего разрешения он прочитает файлы и недавнюю активность, выполнит действия в Windows и обратится к моделям на устройстве.
- Распределять работу между ПК и облаком будет GitHub HydraFusion, а MAI Code 1.1 Flash после 3-битного сжатия стала меньше почти на 80% и держит локально контекст 256K.
- Точной даты для Copilot нет: функции начнут раскатывать на Copilot+ PC в ближайшие месяцы, а HydraFusion выйдет позже в октябре только как экспериментальное превью.
Если вы не следили: Copilot+ PC, как писал Windows Experience Blog, появились в мае 2024 года вместе с Phi Silica, локальной моделью для NPU на основе производной Phi-3.5-mini с контекстом 4k. NPU здесь означает отдельный ускоритель для нейросетей, и по данным Windows Forum, порог для Copilot+ составляет 40+ TOPS. По словам Microsoft, сейчас такие машины выполняют локально больше 2 триллионов инференсов в месяц, а среди бизнес-ноутбуков их уже больше 40%.
Copilot получит доступ к файлам, действиям и моделям на Copilot+ PC
Новый Copilot Microsoft недавно собрала вокруг трёх режимов: Home, Code и Autopilot. На Copilot+ PC все три получат локальный слой. Первый навык называется локальным контекстом: с вашего разрешения Copilot видит файлы и недавнюю активность. Второй отвечает за действия: Copilot наводит порядок в файлах, смотрит диагностику, разбирается с неполадками, пишет код и выполняет цепочки задач на ПК. Третий подключает локальные модели, а облако добавляет по необходимости.
В Home Copilot подтянет файлы, с которыми вы работали, и поможет превратить их в материалы для совместной работы. В Code он соберёт нативное приложение для Windows из одного промпта, запустит код в изоляции MXC и при случае переключится на локальную модель, чтобы расходовать меньше токенов. Autopilot, постоянный проактивный агент, сможет продолжать работу, пока вы заняты другим. Сатья Наделла в посте в X описал обещание так: больше возможностей, а токенов хватает надольше.
MAI Code 1.1 Flash ужали почти на 80% с сохранением контекста 256K
MAI Code 1.1 Flash Microsoft представила на Build: 137 миллиардов параметров всего и 6,8 миллиарда активных, модель рассчитана на реальные задачи программирования. Для запуска на ПК её перевели в 3-битную точность, что сократило размер почти на 80%. По словам Microsoft, качество кода при этом сохранилось, а локально поддерживается окно контекста 256K.
Рядом будут и чужие модели. Готовящийся Nemotron от NVIDIA на более чем 70 миллиардов параметров квантован в 2 бита и занимает чуть больше 20 ГБ памяти. DeepSeek V4 Flash на 284 миллиарда параметров и другие модели Microsoft обещает запускать локально на RTX Spark.
Для разработчиков Windows ML, рантайм для развёртывания моделей на GPU, NPU и CPU, получает поддержку llama.cpp. По замыслу Microsoft, так проще пробовать свежие открытые модели сразу после их выхода.
MXC вышли в общий доступ, и Codex с GitHub Copilot уже их поддерживают
Microsoft Execution Containers, или MXC, стали общедоступны в Windows 11. Под этим названием скрывается песочница для агентов: организация задаёт, к каким файлам и сетям агент получит доступ, и политики соблюдаются прямо во время работы. Изоляция бывает разной: от процесса и сессии до WSLc, виртуальных машин и Windows 365 for Agents. У агента есть собственная идентичность, и через Agent 365 и Intune ИТ-отдел отличает его действия от действий человека.
MXC уже поддерживают Codex от OpenAI, GitHub Copilot, OpenClaw, Replit, LM Studio, OpenShell от NVIDIA и Unsloth AI. Поддержку готовят Claude Code от Anthropic, Box, Egnyte, Heidi Health, Hermes Agent от Nous Research, Manus, Perplexity, Raycast и Simular. Meta выпустит своего персонального агента Muse for Windows как нативное приложение с интеграцией MXC.
Surface Laptop Ultra с памятью до 128 ГБ поступит 16 октября
Surface Laptop Ultra на NVIDIA RTX Spark уже доступен для предзаказа, вместе с новыми устройствами ASUS, Dell, HP, Lenovo и MSI. По данным Testing Catalog, у ноутбука до 128 ГБ общей памяти, он справляется с моделями больше 120 миллиардов параметров и поступит в продажу 16 октября. Саму RTX Spark Microsoft и NVIDIA представили в июне.
Наверху линейки стоят DGX Station for Windows: как пишет Testing Catalog, эти системы рассчитаны на модели до триллиона параметров и выйдут до конца года. Внизу находятся мини-ПК, которые держат включёнными ради долгих агентов. Популярных агентов на них обещают ставить в несколько кликов, а для OpenClaw появится нативный шлюз Windows с интеграцией MXC.
Есть и мелочь для повседневной работы. По данным Testing Catalog, участники Windows Insider смогут прямо из поиска на панели задач переключать настройки, управлять окнами и отправлять сообщения.
HydraFusion начнёт отдавать часть задач моделям на ПК позже в октябре
HydraFusion GitHub запустил в этом году как маршрутизатор: он смотрит на задачу и отправляет её подходящей модели в облаке. Теперь Microsoft расширяет его на Windows, чтобы он выбирал и модели, работающие на самом устройстве. Экспериментальное превью появится позже в октябре в приложении GitHub Copilot, GitHub Copilot CLI и Visual Studio Code.
Логику проще представить на примере мастерской: мелкий ремонт делают на месте, а сложный заказ везут в специализированный сервис. Простые задачи обрабатывает локальная модель и не тратит облачные токены, сложные уходят в облако. Microsoft объясняет это тем, что потребности клиентов в ИИ обгоняют облачные бюджеты. По данным Testing Catalog со ссылкой на технический разбор, в Copilot будут и автоматическая маршрутизация, и явный выбор локальной модели.
Главное ограничение в том, что вся гибридная часть Copilot привязана к Copilot+ PC, а по данным Windowscenter, большинство таких машин пока работает на ARM-процессорах Snapdragon X. Сколько памяти нужно MAI Code 1.1 Flash локально, основной анонс не говорит, хотя для Nemotron цифра приведена. На наш взгляд, обещание «токенов хватит надольше» пока не подкреплено ни одной цифрой: Microsoft не раскрывает, какую долю задач роутер отдаёт локальной модели и сколько это экономит.
Превью в октябре, Copilot позже
Первая проверка придёт позже в октябре, когда HydraFusion появится в экспериментальном превью в приложении GitHub Copilot, CLI и VS Code. Вторая придётся на 16 октября, когда Surface Laptop Ultra, по данным Testing Catalog, поступит в продажу. Гибридные функции Copilot начнут раскатывать на Copilot+ PC в ближайшие месяцы, точной даты Microsoft не называет. Сроки поддержки MXC в Claude Code и остальных ожидаемых агентах тоже пока не объявлены.
Читайте также
- В Microsoft Copilot завезли кодинг на базе GitHub Copilot
- Decisions API от OpenAI вышел в публичную бету для всех
- Моды на TypeScript перекраивают Claude Code изнутри
- DeepSeek Harness v0.2 вышел без Linux, хотя его обещали
- OpenAI научила Luna выбирать ответ за 150 миллисекунд
- Бот Rollouts в Cursor следит за кодом уже в продакшене
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
