Главная мысль июньской конференции Microsoft для разработчиков сводится к одному: нейросети переезжают из облака на локальное железо, а операционная система становится средой, где живут агенты. Ниже — выжимка анонсов без маркетинга: что реально меняется для тех, кто работает с моделями, сколько стоит вход и где обещания пока опережают продукт.
Windows как среда для локального запуска моделей
Ставка сделана на вычислительную мощность, которая уже стоит у людей на столах и простаивает. Если сложить графику, нейроускоритель и процессор обычного ПК, получается достаточно, чтобы крутить модель локально.
Инструмент для этого — переработанный Windows ML, прослойка между программой и железом. Раньше разработчику приходилось подгонять модель под каждый чип вручную; теперь он описывает задачу один раз, а система сама решает, чем считать: процессором, видеокартой или нейроускорителем. Существенная деталь в том, что это работает не на избранных конфигурациях, а на любом железе: локальный ИИ перестаёт быть привилегией машин с отдельной маркировкой. Внутри Microsoft эта схема уже крутится в Outlook, PowerPoint и Teams, а из сторонних — в продуктах Adobe.
Две модели прямо в системе
В Windows встраивается семейство Aion 1.0 из двух моделей, работающих без интернета.
- Aion 1.0 Instruct: небольшая модель для повседневного — суммаризация, переписывание текста, определение намерения пользователя, функции доступности. Веса выкладываются открыто.
- Aion 1.0 Plan: 14 миллиардов параметров, окно контекста 32 тысячи токенов. Она рассуждает, вызывает инструменты, работает с файлами и оркестрирует субагентов, то есть закрывает полный агентный цикл локально.
Роли этих двух моделей легко перепутать: рассуждение и агентная работа лежат на Plan, а Instruct отвечает за простые повседневные операции, а не наоборот.
Сколько стоит локальный интеллект
Дальше был парад железа: AMD с новыми Ryzen, Intel с поколением Panther Lake, Qualcomm сразу с двумя чипами, включая бюджетный, который должен затащить нормальный нейроускоритель в ноутбуки дешевле пятисот долларов.
Центральная новинка — платформа RTX Spark от NVIDIA: процессор, графика и нейроускоритель на одном кристалле с общей памятью, по устройству близко к тому, что Apple сделала в своих чипах. На ней выходят два устройства Microsoft:
| Устройство | Что известно |
|---|---|
| Surface Laptop Ultra | 15 дюймов, сенсорный mini-LED на 2000 нит, батарея на день, выход осенью; следом линейки Asus, Dell, HP, Lenovo, MSI на той же платформе |
| Surface RTX Spark Dev Box | Настольная машина для разработчиков: до петафлопа вычислений, 20 ядер CPU, 128 ГБ общей памяти. На сцене на ней запускали локальную модель на 120 миллиардов параметров |
Порядок цен показывает похожий мини-компьютер NVIDIA той же архитектуры: в российской рознице он стоит около 400 тысяч рублей. Локальный интеллект пока недёшев.
Верхняя граница — Windows на рабочей станции NVIDIA DGX Station, где можно гонять модель на триллион параметров. Помогает этому новый числовой формат NVFP4: топовая модель на пару сотен миллиардов параметров целиком помещается в память домашней машины. Тем, кому железо не нужно, остаётся Windows 365, та же система на серверах Microsoft с подключением с любого устройства.
Мелочи для разработчиков, которых ждали годами
Режим чистого рабочего стола без ленты новостей, виджетов и уведомлений. Терминал со встроенным помощником, который ловит ошибки и подсказывает синтаксис. Больше семидесяти пяти утилит из мира Linux и macOS прямо в системе. Контейнеры WSL стали полноценным механизмом и получили доступ к видеокарте. И вертикальная панель задач, которую просили годами.
Агентам наконец поставили границы
Самая практичная часть анонсов. В систему встроен слой изоляции, ограничивающий то, что агент может сделать с машиной. Демонстрировали это честно: опенсорсному агенту OpenCode, который официально приходит на Windows, поручили удалить все файлы с рабочего стола. Он попробовал и не смог — режим доступа только на чтение не дал. Раньше снёс бы не задумываясь.
Корпоративная часть той же идеи называется Agent 365: панель управления агентами, где у каждого своя учётная запись, права доступа и контроль. Корпоративные системы идентификации и защиты расширены на агентов так же, как на сотрудников. Отдельно показали систему безопасности из сотни с лишним агентов, которые ищут уязвимости в коде.
Для разработчиков появилось приложение с неограниченным числом параллельных агентных сессий и концепт, в котором агент сам строит себе интерфейс для общения с человеком. Корпоративные автономные агенты получают имя и память: агенту задают имя и список задач, после чего он запоминает контекст, учится и работает сам в облаке, на десктопе или в браузере.
Свои модели и общий каталог
В каталоге Microsoft Foundry уже больше одиннадцати тысяч моделей — от OpenAI и Anthropic до собственных; неделей ранее туда добавили Claude Opus 4.8.
Собственных моделей семейства MAI представили семь. Ключевые цифры:
- MAI Thinking, флагман для рассуждений: 97% на математическом наборе AIME 2025 и 53% на SWE-bench Pro, что ставит её рядом с моделями верхнего эшелона на одном из самых тяжёлых кодовых бенчмарков. Обучена на лицензионных данных.
- MAI Image в слепом рейтинге арены обходит свежую модель генерации картинок от Google.
- MAI Transcribe: расшифровка аудио, 43 языка, первое место на отраслевом наборе FLEURS.
- MAI Voice: синтез речи с интонациями.
- MAI Code: модель для кода, заточенная под редактор и помощника Microsoft.
Поверх этого идёт механизм дообучения моделей на данных компании с обещанием, которое стоит проверять на практике: дообученная модель остаётся только у заказчика и не учится на всех подряд. Отдельно анонсирована медицинская модель, которую строят вместе с крупным исследовательским центром на клинической практике, а не только на учебниках.
Устройства, где вместо приложений агент
Project Solara — платформа на базе Android для устройств, рассчитанных на агентов. Тезис радикальный: агенты заменяют приложения, магазина приложений нет, интерфейс — разговор, а не сетка иконок. Идея в том, что компьютер будущего это не одна железка, а россыпь устройств, между которыми агент перемещается.
Показали два образца: настольное устройство, узнающее человека по лицу, и носимый бейдж со сканером отпечатка. Сценарии — розница, логистика, медицина: медсестра с таким бейджем надиктовывает документацию, а камера сканирует препараты. Ни один из образцов в продажу не поступит, это демонстрация для партнёров. Интерес к платформе, впрочем, уже проявили крупные розничные сети.
Инфраструктура под всё это
Формула, вокруг которой Microsoft выстраивает облачную часть, звучит как «токены на доллар на ватт»: сколько полезной работы выжимается из каждого доллара и каждого ватта. Мощностей за последние полтора года нарастили больше, чем за первое десятилетие существования облака.
Флагманом называют первую ИИ-суперфабрику компании, растянутую сразу на два штата, с двухэтажной архитектурой ради плотности и водяным охлаждением почти без расхода воды. Собственный чип Maia 200 уже стоит в дата-центрах и даёт плюс 30% к тем самым токенам на доллар против топовой видеокарты; процессор Cobalt 200 заточен под агентные нагрузки.
Квантовый чип: красиво и далеко
Финалом показали Majorana 2, второе поколение квантового процессора. Главная проблема этой технологии — капризность: рабочая ячейка удерживает состояние доли секунды, после чего расчёт рассыпается. У нового чипа она держится до десятков секунд, что примерно в тысячу раз дольше, чем у прошлогоднего первого поколения, и миллион таких ячеек помещается на кристалле меньше банковской карты.
Что это значит для практики сегодня: ничего. Квантовая машина не появится дома, не ускорит работу и не заменит ноутбук. Это инструмент для задач, которые упираются в стену на обычном железе: расчёт лекарств, моделирование материалов и химии. Горизонт таких применений измеряется годами.
Соседний сюжет из той же категории «пока демонстрация»: платформа для научных исследований, где команда агентов ведёт работу по научному методу. В показанном примере агенты написали статью, сгенерировали восемь десятков новых белков для разложения пластика и отправили последовательности в реальную лабораторию.
Что из этого стоит держать в голове
Смена платформы происходит в двух местах сразу. Первое: локальный запуск моделей перестаёт быть уделом энтузиастов с ручной сборкой окружения — единый слой исполнения на любом железе и модель в коробке снимают главный барьер. Приватность и отсутствие оплаты за каждый токен здесь важнее скорости.
Второе: агент из ассистента превращается в отдельную сущность со своей учётной записью, правами и памятью, и именно поэтому появился слой изоляции. Демонстрация с несостоявшимся удалением файлов показательнее всех бенчмарков: индустрия дошла до того, что автономного исполнителя нужно ограничивать в правах, как обычного сотрудника.
Остальное пока стоит держать в разделе «посмотрим». Устройства на Android без приложений в продажу не идут, обещание изолированного дообучения проверяется только практикой, а квантовый процессор к повседневной работе отношения не имеет.
Сравните модели перед запуском
Тарифы, лимиты и список моделей — на стороне сервиса. Если что-то разойдётся с описанным здесь, напишите: поправим материал и проставим новую дату проверки.
Открыть каталог моделей«SEO Разум» не продаёт доступ к API и не является поставщиком токенов.