Microsoft представила MAI Code 1.1 Flash — модель для генерации кода, интегрированную в GitHub Copilot. По заявлению компании, новая модель пишет код лучше, на 25% эффективнее расходует токены и стоит в четыре раза дешевле версии, выпущенной в июне. Разработчики принимают на 4% больше предложений, сгенерированных моделью. Обучение проходило с использованием «сотен тысяч сред обучения с подкреплением» в GitHub Copilot.

Однако бенчмарки, опубликованные в карточке модели, показывают, что MAI Code 1.1 Flash лишь незначительно превосходит предшественника и мини-модели от Anthropic и OpenAI, но значительно уступает открытой модели DeepSeek-V4-Flash-0731. На бенчмарке SWE-bench Verified модель набирает 72.6%, тогда как DeepSeek-V4-Flash не публикует результат. На Terminal Bench 2.1 показатели составляют 62.9% против 82.7% у DeepSeek. При этом стоимость MAI Code 1.1 Flash выше: $0.20 за миллион входных токенов против $0.14 у DeepSeek, и $1.20 за миллион выходных токенов против $0.28.

МодельSWE-bench VerifiedTerminal Bench 2.1
MAI-Code-1.1-Flash72.6%62.9%
MAI-Code-1-Flash71.6%51.7%
Haiku 4.569.8%49.4%
GPT-5.4 mini69.2%60.7%
DeepSeek-V4-Flash-0731Не опубликовано82.7%

Разница в цене особенно заметна при учёте эффективности использования токенов. Хотя стоимость токена не отражает полную картину без учёта эффективности, разрыв в пользу DeepSeek, вероятно, значителен. Это объясняет, почему Microsoft в официальном анонсе избегает прямых сравнений с конкурентами, ограничиваясь расплывчатыми метриками улучшения по сравнению с предшественником, такими как «рост выживаемости кода на 4%» и «увеличение повторных обращений на 9%».

На бенчмарке Terminal Bench 2.1 модель набирает 62.9%, тогда как DeepSeek-V4-Flash — 82.7%.

Ситуация противоречит недавним заявлениям Microsoft о поддержке открытого ИИ. Вместо использования более мощных и доступных открытых моделей, таких как DeepSeek-V4-Flash, компания вкладывает ресурсы в собственную проприетарную модель, которая слабее и дороже. Причина, вероятно, та же, что и в недавней реорганизации Copilot, где Microsoft заменила модели OpenAI и Anthropic на собственные более дешёвые MAI-модели для сокращения расходов. Это привело к снижению качества в обмен на улучшение маржи.

MAI Code 1.1 Flash вписывается в эту стратегию. Пользователи экосистемы Microsoft могут выбирать разные модели в зависимости от приложения и сценария, но Microsoft, скорее всего, сделает собственные модели стандартными по умолчанию. Это позволит компании занять значительную долю рынка, поскольку большинство пользователей не выбирают модель осознанно. Таким образом, несмотря на риторику об открытости, стратегия Microsoft направлена на укрепление собственной проприетарной экосистемы.