Автор, известный как амбассадор ИИ, опубликовал на Habr вторую часть своего опыта использования больших языковых моделей. Она начинается с цифры: более миллиарда токенов в день, которые она тратит, запуская по 7–9 потоков агентов в течение 12 часов. Это не просто статистика, а повод разобраться, какие подписки и модели оправдывают деньги и как организовать работу, чтобы не разориться.
С 1 мая, когда вышла первая часть, качество ИИ-агентов заметно выросло. Автор отмечает, что суб-агенты перестали быть эффективными, а западные фронтиры не уступили китайским моделям. В новом обзоре она рассматривает подписки Grok, GPT, OpenCode Go, Ollama Cloud, Qwen, Minimax и Kimi, исключая Claude и Google из-за блокировок аккаунтов.
| Модель | Цена подписки | Сильные стороны | Ограничения |
|---|---|---|---|
| GPT 5.6 Luna | $20/мес | Высокий интеллект, низкая цена | Младшая модель, лимиты |
| Minimax M3 | не указано | Большие лимиты, скорость | 5-часовое окно |
| Kimi 3 | $40/мес | Дизайн, бренд | Быстро расходует токены, дорого |
| Deep Seek V4 Flash | $20/мес (Ollama Cloud) | Скорость, качество | Нет явных |
Ключевая модель в линейке GPT — GPT 5.6 Luna. Это младшая модель семейства, но её интеллект, по оценке автора, весьма высок. Luna, как и Deep Seek V4 Flash, имеет низкую цену, что позволяет использовать подписку GPT за $20 долго, запуская по 2–3 Luna в день для основных задач. Для сложных задач автор рекомендует использовать GPT Astra или GPT 5.6 Sol в веб-чате, а затем передавать результаты через Google Disk локальному агенту Luna. Такой подход позволяет неограниченно использовать старшие модели, оставляя рутину младшей.
Minimax M3 — рабочая лошадка с большими лимитами, но ограничением в виде 5-часового окна, подходит для рутинных задач.
Minimax M3 — ещё одна модель, которую автор называет «верным другом и рабочей лошадкой». Она уступает Luna, Deep Seek V4 Flash и Qwen по качеству, но имеет значительно большие лимиты. Единственное ограничение — 5-часовое окно. Автор использует Minimax для долгих рутинных задач, особенно связанных с devops, экономя другие подписки. Скорость у M3 выше, чем у Luna, но ниже, чем у Deep Seek V4 Flash.
Kimi вызывает смешанные чувства. Когда-то Kimi была лидером, но теперь её подписка стоит $40 в месяц, что вдвое дороже стандартных $20. При этом Kimi 3 быстро расходует токены, а Kimi 2.7 уже отстаёт от конкурентов. Автор ставит Kimi на четвёртое место по приоритету покупки, отмечая, что она хороша для дизайна и бренда, но не для вёрстки. Она советует протестировать Kimi на своих задачах перед покупкой.
Ollama Cloud перешла на прозрачную тарификацию: за $20 пользователь получает $60 на токены. Deep Seek V4 Flash, по словам автора, стала круче или такой же, как Deep Seek V4 Pro в мае. Это отличная модель для всего, и с подпиской Ollama Cloud она становится выгодным вариантом.
В целом, автор подчёркивает, что выбор подписки зависит от задач. Для сложных задач — GPT Pro с 7–9 потоками Luna и 50 запросами к Astra Pro в неделю. Для рутины — Minimax M3 или Deep Seek V4 Flash. А для экономии — комбинация GPT Luna и Google Disk. Главное — правильно организовать проекты и не бояться экспериментировать.

