Разговор начался с бытового вопроса: знакомая, далёкая от IT, спросила, можно ли сразу посадить в базу знаний агента, чтобы он делал всё сам. Автор отговаривать начал не из технических соображений. У него самого под базой крутятся четыре субагента в отдельном репозитории bear-skills, а основная работа идёт в Claude Code. Проблема в другом месте: на старте агент занимает ровно ту позицию, ради которой база и заводится — разобрать источник, пересказать своими словами, заметить, с чем это связано. Отдал эти операции машине — получил аккуратный склад и прежнюю пустую голову.

Спор про LLM и Obsidian идёт в ленте давно, и у него есть три заметных голоса. Andrej Karpathy в gist'е llm-wiki описывает структуру хранилища под LLM-агента: слой неизменяемого сырья, компилируемая вики, глобальный индекс и schema-файл с конвенциями. Канал ИИ Impact в видео «Don't Use Karpathy's Second Brain (I BUILT SOMETHING BETTER)» показывает Infinite Brain — 16 типов узлов, 10 типизированных рёбер, атомарные файлы и граф, по которому агент рассуждает, экономя токены. Chase ИИ в «The 7 Levels of Claude Code & RAG» называет Obsidian-уровень «80%-решением, которое на деле почти 99%-решение для большинства»: бесплатно, почти без overhead'а, соло-оператору хватает.

ПодходАвторСтруктураДля чего
llm-wikiAndrej KarpathyСырьё, вики, index.md, log.md, schema-файлОбход базы LLM-агентом
Infinite BrainAI Impact16 типов узлов, 10 типизированных рёбер, атомарные файлы, графРассуждение агента по связям с экономией токенов
Тренажёр АгамалиеваРустам АгамалиевObsidian + Claude в роли тренажёраРабота с источником, оставляющая след в сознании

Схема Карпатого устроена так. Файл CLAUDE.md (или AGENTS.md) задаёт, как устроена вики, какие конвенции и workflow. Папка raw/ хранит неизменяемое сырьё: статьи, papers, картинки, данные. Папка wiki/ содержит markdown-страницы, которые пишет и поддерживает LLM. Файл index.md работает каталогом — ссылка на страницу, строка описания, опционально метаданные. Файл log.md ведёт append-only лог: ingest, запросы, lint-проходы. Поток запроса идёт от index.md к отобранным страницам, ответ приходит с цитатами, а удачный ответ можно дописать обратно в вики отдельной страницей.

Проект Infinite Brain доводит идею до графа: 16 типов узлов и 10 типизированных рёбер, чтобы агент рассуждал по связям и экономил токены.

Оговорка, которую в пересказах теряют: это idea file, а не спецификация. Карпатый прямым текстом пишет, что документ намеренно абстрактный, а конкретная структура каталогов и форматы страниц зависят от домена. Имена raw/ и wiki/ — уже чья-то реализация, у него это просто слои «raw sources» и «the wiki». Канонические раскладки с master_index.md и вложенными wiki/<topic>/index.md, которые ходят по пересказам, — тоже чьи-то реализации, а не его требования. В иерархии Chase ИИ для памяти Claude Code от AutoMemory до Agentic RAG это уровень 4 из 7: ни embedding-пайплайна, ни векторного хранилища, ни оркестрации — markdown-файлы и Obsidian.

Здесь и вторая подмена. Цитата про «99%-решение» относится к уровню 4 целиком, то есть к markdown-базе в Obsidian вместо AutoMemory или RAG. Эталоном уровня Chase ИИ называет схему Карпатого, а вложенный master index с папками под статьи показывает как свою реализацию. Это аргумент за Obsidian как уровень, а не за конкретную таксономию. Когда «99%-решением» обосновывают выбор раскладки каталогов или десяти рёбер Infinite Brain, это натяжка. И отдельная строчка, на которой держится вся схема: «You never (or rarely) write the wiki yourself — the LLM writes and maintains all of it. You're in charge of sourcing, exploration». То есть человек отвечает за поиск и отбор источников, а не за письмо.

Все три голоса отвечают на один вопрос — как сделать базу удобной для LLM. Ни один не отвечает на другой: что происходит с головой владельца. За последние месяцы личная база автора, больше шести тысяч заметок, заметно сместилась в сторону структур, удобных для агента; под это был отдельный проект про обогащение базы знаний для агентного взаимодействия, и он уже закрыт. Параллельно появился симптом: всё чаще человек помнит, что в базе про это что-то есть, но не помнит что. Знание ушло из головы в индекс.

Практический вывод сводится к границе. Агенту можно отдавать рутину с первого дня: разбор форматов, нормализацию метаданных, поддержку индекса, поиск дублей, линковку по формальным признакам. Нельзя отдавать три операции, ради которых база и существует: разобрать источник, пересказать своими словами, заметить, с чем это связано. Вопрос «кто пишет твою базу знаний» становится твоим ровно в тот момент, когда ты перестаёшь понимать, что в ней лежит.