На этой неделе исследователь Anthropic объявил об уходе из компании. В посте на X он написал, что она «несётся прямо к самоулучшающемуся сверхинтеллекту и играет с нашими жизнями». Сообщение подписал и руководитель направления alignment внутри Anthropic — то есть человек, чья работа как раз в том и состоит, чтобы следить за безопасностью моделей, не стал от него дистанцироваться.

Anthropic — одна из ведущих лабораторий, разрабатывающих большие языковые модели. Компания известна тем, что строит свою публичную позицию вокруг темы безопасности ИИ: она формулирует принципы ответственной разработки и продвигает подход, при котором надёжность модели обсуждается наравне с её возможностями. Именно поэтому внутренний конфликт вокруг alignment-повестки выглядит для отрасли заметнее, чем аналогичные заявления в других компаниях.

СобытиеДетали
Уход исследователя AnthropicПубличное заявление в X о «самоулучшающемся сверхинтеллекте»
Реакция внутри компанииРуководитель alignment-направления подписал то же сообщение
КонтекстСообщения о подготовке Anthropic к IPO
Stokes SpaceПривлёк $1 млрд на фоне сворачивания Falcon у SpaceX
CognitionПривлёк $2 млрд при оценке $48 млрд
Плавучие ядерные реакторыПосевной раунд на $50 млн

Контекст, в котором прозвучало предупреждение, добавляет ему веса. По сообщениям, Anthropic готовится к IPO. Выход на биржу означает публичных акционеров, квартальную отчётность и давление со стороны рынка, который ждёт ускорения выпуска продуктов. Публичное заявление сотрудника и подпись руководителя alignment-направления в такой момент читаются не как абстрактная дискуссия о рисках, а как сигнал о внутренних разногласиях по поводу темпов разработки.

Руководитель alignment-направления Anthropic поставил свою подпись под тем же сообщением, а не открестился от него.

Сотрудник Anthropic ушёл из компании с предупреждением о «самоулучшающемся
· Источник: TechCrunch AI

Разговор о самоулучшающемся сверхинтеллекте — это давняя тема в сообществе исследователей ИИ. Речь о гипотетическом сценарии, при котором система становится способна улучшать саму себя, и темпы её развития перестают быть предсказуемыми для разработчиков. Единого мнения о том, насколько этот сценарий реалистичен и на каком горизонте, в отрасли нет. Одни считают его отдалённой теоретической угрозой, другие — направлением, которое требует внимания уже сейчас.

Публичные предупреждения такого рода в индустрии ИИ звучали и раньше. Однако сочетание двух факторов — ухода сотрудника и подготовки компании к IPO — меняет то, как это воспринимается. Вопрос не только в том, что сказано, но и в том, когда именно это сказано. Для потенциальных инвесторов и партнёров это дополнительный фактор неопределённости: он касается не продукта или выручки, а внутренней устойчивости команды, отвечающей за безопасность.

Что остаётся неясным. В источнике нет данных о том, как на заявление отреагировало руководство Anthropic, повлияет ли оно на сроки IPO и были ли у ушедшего исследователя разногласия с компанией помимо публично озвученных. Нет и подтверждённых деталей о самой подготовке к размещению — только сообщения о ней. Поэтому оценивать ситуацию стоит как сигнал о напряжении внутри одной из ключевых лабораторий, а не как подтверждённый сдвиг в её стратегии.

В том же выпуске подкаста TechCrunch Equity обсудили и другие события недели. Apple сделала акцент на ИИ во время презентации своих устройств — по мнению ведущих, постоянно работающие функции в Watch и AirPods могут оказаться значимее, чем новый складной iPhone. Стартап Stokes Space привлёк $1 млрд на фоне того, что SpaceX сворачивает программу ракет Falcon и освобождает рынок запусков. В стартап по разработке кода Cognition инвесторы вложили $2 млрд при оценке $48 млрд. А проект плавучих ядерных реакторов получил $50 млн на посевном раунде — на фоне растущего спроса на энергию для дата-центров под ИИ.