Сектанты, криптовалютчики и глобалисты: с кем Anthropic собрался строить МАГАТЭ для ИИ
Поводом для расследования New York Post стало эссе Дарио Амодеи «Нам нужно замедлить развитие передовых ИИ-систем» (We Must Pace the Frontier), опубликованное 12 сентября. Глава Anthropic считает, что разработка передовых моделей идет быстрее, чем появляются механизмы контроля за ними. Он предлагает предоставить независимым экспертам постоянный доступ к ИИ-лабораториям, чтобы они могли следить за обучением моделей, проверять системы безопасности и расследовать инциденты. В перспективе такие механизмы, по его замыслу, должны перерасти в общие международные правила для крупнейших разработчиков ИИ.
Дарио Амодеи выделяет несколько этапов развития системы. Сначала ведущие ИИ-компании должны договориться о единых стандартах безопасности. Затем к ним должны присоединиться правительства демократических стран. На третьем этапе речь может идти уже о международных соглашениях с участием Китая и других государств. По масштабу это напоминает модель МАГАТЭ, которое занимается международным контролем за ядерными технологиями.
Одной из организаций, способных выполнять роль независимого наблюдателя, глава Anthropic называет METR (Model Evaluation and Threat Research, «Исследования и оценка моделей и угроз»). Она тестирует возможности передовых моделей ИИ и пытается определить, какие задачи они уже способны выполнять самостоятельно и какие риски это создает.
Именно здесь начинается самая спорная часть истории. METR заявляет, что является независимой некоммерческой организацией и не принимает деньги от компаний, непосредственно разрабатывающих ИИ. Но ее история тесно связана с Anthropic.
METR выросла из Alignment Research Center (ARC, «Центр исследований по согласованию ИИ с человеческими целями»), созданного исследователем Полом Кристиано. Пол Кристиано ранее работал в OpenAI вместе с Дарио Амодеи, а позже вошел в число первых попечителей специального траста Anthropic. ARC, в свою очередь, возник из движения Effective Altruism («Эффективный альтруизм»). Это движение предлагает направлять ресурсы туда, где они могут принести человечеству наибольшую пользу.
New York Post называет Effective Altruism сектой и обращает внимание на то, насколько тесно его представители связаны с технологическими миллиардерами и ИИ-индустрией. С «Эффективным альтруизмом» пересекались некоторые весьма известные люди из технологического мира. Среди его сторонников был основатель криптовалютной биржи FTX Сэм Бэнкман-Фрид. После краха компании его признали виновным в мошенничестве и других преступлениях, связанных с выводом средств клиентов FTX, и в 2024 году приговорили к 25 годам тюрьмы.
Еще одна заметная фигура в этой истории — Марк Бениофф, основатель и генеральный директор одного из крупнейших разработчиков корпоративного ПО Salesforce. Компания тесно сотрудничает с Anthropic: Claude используется в Salesforce, а в августе 2026 года стороны запустили Claudeforce — совместную систему, объединяющую ИИ-модели Anthropic с данными и рабочими процессами Salesforce. Марк Бениофф и Дарио Амодеи также публично обсуждали вопросы ответственного развития и управления ИИ. В 2025 году Salesforce сократила около 4 тыс. сотрудников службы поддержки, поскольку часть работы передали ИИ-агентам.
Другой персонаж — Дастин Московиц, сооснователь Facebook*. Через благотворительную организацию Open Philanthropy, которую он создал вместе с женой Кэри Туной, Дастин Московиц финансирует исследования долгосрочных рисков, включая безопасность ИИ. Он также был одним из ранних инвесторов Anthropic.
Еще один сторонник движения, эстонский программист и сооснователь Skype Яан Таллинн, который также инвестировал в Anthropic. Он много лет занимается исследованиями экзистенциальных рисков, в том числе связанных с ИИ. Через свой Survival and Flourishing Fund он направил около $150 млн более чем в 300 проектов, среди которых был METR.
При этом METR официально не финансируется Anthropic и другими ИИ-компаниями: организация утверждает, что не принимает деньги от ИИ-разработчиков.
Критиков беспокоит то, что Anthropic — одна из компаний, которые будут находиться под контролем будущей системы, одновременно активно участвует в формировании того, как эта система должна выглядеть. А в качестве одного из возможных независимых контролеров компания поддерживает организацию, которая исторически выросла из близкой ей системы.
Сторонники Дарио Амодеи предлагают другую трактовку. По их мнению, речь идет не о захвате контроля над отраслью, а о попытке создать механизм, который позволит независимо проверять самые мощные ИИ-системы до того, как они выйдут из-под контроля разработчиков. METR уже проводит независимые тесты моделей и публикует результаты своих исследований.
Дискуссия вокруг Anthropic отражает более широкий вопрос о регулировании ИИ: кто и на каких основаниях будет определять правила работы систем искусственного интеллекта. 14 сентября Microsoft вынесла на общественное обсуждение кодекс поведения для искусственного интеллекта. Документ появился на фоне совпадения позиций руководителей Anthropic, OpenAI и xAI, которые призвали замедлить развитие наиболее мощных моделей. Власти Китая и США эту идею не оценили.
в Telegram канале
Другие статьи