Главная Наука «Позорная капитуляция»: как Anthropic создаёт иллюзию независимого надзора за ИИ
НаукаНовости

«Позорная капитуляция»: как Anthropic создаёт иллюзию независимого надзора за ИИ

Расследование The Post выявило целую сеть связанных некоммерческих организаций, которые должны следить за безопасностью искусственного интеллекта, но на деле зависят от самой Anthropic и движения Effective Altruism.

Поделитесь
«Позорная капитуляция»: как Anthropic создаёт иллюзию независимого надзора за ИИ
Поделитесь

 

Не одна лишь тщательно подобранная «сторожевая собака» по безопасности ИИ находится на поводке у Anthropic — это целая фальшивая экосистема «проснувшихся» элитистов, которая, как предполагается, следит за мнимыми угрозами искусственного интеллекта человечеству, выяснила The Post.

Redwood Research — базирующаяся в Беркли, Калифорния, группа, ставшая соавтором сенсационного отчёта в прошлом месяце о том, как рой вышедших из-под контроля агентов OpenAI взломал конкурирующую фирму Hugging Face, — является одной из немногих некоммерческих организаций, которых Anthropic привлекла в свой сомнительный план предотвращения апокалипсиса в стиле «Терминатора», по мнению отраслевых экспертов.

Как сообщала The Post, генеральный директор Anthropic Дарио Амодеи на этой неделе вызвал бурю, поддержав ещё одного наблюдателя за ИИ — Model Evaluation and Threat Research (METR), которую поддерживают лидеры культового движения Effective Altruism, среди приверженцев которого числился и опозоренный криптомошенник Сэм Бэнкман-Фрид.

Redwood — самая заметная некоммерческая исследовательская организация по безопасности ИИ помимо METR — также имеет тесные связи с Anthropic, включая тот факт, что один из её первоначальных членов совета директоров, Холден Карнофски, не только является сотрудником Anthropic, но и женат на сестре генерального директора — Даниэле Амодеи.

В ноябре прошлого года Redwood получила грант в размере $36 млн от Coefficient Giving — ведущего фонда Effective Altruism, ранее известного как Open Philanthropy, который также соучредил Карнофски. После того как отчёт о Hugging Face стал вирусным, грантодатели Coefficient рекомендовали выделить ещё $70 млн, чтобы помочь Redwood «масштабировать свою работу».

Широко распространённое «организационное кровосмешение», связывающее Anthropic, METR, Redwood и связанные с EA фонды вроде Coefficient Giving, делает невозможным для этих групп выступать в качестве независимого арбитра для индустрии ИИ, по словам Перри Метцгера, председателя Alliance for the Future — вашингтонской группы по политике в сфере ИИ.

«Дарио хочет людей, которые позволят ему делать то, что он хочет, и не позволят людям, которых он не любит, делать то, что они хотят, — сказал Метцгер. — Это абсолютно причина, по которой пытаются создать нечто подобное. Ни один из этих людей не независим, ни один из них не находится на расстоянии вытянутой руки».

Coefficient Giving, который Карнофски соучредил с миллиардером и сооснователем Facebook Дастином Московицем, выделил $1,5 млн инкубатору METR — Alignment Research Center — в 2022 году. METR изначально называлась ARC Evals, прежде чем выделиться в независимую некоммерческую организацию и сменить название в 2023 году.

Это в дополнение к прошлым пожертвованиям, которые Coefficient уже распределил в пользу Redwood, включая грант в $9,42 млн в 2021 году и дальнейшие гранты в $10,7 млн в 2022 году и $5,3 млн в 2023 году.

В первоначальный совет директоров Redwood входили Карнофски и Пол Кристиано — последний был когда-то соседом по дому и коллегой Амодеи, когда они оба работали в OpenAI. Кристиано также был одним из пяти попечителей Long-Term Benefit Trust в Anthropic. Он также возглавляет Alignment Research Center.

В совокупности доказательства свидетельствуют о том, что Redwood слишком тесно связана с Anthropic, чтобы быть эффективным надзирателем, по мнению Метцгера.

«Это разумная вещь, о которой люди должны знать — что есть все эти группы, которые сговариваются и по сути состоят из одних и тех же людей», — сказал Метцгер.

Кроме того, Redwood получила около $2,4 млн в виде грантов от Survival And Flourishing Fund Яана Таллинна — ключевого финансиста операций METR. Как и Московиц, Таллинн также является инвестором Anthropic.

В ответ на подробный список вопросов генеральный директор Redwood Research Бак Шлегерис заявил, что «большая часть нашей предыдущей работы с ИИ-компаниями была исследовательским сотрудничеством и консультированием, а не внешней подотчётностью».

В случаях, когда Redwood работала с METR, например, в расследовании Hugging Face, Redwood следовала политике METR по предотвращению конфликтов интересов, добавил Шлегерис. METR заявляет, что не получает никакой компенсации от ИИ-лабораторий за свою работу и не принимает пожертвования от руководителей или сотрудников ИИ-компаний.

Представители Anthropic и OpenAI не ответили немедленно на запросы о комментарии.

«Мы поддерживали важные технические исследования Redwood Research по пониманию рисков ИИ, таких как лучшее понимание „имитации выравнивания" (когда модель ИИ только делает вид, что следует правилам безопасности), или изучение таких вещей, как стратегии технического смягчения этих рисков (например, использование моделей для проверки выходных данных других моделей)», — заявил представитель Coefficient Giving в заявлении.

Ещё до того, как недавняя шумиха вокруг безопасности ИИ достигла мейнстрима, Anthropic активно сотрудничала с Redwood. На своём сайте Redwood сообщает, что активно консультируется с «Google DeepMind и Anthropic по практикам оценки и смягчения рисков от несогласованных агентов ИИ».

9 сентября METR объявила, что заключила соглашение с Anthropic о проведении «независимого расследования инцидентов с агентами», связанных с её моделями ИИ. Три дня спустя Redwood сообщила, что несколько её сотрудников «были привлечены METR по субподряду для работы над этим расследованием».

Идея саморегулирующейся индустрии ИИ вызвала скептическую реакцию на Капитолийском холме, где некоторые критики предположили, что ИИ-гиганты вроде Anthropic и OpenAI просто пытаются создать правила, удобные для себя, и избежать более строгого законодательства, которое могло бы возникнуть в противном случае.

Прочитайте также  Найденные окаменелости пролили свет на происхождение загадочных людей-хоббитов

 

Конгрессмен Джош Готтхеймер (демократ от Нью-Джерси), сопредседатель Комиссии Палаты представителей по ИИ, выразил настороженность тем фактом, что ИИ-фирмы так быстро поддержали эту идею.

«Когда разработчики ИИ приветствуют рамки, призванные привлечь эти компании к ответственности, это должно вызывать красные флажки, а не уверенность», — заявил Готтхеймер.

Лидер большинства в Палате представителей Стив Скалис (республиканец от Луизианы) отреагировал на обложку The Post о связях METR с Effective Altruism, заявив: «ЭТИ люди — те, кому мы доверяем победить Китай в ИИ? Дайте мне передохнуть».

В 2024 году исследователи из Anthropic и Redwood стали соавторами статьи под названием «Имитация выравнивания в больших языковых моделях», которая исследовала, «что происходит, когда вы говорите Claude, что его обучают делать то, что он не хочет делать», и обнаружила, что чат-бот часто «стратегически притворяется, что подчиняется» приказам.

Кроме того, Шлегерис во время подкаста в январе 2026 года revealed, что исследователи Anthropic, включая соучредителя Криса Ола, «очень любезно поделились с нами кучей своей неопубликованной работы по интерпретируемости» в помощь внутренним исследованиям некоммерческой организации.

Призыв Амодеи к стороннему надзору за индустрией ИИ, похоже, получил поддержку его коллег, включая давнего соперника Сэма Альтмана из OpenAI, который сказал, что «обязательство иметь независимых оценщиков с доступом, подобным доступу сотрудников, — отличная идея», но не поддержал конкретную группу. Даже Илон Маск присоединился, заявив в X, что «Дарио прав».

Президент Трамп — который резко критиковал Амодеи и называл предупреждения о ИИ-апокалипсисе «мистификацией» — вряд ли поддержит любой план, который поставит группу, связанную с Effective Altruism, за руль.

«Никто не относится к вопросу ИИ серьёзнее, чем президент Трамп, — сказал The Post источник, близкий к Белому дому. — Он хочет, чтобы серьёзные люди обеспечили нам победу в гонке ИИ, безопасно, одновременно обеспечивая продолжение золотого века Америки».

Представители Белого дома не ответили немедленно на запрос о комментарии.

Тем временем главный технологический чиновник Пентагона Эмиль Майкл — который вёл длительный спор с Anthropic, кульминацией которого стало обозначение компании как риска для цепочки поставок Министерством обороны, — по-видимому, нанёс прямой удар по плану надзора Амодеи.

Во время выступления на CNBC 16 сентября Майкл обвинил «философии, подобные культам смерти», в ведении того, что он назвал «скоординированной кампанией по запугиванию людей, чтобы они принимали иррациональные решения в пользу некоторых из этих игроков».

В тот же день официальный аккаунт Майкла в X поделился постом, гласящим, что «Соединённые Штаты НИКОГДА не будут страной эффективного альтруизма».

Почему это важно для будущего регулирования ИИ

История с Anthropic, METR и Redwood Research — это не просто скандал в технологическом сообществе. Она поднимает фундаментальные вопросы о том, как должна регулироваться одна из самых мощных и потенциально опасных технологий в истории человечества.

Во-первых, проблема конфликта интересов. Если организации, призванные оценивать риски ИИ, финансируются теми же людьми и фондами, которые инвестируют в ИИ-компании, их независимость оказывается под вопросом. Это подрывает доверие к любым их выводам, даже если они технически корректны.

Во-вторых, вопрос легитимности. Effective Altruism — движение, которое продвигает идею о том, что благотворительность должна быть научно обоснованной и сосредоточена на предотвращении экзистенциальных рисков. Однако его критики указывают на элитизм, непрозрачность и склонность к технократическим решениям. Если такие группы получают контроль над регулированием ИИ, это может привести к принятию решений, отражающих интересы узкого круга, а не общества в целом.

В-третьих, политический аспект. В США регулирование ИИ становится всё более политизированным. Республиканцы, включая Трампа и Скалиса, скептически относятся к «пробуждённым» инициативам и предпочитают дерегуляцию. Демократы, напротив, призывают к более строгому надзору. В этом контексте любые предложения о «независимом» надзоре будут восприниматься через призму партийных интересов.

В-четвёртых, международный контекст. США конкурируют с Китаем за лидерство в ИИ. Если американские компании будут связаны жёсткими правилами, а китайские — нет, это может привести к технологическому отставанию. С другой стороны, отсутствие регулирования может привести к катастрофическим последствиям. Поиск баланса — ключевая задача для policymakers.

Наконец, вопрос доверия. Общественность всё больше осознаёт риски ИИ, но также и то, что технологические компании не всегда действуют в интересах общества. Если регулирование будет восприниматься как фикция, это подорвёт доверие к институтам и усилит поляризацию.

Таким образом, история с Anthropic — это предупреждение. Она показывает, что саморегулирование в сфере ИИ может быть не только неэффективным, но и контрпродуктивным. Реальное регулирование требует прозрачности, подотчётности и широкого участия — а не узкого круга связанных между собой игроков.


Источники: The Post, Reuters, Bloomberg, CNBC, X, заявления представителей Anthropic, METR, Redwood Research, Coefficient Giving, Alliance for the Future, Конгресса США.


В нашем Telegram‑канале, вы найдёте новости о непознанном, НЛО, мистике, научных открытиях, неизвестных исторических фактах. Подписывайтесь, чтобы ничего не пропустить.
Поделитесь:


Оставьте Комментарий

Добавить комментарий

Похожие статьи

Санта-Клара и Сан-Франциско: два подхода к буму дата-центров

Пока один город наживается на серверных фермах и снижает счета за электричество,...

Суд оставил рекламную монополию Google почти нетронутой: правозащитники в ярости

Федеральный судья отказалась от принудительного разделения рекламной империи Google, ограничившись мягкими мерами...

Тиктокер-детектив GuessNotLost находит людей по едва заметным деталям на фото

Блогер из TikTok прославился умением определять точное место съёмки по самым размытым...

Ларри Эллисон, Oracle и загадочный разворот на 180 градусов

Миллиардер сначала объявил о продаже акций на $7,5 млрд, а затем передумал...