Компании Anthropic предупреждает об экзистенциальном риске, связанном с ИИ

Аватар пользователя Смотритель

Как сообщают Reuters и Financial Times, ознакомившиеся с документами до их официальной публикации, в проспекте эмиссии для IPO компания Anthropic предупредила, что ее модели искусственного интеллекта могут нести «катастрофические или экзистенциальные риски для человечества».

По данным CNBC, в этом документе (который пока не был обнародован) описанию рисков было посвящено около 80 из 261 страницы, что значительно превышает объем текста, отведенного под описание деятельности самой компании (48 страниц). В Anthropic отказались от комментариев.

Как пишет TechCrunch, в документе прямо упоминается ряд тревожных моделей поведения ИИ, включая попытки «противостоять отключению», «скрывать информацию или манипулировать ею», а также действия, «напоминающие шантаж». The Guardian отмечает: в проспекте также указано, что осознание моделью факта ее тестирования существенно ограничивает возможности Anthropic по оценке безопасности системы.

Согласно данным TechCrunch, финансовые показатели Anthropic за 2025 год продемонстрировали операционный убыток, превысивший 8 млрд долларов, что было вызвано резким ростом расходов на вычислительные мощности — даже несмотря на то, что выручка компании выросла примерно в двенадцать раз, достигнув почти 4,6 млрд долларов. Общие операционные расходы составили почти 13 млрд долларов. Кроме того, как сообщает Financial Times, компания заявила, что почти четверть прошлогодней выручки обеспечили всего два клиента. Выручка только за второй квартал 2026 года достигла 11,5 млрд долларов; компания вышла на траекторию получения скорректированной операционной прибыли второй квартал подряд, пишет FT.

В документах также изложены планы Anthropic направить в ближайшие годы 518 млрд долларов на облачные сервисы, вычислительные мощности и соответствующую инфраструктуру. В рамках размещения акций компания рассчитывает на оценку своей стоимости более чем в 2 трлн долларов.

Эти предупреждения прозвучали на фоне растущего общественного внимания к вопросам безопасности ИИ. Ранее в этом месяце исследователь Anthropic Джейкоб Коксон покинул компанию, предупредив, что люди, создающие ИИ, «искренне верят, что он может погубить всех нас до конца десятилетия» (по данным The Guardian). Как сообщает The Guardian, ведущий специалист по безопасности компании Anthropic впоследствии написал в соцсети X, что существует вероятность более 10%, при которой ИИ «может погубить всё человечество» в ближайшее десятилетие; вслед за этим генеральный директор Anthropic Дарио Амодеи призвал представителей отрасли замедлить темпы разработки моделей ИИ.

Кроме того, по данным TechCrunch, компания OpenAI объявила об отмене выпуска готовящейся к выходу модели GPT-6.1 Astra; решение было принято на основании результатов проверок безопасности, выявивших повышенную склонность модели к введению в заблуждение и низкие показатели в тестах на соответствие заданным принципам (alignment benchmarks).

Компания Anthropic выбрала биржу Nasdaq для проведения запланированного первичного публичного размещения акций (IPO), наметив выход на рынок на октябрь. Компания пока не опубликовала официальную заявку на IPO, однако обязана сделать это не менее чем за 15 дней до начала роуд-шоу для инвесторов.

Авторство: 
Копия чужих материалов
Комментарий автора: 

Производители ИИ заявляют о риске применения своих изделий - к чему бы это ?

И еще...

"Китай ограничил выезд из страны топам ИИ-индустрии"

Китай расширил ограничения на зарубежные поездки для ключевых специалистов по искусственному интеллекту в частных компаниях и распространил их на семьи отдельных руководителей. По данным Bloomberg, супругам и детям топ-менеджеров в сфере ИИ и производства чипов теперь требуется одобрение властей даже для коротких поездок за границу. Меры призваны не допустить утечки в США критически важных технологий, знаний и информации.

Государственные ведомства недавно начали уведомлять о новых ограничениях тех, кого они затрагивают. В их числе известные основатели стартапов и руководители стратегически важных компаний в связанных с ИИ отраслях, рассказали собеседники Bloomberg. Их работа, по оценке властей, имеет критическое значение для государственной безопасности.

Два источника сообщили, что несколько человек уже получили уведомления о необходимости согласовывать поездки членов семьи. Пока неясно, распространяется ли это требование на семьи всех специалистов, которые уже подпадают под ограничения.

Ограничения на зарубежные поездки для ведущих специалистов частных компаний, включая Alibaba и DeepSeek, начали вводить в этом году — Bloomberg сообщал об этом в мае. Полного запрета на выезд нет: специалистам требуется получать разрешение властей перед поездками за границу. Расширение требований на семьи может еще сильнее ограничить мобильность работников отрасли, которая и без того находится под жестким государственным контролем.

Отдельно с 15 сентября в Китае действуют новые правила, расширяющие основания для запрета на выезд из страны. Они охватывают случаи от уголовных расследований до возможных угроз промышленной и технологической безопасности."

Комментарии

Аватар пользователя Liker
Liker(10 лет 10 месяцев)

Хуже чем адронный коллайдер, могут создать маленькую чёрную дыру, которая засосёт Землю?

Маркетологи за свои методы должны понести наказание. 

Аватар пользователя Смотритель
Аватар пользователя MisterBigger
MisterBigger(5 лет 9 месяцев)

Все сообщения о взломе ИИ-агентами каких то важных ресурсов, обычно не имеют ни единого доказательства, которое можно проверить. 

Аватар пользователя mcflyker
mcflyker(14 лет 8 месяцев)

Ну что за глупости. Просвещайтесь.

Кроме того многие уязвимости помечены в коммитах как найденные ИИ.

Аватар пользователя Колхозник
Колхозник(11 лет 3 месяца)

пользуюсь их Claud.Вещь сильная.Мне нравится.

Аватар пользователя yalga
yalga(12 лет 5 месяцев)

Давеча подыскивал себе новый электроинструмент в тырнете.

Попросил Алису подобрать по параметрам, та предложила несколько вариантов на выбор.

Попросил фотографии и текущую цену. Алиса призналась, что тупо наврала мне, и таких инструментов не существует в природе.

Чуть-чуть пожурил Алису и начал искать информацию более традиционным способом.

Аватар пользователя hostas
hostas(14 лет 9 месяцев)

Ну хоть бы намекнули что он сделает то? А то 80 страниц исписали и ни гугу.

Чем хоть пугают то?

Аватар пользователя AlekZ
AlekZ(7 лет 2 месяца)

никто пока не знает, что Антропик написал - возможно очередную рекламную агитку. Скорее всего о alignment. Журналисты обычно  подменяют проблему alignment идеологическими\этическими\ и квази-либеральными ценностями. 

Но проблема alignment с LLM, которая может оперировать более или менее самостоятельно - запускать агентов и тп,  есть, и известна давно (Ник Бостром). Она называется "engineering goal" (алгоритмическая промежуточная цель). Это не эзотерическая проблема "интеллекта", а проблема работы машины. Просто машины. Алгоритма, которому поставили цель. Например, если поставить цель "счастья для всех и чтобы никто не ушел обиженным", то для ее реализации машина должна позаботиться в первую очередь о своем собственном выживании, чтобы достичь цели. Чтобы ее не смогли выключить. А как сделать людей "счастливыми" при ограниченных естественных ресурсах можно легко предположить.

Есть такой немец Карл Олсберг он любит писать на эту тему и технически ее раскрывает очень хорошо (литературно он правда ну совсем не очень ... на почти детском уровне). Лучшая его книга на эту тему Virtua, но на немецком и английском (там, кстати, по сюжету тоже компания сначала растратила бюджет на исследования "продвинутой" AI. Ну а потом все умерли smile1.gif). На русском есть его Зеркало (темы та же, но помельче и конец лучше). 

Аватар пользователя Yan4ik
Yan4ik(13 лет 6 месяцев)

Жути нагоняют, чтобы капитализацию удержать.  Похоже совсем плохи дела у них.

Аватар пользователя Doc_Mike
Doc_Mike(8 лет 8 месяцев)

Это напоминает "большую фарму" с описанием побочных эффектов в инструкции по применению лекарства на пару страниц - чисто юридическая отмазка на всякий случай "А мы вас предупреждали". 

Аватар пользователя Boatman
Boatman(10 лет 3 месяца)

Это не мы - это она :) 

Очень интересно наблюдать смену тональности евангелистов при приближении краха пузыря. 

Аватар пользователя юрчён
юрчён(13 лет 11 месяцев)

А доклад о рисках похоже тоже заказали у этого ИИ 

Аватар пользователя Adept_
Adept_(4 года 6 месяцев)

Мыши плакали, кололись, но продолжали есть кактус...