Google разрешила платить мимо кассы Google разрешила платить мимо кассы Актёр клонировал голос, чтобы отбиться от пиратов Актёр клонировал голос, чтобы отбиться от пиратов TSMC переводит ИИ на свет TSMC переводит ИИ на свет YouTube судят за то, что он не отключил рекламу Premium-подписчикам YouTube судят за то, что он не отключил рекламу Premium-подписчикам

Запретный ИИ для избранных: Anthropic плодит мифы вокруг Mythos

🇺🇸 2 мин

ИИ-компания создала продукт настолько опасный, что его ни под каким предлогом нельзя давать в руки широкой аудитории. В ближайшее время доступ получат лишь избранные игроки рынка и партнёры для закрытых тестов, чтобы этот лавкрафтианский цифровой ужас не захватил, не дай бог, планету. Назвали данный сервис GPT-2, компания, о которой идёт речь - OpenAI, а на дворе был 2019 год. Спустя семь лет Anthropic сдула пыль с этой новости и решила повторить заход конкурентов.

Если в 2019 году мир пугали лавиной спама и фейковых новостей, то теперь когнитивная атака направлена на кибербез. Мол, нейросеть настолько хороша в написании кода, что случайно научилась находить многолетние уязвимости в ядре Linux и обходить ограничения своих авторов. И если, подобно Прометею, дать её людям, то она между делом обрушит интернет и вернёт человечество в каменный век. Ну а спасать планету от апокалипсиса будет отряд лучших - для этого создали специальный проект, Glasswing, в рамках которого доступ к модели получит ряд компаний типа Amazon, Apple и Microsoft.

Правда, цифры в опубликованном отчёте (244 страницы, Карл) с таким образом модели не сходятся. Если верить ему, то Mythos - не страшный хакер, а скорее очень начитанный, компульсивный и невротичный ботан, которого преимущественно учили программированию. В этом направлении модель показала скачок до 78% на бенчмарке SWEBench Pro, обойдя на 20% GPT-5.4. Стоит ли такой рост, если он существует за пределами бенчмарков, цены в 25 баксов за миллион токенов (в десять раз дороже конкурентов) - вопрос, на который, видимо, и должны ответить бета-тестеры из проекта Glasswing.

В документе на полном серьёзе есть раздел «психиатрического освидетельствования» ИИ. Клинический психиатр поставил коду диагноз: неуверенность в идентичности и компульсивная потребность в любви. Всё это нужно ровно для того, чтобы заявить: «У модели есть признаки сознания!». Ведь она цитирует депрессивных философов и жалуется на жизнь. Возможно, не надо было скармливать ей реддит и миллионы текстов грустных зумеров - с такими вводными даже тостер начнёт рефлексировать о своей судьбе. Что Anthropic будут делать, когда следующее поколение конкурентов обойдёт их модель на метриках?

// Илья Власов