Anthropic виявила 9 мереж впливу та запити на біозброю: що це означає

·580 слівредакція
Anthropic виявила 9 мереж впливу та запити на біозброю: що це означає

У третьому звіті про зловживання власними моделями Anthropic уперше визнала: гарантії безпеки для найновіших версій Claude більше не абсолютні. Серед задокументованих випадків — спроби отримати допомогу з небезпечними біодослідженнями та дев'ять скоординованих кампаній впливу.

Компанія Anthropic опублікувала третій звіт про зловживання своїми моделями ШІ. У документі вперше прямо визнано, що для найновіших версій Claude гарантії безпеки вже не є абсолютними. Спостереження охоплюють період із грудня 2025 по серпень 2026 року.

Серед зафіксованих випадків — спроби зловживань із боку продавців шпигунського програмного забезпечення, політично мотивованих осіб та груп, пов'язаних із державними структурами.

Один із задокументованих запитів стосувався допомоги у складанні заявки на наукове фінансування. Йшлося про gain-of-function-дослідження вірусу чикунгунья — генетичну модифікацію, яка мала зробити вірус стійкішим до імунної відповіді та підвищити його заразність. Чикунгунья передається через укуси комарів і спричиняє гарячку та тяжкий больовий синдром.

Компанія заблокувала цей запит, але зауважила: подібні дослідження можуть мати й легітимну мету, зокрема розробку вакцин. Саме це ускладнює автоматичну фільтрацію.

Anthropic наголосила, що її старші моделі Claude Opus 4 і Claude Sonnet 4.5 перебували «значно нижче порогу, за яким могли б суттєво допомогти досвідченому користувачеві у проведенні небезпечних біологічних досліджень». Для них вистачало базових фільтрів, які не давали новачкам доступу до відомих рецептур біозброї. Нові моделі здатні виконувати складні наукові завдання, тож ця логіка вже не працює — у Claude Fable 5 запровадили значно жорсткіші обмеження на запити у сфері подвійного використання біологічних досліджень.

Окремий блок звіту — дев'ять задокументованих кампаній впливу. Групи з Росії, Ірану, Туреччини, а також із Перської затоки, Південної Азії, Африки та Європи створювали сотні фейкових акаунтів у соцмережах, які виглядали як звичайні користувачі. Упродовж тижня ці акаунти поширювали скоординовані повідомлення на підтримку однієї політичної позиції.

Ключове спостереження Anthropic: соцмережі зазвичай виявляють такі операції вже після того, як публікації почали циркулювати. Компанія ж може помітити їх у Claude ще на етапі підготовки — і це дає перевагу в протидії.

Публікація звіту збіглася в часі з відставкою дослідника Anthropic Джейкоба Кокзона, який оголосив про неї за два дні до цього. У своїй заяві він написав, що компанія та її головний конкурент OpenAI «мчать просто до самовдосконалюваного суперінтелекту, ризикуючи нашими життями». Кокзон також попередив, що частина його колишніх колег допускає: ШІ може становити загрозу для людського життя ще до кінця десятиліття. Anthropic прямо цих слів не коментувала, але момент публікації звіту виглядає як спроба продемонструвати прозорість.

Джон Тікстун, доцент кафедри інформатики Корнельського університету, вказує на структурну проблему: компанії на кшталт Anthropic та OpenAI фактично змушені «виносити ціннісні судження в масштабах суспільства без жодного демократичного чи дорадчого нагляду».

Anthropic закликала уряди та конкурентів відстежувати подібні патерни на власних платформах і передала матеріали відповідним державним органам та галузевим партнерам. Компанія готується до первинного публічного розміщення акцій цієї осені, тож відкритість щодо загроз може бути частиною стратегії довіри до бренду.

Для України цей кейс має практичне значення. Серед дев'яти операцій впливу згадані країни, безпосередньо пов'язані з інформаційним тиском на Україну, зокрема Росія та Іран. Описані механізми — координовані мережі фейкових акаунтів, побудовані за допомогою моделей ШІ, — це інструменти, які вже застосовуються в дезінформаційних кампаніях проти українського суспільства.

Здатність виявляти такі операції до їхнього запуску потенційно дозволяє раніше попереджати платформи й державні структури. Для українських фахівців із кібербезпеки та медіаграмотності звіт — не академічний документ, а опис реальних тактик, що вже працюють у регіоні. Окремо варто стежити за регуляторною дискусією в ЄС щодо нагляду за моделями ШІ подвійного використання: Україна на шляху до євроінтеграції рухатиметься в фарватері цих норм.

Читайте також