Anthropic звітує: від біоризиків до мереж впливу — що показав третій звіт компанії

Anthropic оприлюднила третій звіт про зловживання своїми моделями. У ньому — і спроба отримати допомогу з небезпечним біодослідженням, і дев'ять скоординованих кампаній впливу, зокрема з Росії та Ірану.
Компанія Anthropic представила третій за ліком звіт про те, як її моделі намагалися використати з небезпечною метою. Вперше вона відкрито визнала: для найновіших версій Claude гарантії безпеки вже не можна вважати абсолютними. Дослідники фіксували такі спроби в проміжку з грудня 2025-го до серпня 2026 року, і серед тих, хто їх робив, — продавці шпигунського програмного забезпечення, політично вмотивовані особи та групи, пов'язані з державними структурами.
Один із задокументованих епізодів стосується біології. У Claude просили допомогти підготувати заявку на наукове фінансування для gain-of-function-дослідження вірусу чикунгунья — генетичної модифікації, яка мала зробити вірус стійкішим до імунної відповіді та підвищити його заразність. Чикунгунья поширюється через укуси комарів і викликає гарячку та сильний біль. Компанія заблокувала запит, але зауважила: у подібних досліджень буває й легітимна мета, як-от розробка вакцин, і саме це ускладнює автоматичну фільтрацію.
За оцінкою Anthropic, її старші моделі Claude Opus 4 і Claude Sonnet 4.5 перебували «значно нижче порогу, за яким могли б суттєво допомогти досвідченому користувачеві у проведенні небезпечних біологічних досліджень». Для них вистачало базових фільтрів, які не давали новачкам доступу до відомих рецептур біозброї. Інша річ — новіші моделі, здатні виконувати складні наукові завдання: там стара логіка не працює. Тому в Claude Fable 5 запровадили значно жорсткіші обмеження на запити у сфері подвійного використання біологічних досліджень.
Друга частина звіту — про інформаційний вплив. Задокументовано дев'ять кампаній, які ведуть групи з Росії, Ірану, Туреччини, а також із Перської затоки, Південної Азії, Африки та Європи. Вони створювали сотні фейкових акаунтів у соцмережах, що виглядали як звичайні користувачі, і протягом тижня розповсюджували скоординовані повідомлення на підтримку однієї політичної позиції. Ключове спостереження: платформи зазвичай виявляють такі операції вже після того, як публікації почали циркулювати, тоді як компанія може помітити їх у Claude ще на етапі підготовки — і це дає перевагу в протидії.
Звіт вийшов за два дні після того, як дослідник Anthropic Джейкоб Кокзон оголосив про відставку. У заяві він написав, що компанія та її головний конкурент OpenAI «мчать просто до самовдосконалюваного суперінтелекту, ризикуючи нашими життями». Кокзон також попередив, що частина його колишніх колег вважає: ШІ може становити загрозу для людського життя ще до кінця десятиліття. Прямого коментаря від Anthropic на ці слова не було, хоча публікація звіту саме в цей момент виглядає як спроба продемонструвати прозорість.
Джон Тікстун, доцент кафедри інформатики Корнельського університету, вказує на структурну проблему: такі компанії, як Anthropic та OpenAI, фактично змушені «виносити ціннісні судження в масштабах суспільства без жодного демократичного чи дорадчого нагляду».
Anthropic закликала уряди та конкурентів відстежувати подібні патерни на власних платформах і передала матеріали відповідним державним органам та галузевим партнерам. Компанія готується до первинного публічного розміщення акцій цієї осені, і відкритість щодо загроз може бути частиною стратегії довіри до бренду.
Для України цей звіт має практичне значення. Серед дев'яти задокументованих операцій згадані країни, безпосередньо причетні до інформаційного тиску на українське суспільство, зокрема Росія та Іран. Описані механізми — координовані мережі фейкових акаунтів, побудовані за допомогою моделей ШІ, — це саме ті інструменти, що вже застосовуються в дезінформаційних кампаніях проти України. Здатність виявляти такі операції до запуску потенційно дозволяє раніше попереджати платформи й державні структури.
Для українських фахівців із кібербезпеки та медіаграмотності це не академічний документ, а опис реальних тактик, які вже працюють у регіоні. Окремо варто стежити за регуляторною дискусією в ЄС щодо нагляду за моделями ШІ подвійного використання: Україна на шляху до євроінтеграції рухатиметься в фарватері цих норм.
Читайте також
Ще в розділі «Фейки»
- Фейк про "мощі Коновальця" у Львові: як працює провокація
- Фейк про мінування туш тварин на Херсонщині: хто і навіщо його поширює
- Шахрай у Харкові збирав гроші на ЗСУ: як працювала схема
- Як Росія використовує дезінформацію в Колумбії проти України
- Фейк від РФ: українські військові нібито погрожують Ірану




