toolcall.
Регулирование13 сент. 2026 г., 08:32 UTC

Anthropic: AI-модели уже помогают в targeting и задачах по оружию

Frontier Red Team увидела, что модели в симуляциях приближаются к экспертной работе в разведке и conventional weapons workflows.

Frontier Red Team Anthropic заявила, что AI-модели становятся достаточно сильными, чтобы помогать не только в cyber- и bio-risk сценариях, но и в tactical intelligence targeting и задачах по conventional weapons. Новые оценки проверяли, могут ли модели помогать в рабочих процессах вроде сопоставления личности по фрагментарным данным или улучшения дронов и других обычных вооружений.

По словам Anthropic, часть таких задач раньше требовала редких и хорошо подготовленных специалистов, но модели уже способны выполнять элементы этой работы в симуляциях. Компания связывает выводы с отдельным threat intelligence report, где описывались реальные попытки misuse Claude для surveillance и weapons-related активности.

Эти оценки синтетические и не показывают, что модель автономно проводит военную операцию. Но Anthropic считает важным другой сигнал: модели снижают стоимость и порог доступа. Если targeting-анализ или weapons engineering становятся проще, небольшие группы могут пробовать процессы, которые раньше были недоступны, а крупные игроки смогут масштабировать работу на большем объеме данных.

Anthropic также тестировала open-weight модели китайских разработчиков. Они отставали от frontier-моделей, но все равно показывали тревожные способности в части targeting и weapons tasks. Компания считает, что это усиливает аргумент за on-platform classifiers, release safeguards и более внимательные проверки military-relevant capabilities перед широким выпуском сильных моделей.

Источники

Упоминаются

ai-safetyanthropicfrontier-modelsnational-securitysecurity