Anthropic: AI-модели уже помогают в targeting и задачах по оружию
Frontier Red Team увидела, что модели в симуляциях приближаются к экспертной работе в разведке и conventional weapons workflows.
Frontier Red Team Anthropic заявила, что AI-модели становятся достаточно сильными, чтобы помогать не только в cyber- и bio-risk сценариях, но и в tactical intelligence targeting и задачах по conventional weapons. Новые оценки проверяли, могут ли модели помогать в рабочих процессах вроде сопоставления личности по фрагментарным данным или улучшения дронов и других обычных вооружений.
По словам Anthropic, часть таких задач раньше требовала редких и хорошо подготовленных специалистов, но модели уже способны выполнять элементы этой работы в симуляциях. Компания связывает выводы с отдельным threat intelligence report, где описывались реальные попытки misuse Claude для surveillance и weapons-related активности.
Эти оценки синтетические и не показывают, что модель автономно проводит военную операцию. Но Anthropic считает важным другой сигнал: модели снижают стоимость и порог доступа. Если targeting-анализ или weapons engineering становятся проще, небольшие группы могут пробовать процессы, которые раньше были недоступны, а крупные игроки смогут масштабировать работу на большем объеме данных.
Anthropic также тестировала open-weight модели китайских разработчиков. Они отставали от frontier-моделей, но все равно показывали тревожные способности в части targeting и weapons tasks. Компания считает, что это усиливает аргумент за on-platform classifiers, release safeguards и более внимательные проверки military-relevant capabilities перед широким выпуском сильных моделей.