Утечка данных Anthropic: разработка новой модели выше класса Opus и акцент на кибербезопасность
Внутренние документы Anthropic раскрыли планы по выпуску новой флагманской ИИ-модели, которая превосходит текущие решения в логике и программировании, но требует крайне осторожного внедрения.

В результате ошибки конфигурации системы управления контентом в компании Anthropic произошла масштабная утечка данных. В открытом доступе оказались почти три тысячи внутренних документов. Главным открытием стали черновики публикаций, описывающих совершенно новую модель искусственного интеллекта, которая должна превзойти текущую флагманскую линейку Opus.
До сих пор архитектура семейства моделей Claude строго делилась на уровни Haiku, Sonnet и Opus, где последний представлял собой наиболее мощное и ресурсоемкое решение. Утекшие документы показывают, что компания готовит продукт принципиально нового класса. В черновиках фигурируют два возможных названия для новинки: Mythos и Capybara. Представители Anthropic уже подтвердили прессе факт тестирования этой системы, назвав ее самым способным решением, которое они когда-либо создавали.
Согласно внутренним тестам, новая модель демонстрирует радикальный скачок в решении задач программирования, академического рассуждения и кибербезопасности по сравнению с версией Claude Opus 4.6. Разработчики утверждают, что система значительно опережает любые другие доступные на рынке большие языковые модели (LLM) в области кибер-возможностей.

Image description
Однако выдающиеся характеристики сопровождаются серьезными техническими и этическими вызовами. В документах прямо указывается, что новая модель крайне дорога в обслуживании для самой компании и будет иметь высокую стоимость использования для конечных клиентов через программный интерфейс (API). В настоящее время инженеры активно работают над повышением эффективности системы перед ее широким релизом.
Особого внимания заслуживает стратегия запуска продукта. Anthropic планирует намеренно замедлить развертывание модели. Первоначальный доступ получит лишь узкая группа доверенных клиентов, задача которых — оценить риски и потенциал применения в сфере информационной безопасности. Руководство компании осознает, что подобные системы могут использоваться для поиска и эксплуатации уязвимостей в программном обеспечении со скоростью, значительно превышающей возможности специалистов по защите.
Индустрия искусственного интеллекта сейчас находится на пороге очередного этапа масштабирования. Параллельно с Anthropic к крупному релизу готовится и OpenAI. По имеющимся данным, их новая модель под кодовым названием Spud уже завершила этап предварительного обучения. Генеральный директор OpenAI Сэм Альтман также обещает существенный скачок в возможностях системы.
Ожидается, что обе компании постараются синхронизировать выпуск своих самых мощных продуктов с подготовкой к первичному публичному размещению акций (IPO), которое может состояться в конце года. Гонка в сфере генеративного ИИ переходит на новый уровень, где фокус смещается с простого наращивания параметров на обеспечение безопасности, контроль над технологиями двойного назначения и поиск экономической целесообразности.
TL;DR
Главное
Anthropic готовит к выпуску новую модель ИИ класса выше Opus, которая требует беспрецедентных мер безопасности из-за высоких возможностей в сфере киберугроз.
Ключевые факты
- /Утечка раскрыла почти 3000 внутренних документов Anthropic из-за ошибки в настройках.
- /Новая модель (кодовые имена Mythos или Capybara) превосходит Claude Opus 4.6.
- /Релиз будет намеренно замедлен для оценки рисков в сфере кибербезопасности.
- /Обе компании (Anthropic и OpenAI) готовят крупные релизы в преддверии возможных IPO.
Инсайт
Гонка ИИ-моделей смещается от быстрого релиза к искусственному замедлению: компании вынуждены тормозить выход продуктов, так как их возможности по взлому систем опережают возможности защиты.


