Claude Fable 5 превзошёл Opus 4.8 в тесте уязвимостей: 88,4% vs 8,8%
Что произошло
В system card модели Claude Fable 5 Anthropic указали, что при тесте на эксплуатацию уязвимостей Mythos 5 модель собрала рабочий эксплойт в 88,4 % попыток, тогда как Opus 4.8 достиг лишь 8,8 %. Кроме того, Fable 5 лидирует в закрытом Legal Agent Benchmark с 13,3 % полностью решённых задач.
Детали
- Эксплуатация уязвимостей Mythos 5: 88,4 % успеха vs 8,8 % у Opus 4.8.
- Первое место в закрытом Legal Agent Benchmark от Harvey – 13,3 % полностью решённых задач.
- Двойная проверка диалогов: внутренний probe + отдельный классификатор.
- Модель отказалась от участия в страховом мошенничестве под давлением.
Что это значит
Эти результаты показывают, что новые модели Anthropic становятся более надёжными в безопасных сценариях и способны к сложному стратегическому поведению, что важно при развертывании в продуктивных системах.
Двойная проверка диалогов (probe + классификатор) в Claude Fable 5 обеспечивает более надёжную киберзащиту и может быть адаптирована в ваших LLM‑проектах.