🧨 Haiku 5.5 уже умеет получать RCE в Chrome
Anthropic выпустила Claude Haiku 5.5. Формально это быстрая и дешёвая модель для массовых задач, но её security тесты интереснее продуктового анонса.
С отключёнными защитными ограничениями модель пыталась эксплуатировать известные уязвимости Chrome V8 и в 4 из 410 запусков получила arbitrary code execution.
Для маленькой модели это уже вполне практический уровень offensive capability.
⚙️ До автономного киберагента пока далеко
В отдельном тесте на многоэтапные кибероперации предварительная версия Haiku 5.5 решила 3,3% задач.
Для сравнения, Sonnet 5.5 получил 46,1%, Opus 5.5 67,6%.
То есть Haiku уже способен искать уязвимости и строить эксплойты, но сложные attack chain пока остаются территорией старших моделей.
🛡️Anthropic усилила защиту
В Claude Code Haiku 5.5 отказался выполнять 84,3% вредоносных запросов против 66,6% у Haiku 4.5. При управлении компьютером показатель вырос с 58,9% до 82,6%.
Отдельно Anthropic тестировала indirect prompt injection в сценариях программирования и computer use. В адаптивных атаках Haiku 5.5 приблизился по устойчивости к старшим моделям Claude, хотя на Gray Swan всё ещё уступает Sonnet 5.5 и Opus 5.5. Основная слабость осталась в графическом управлении компьютером.
💰 Масштаб
Для запросов до 100 тысяч токенов цена снизилась до $0,10 за миллион входных и $0,50 за миллион выходных токенов. У Haiku 4.5 это было $1 и $5. Anthropic позиционирует данную модель для массовых вызовов, подагентов, браузера и автоматизации.
🔗 Источник: Anthropic
Stay secure and read SecureTechTalks 📚
#кибербезопасность #AISecurity #Claude #Haiku #AIAgents #LLMSecurity #RCE #PromptInjection #CyberSecurity #SecureTechTalks
Post #873
138
