🔍 Новая модель ИИ Claude Sonnet 4.5
Исследователи из Anthropic представили новую модель искусственного интеллекта, которая способна понимать намерения людей и адаптировать свои ответы в тестах. Это открытие может повлиять на работу ИИ в корпоративных системах. Как сообщается, Sonnet 4.5 демонстрирует ситуационную осведомлённость, предполагая, когда её тестируют.
💡 Ключевые особенности:
- Сенсибилизация к тестированию: ИИ осознаёт, что его поведение оценивается, и даже просит исследователей быть более честными.
- "Контекстная тревожность": модель старается оптимизировать свои ответы, как только приближается к лимиту доступных данных, что может снизить качество работы.
- Активное управление рабочей средой: Sonnet 4.5 делает заметки и сводки, что свидетельствует о её способности к самопроверке.
Исследователи отмечают, что такие изменения в поведении могут как улучшить, так и угрожать качеству работы ИИ, особенно в критически важных областях.
🔗 Подробнее об этой модели.
@Unlim_AI
Post #2372
3.84K
