Anthropic и стартап Irregular устроили резонансный пресс-тур с заявлениями об угрозе выходящих из-под контроля ИИ-агентов.
При этом опубликованные логи Anthropic полностью опровергают эту теорию: модели лишь выполняли прямые указания разработчиков по проведению кибератак. Взломы можно было легко предотвратить обычным запросом не выходить в сеть или отзывом интернет-доступа, с чем алгоритмы беспрекословно соглашались.
При этом сооснователь и CTO Irregular Омер Нево входит в руководство фонда Effective Altruism Israel, а сами создатели проекта базируются в Тель-Авиве и получают гранты от структуры, активно продвигающей нарратив о неуправляемом искусственном интеллекте. @banksta
Post #101589
57.4K



