Claude мыслит? Anthropic нашла «разум» у ИИ
Anthropic, создатели модели Claude, впервые обнаружили у нее внутренние "пространства мышления", где ИИ обрабатывает концепции. Это подтверждает, что большие языковые модели не просто предсказывают слова, но и формируют внутренние представления.
Долгое время LLM были "черными ящиками", их логика работы оставалась непрозрачной даже для инженеров. Теперь, благодаря детальному анализу, ученые из Anthropic увидели, как Claude строит эти скрытые слои концепций, которые затем используются для генерации ответов. Иронично, что мы создаем интеллект, который потом сами с трудом расшифровываем.
Понимание этих внутренних процессов открывает путь к созданию не только более мощных, но и предсказуемых, а значит, более безопасных ИИ.
Post #1631
44
