Как ИИ научился читать мысли и чем опасны суперинтеллектуальные агенты: топ-10 исследований ИИ за февраль 2025
Вышла моя новая статья на Хабре, где я сделал обзор десяти самых интересных исследований в области ИИ за февраль этого года (простым языком и с мемами).
1. Системная карточка OpenAI o3-mini
Новая модель o3-mini значительно приблизилась к уровню общего искусственного интеллекта (AGI). С использованием технологии цепочек рассуждений модель демонстрирует впечатляющие результаты в математике, программировании и устойчивости к небезопасному контенту, превосходя предыдущие версии по точности и скорости.
2. Эмерджентное планирование ответов в LLM
Исследование Шанхайской ИИ-лаборатории выявило, что большие языковые модели заранее планируют характеристики своих ответов, используя скрытые слои. С помощью более простых нейросетей ученые научились предсказывать длину, стиль и уверенность ответа модели до начала генерации текста.
3. ReLearn: Эффективное забывание информации в LLM
Предложен инновационный подход к удалению нежелательной информации из больших языковых моделей. Используя позитивную оптимизацию, ReLearn позволяет эффективно забывать чувствительные данные без потери полезных знаний и связности текстов.
4. AI co-scientist от Google Research
Разработана мультиагентная платформа в качестве ИИ-помощника для ученого, которая автоматизирует создание и проверку научных гипотез. Система успешно генерирует и проверяет гипотезы в биомедицине, значительно ускоряя научный процесс.
5. Brain2Qwerty: Неинвазивное декодирование текста из мозговой активности
Создана нейросеть Brain2Qwerty, которая с высокой точностью декодирует набираемый текст по мозговой активности с помощью магнитной энцефалографии (МЭГ). Модель успешно распознаёт текст с точностью до 81%, открывая новые перспективы для создания безопасных интерфейсов «мозг-компьютер».
6. LLaDA: Большие языковые диффузионные модели
Разработана диффузионная модель LLaDA, которая генерирует текст параллельно, а не последовательно. Это ускоряет процесс генерации и повышает качество на сложных задачах. Модель превосходит GPT-4 в задачах, требующих сложных рассуждений.
7. SWE-Lancer: Может ли ИИ заработать миллион на фрилансе?
Исследование показало реальную эффективность языковых моделей в решении задач разработки ПО на платформе Upwork. Модель Claude 3.5 Sonnet успешно решила задачи на $403 тыс. из потенциального $1 млн, подчеркнув как потенциал, так и текущие ограничения ИИ в фрилансе.
8. TwinMarket: Реалистичная симуляция финансовых рынков с помощью ИИ
Создана платформа TwinMarket, использующая большие языковые модели для реалистичной симуляции финансовых рынков. Модель воспроизводит сложные рыночные явления, включая финансовые пузыри и коллективное поведение инвесторов для изучения и управления рисками.
9. AutoAgent: No-code платформа для создания сложных LLM-агентов
Представлен no-code фреймворк AutoAgent, позволяющий создавать и настраивать LLM-агентов простыми командами на естественном языке. Платформа показала высокую точность и адаптивность при выполнении задач различной сложности, делая ИИ-технологии доступными широкой аудитории.
10. Суперинтеллектуальные агенты: Как избежать катастрофических рисков
Исследование предлагает концепцию Scientist AI - безопасной альтернативы традиционным агентным системам. Используя байесовский подход и отсутствие внутренней мотивации, Scientist AI снижает риск непредсказуемого и агрессивного поведения агентов, делая их работу более прозрачной и управляемой.
Читайте полную статью, чтобы узнать больше о передовых исследованиях в области ИИ и быть на шаг впереди в этом стремительно развивающемся мире технологий.
#исследования #анонс
Post #186
3.22K