TGViewer
Все о блокчейн/мозге/space/WEB 3.0 в России и мире Все о блокчейн/мозге/space/WEB 3.0 в России и мире @blockchainrf · 20.5K subscribers
Post #13273 2.52K
Google представили прототип ИИ-системы, проводящей полный цикл научной работы при этом гарантирует проверяемость результатов.

Авторы проекта говорят, что сегодняшние автономные ИИ-учёные уже пишут статьи, но часто:

- выдумывают несуществующие ссылки;
- описывают в тексте один метод, а в коде реализуют совсем другой;
- говорят о результатах экспериментов, которые нельзя воспроизвести по приложенному коду.

Решение от Google - Science One Framework, у которого принцип работы такой: каждое утверждение в статье должно быть привязано к конкретному источнику в реальной статье из базы, строчке лога эксперимента или фрагменту кода.

Сам фреймворк состоит из 3-х основных частей:

1. один читает литературу через Semantic Scholar API и берёт ссылки только оттуда, без обращения к памяти модели;

2. второй параллельно тестирует решения и фиксирует все результаты в неизменяемом логе;

3. третий Claim Verifier перед публикацией сверяет каждое утверждение с доказательной базой и переформулирует то, что за её рамки выходит.

В качестве аудита Google предложили отдельный протокол CoE Audit - 4 автоматические проверки любой статьи, сгенерированной ИИ.
Google Research Science One Framework: A verifiable autonomous research framework via Chain-of-Evidence Introducing the Science One Framework, an experimental research prototype designed to eliminate hallucinations by natively building verifiable evidence chains, and CoE Audit, an automated protocol to evaluate the integrity of AI-generated papers.
  • ❤ 8
  • 🔥 3
  • 👏 3
  • 🤔 1
More from @blockchainrf
  1. Sep 25, 2026Свежее от #DeepSeek:они показали,как выглядит фабрика обучения ИИ-агентов изнутри Команда…
  2. Sep 25, 2026Но всех рвет Джефф Дин, ex-Google, его стартап инвесторы оценивают в $50млрд, и это не пре…
  3. Sep 25, 2026Это какое-то безумие, инвесторы оценивают разработчика Jev в $10млрд Мы недавно писали про…
  4. Sep 25, 2026Anthropic разобрали как создать ИИ-агентов для торговли и сами рынки для агентов Команда р…
  5. Sep 24, 2026Google DeepMind говорят, что безусловного дохода недостаточно для счастливого будущего с И…
  6. Sep 24, 2026Шмидхубер стал Chief Scientific Advisor в Sakana AI 🙂
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →