Разумеется, я использую ИИ для проверки утверждений. С выходом GPT-5 и их агента качество и надёжность ответов заметно выросли, агент практически не галюцинирует (хотя, увы, может в список источников включить среди качественных научных статей немного ереси с дорвеев, поэтому проверять его нужно в любом случае). Модели научились говорить «Не знаю», а судя по свежим исследованиям, может и полностью с галлюцинациями разберутся — как минимум отличить программно галлюцинацию уже возможно, так что ждём больше «Не знаю» в ответах агентов.
Вот мой чат с GPT Agent, где я прошу его провалидировать реалистичность Alterego, интерфейса для «чтения мыслей», про который я писал ранее. Промт простенький, буквально пара строк. Я его потом улучшил с помощью самого же ChatGPT, но даже исходные 2-3 строки и пара ссылок дают агенту достаточно контекста, чтобы выдать подробнейший ответ-презентацию.
Однозначные утверждения о том, что ChatGPT делает нас тупее не выдерживают критики — если хотя бы формально выполнять простейшие правила и активно взаимодействовать с ответами моделей (читать как минимум), начиная с o3, то интеллект не может не развиться. GPT-5 отвечает на уровне ну как минимум бакалавра, а вообще и действительно PhD (по сложности ответов и словаря) — хотя в остальном я считаю сравнение ChatGPT с PhD. некорректным.
К примеру, Клод оценил Readability Level ответов как Graduate/Professional (16+ лет образования). Объем словаря и навыки письма — самые большие предикторы всех типов успеха (академических, бизнесовых и так далее). Более объемный словарь — более точный инструментарий для описания реальности, и для взаимодействия с агентами, конечно.
Так что если вы нормально читаете отчёты GPT-5 и GPT Agent — когнитивный упадок не грозит.
Чат с Клодом про оценку Readability Level в ответах GPT-5
Post #339
278