TGViewer
AI и грабли AI и грабли @oestick · 13.7K subscribers
Post #387 2.39K
Эксперимент закончен, поболтаем про результаты:

Главный вывод, судя по комментам, что оба варианта так себе 😅

И это правда, но почему?

У меня тут две мысли

1. Заметили один интересный эффект – когда LLM вытаскивала текст, она взяла все 5 предложений из выделенных автором блоков

Если убрать выделение, отформатировав их как весь остальной текст, результат получается интереснее:

Ты просто говоришь, что любая новая идея провалится и в 98% случаев ты будешь прав. Потому что 98% идей действительно провалятся. Вот только ты так и останешься в жопе с таким критическим мышлением.

Оставайся посередине. Всеми силами держи дистанцию между крайностями. Не видишь другой крайности — значит ты слишком близко к первой.

Крайности всегда приятны и хорошо видны, но в долгосрочной перспективе не имеют смысла. Я всегда могу занять сначала одну позицию, потом другую, потом снова первую, и буду «жизой» для одних и «лол дурачком» для других.

Когда приходит время действовать, «оставаться посередине» — самое херовое, что можно делать

Для себя — оставайтесь посередине. Для других — будьте самым отбитым психопатом, которого они только встречали


То есть LLM как бы цепляется за авторскую семантику. В каких-то случаях полезно, а в каких-то, как тут – вредно – автор выделяет слишком базовый смысл, который актуален только когда есть остальной контекст

2. Ну а главная причина: 5 предложений – слишком мало.

Я не просто так в оригинальном посте писал про 20. Обычно первые результаты LLM всегда очень банальны. Поэтому часто вообще прошу что-то вроде:

Выдай 10 результатов. Потом выдай еще 10 менее очевидных и выходящих за рамки того, что было в первой пачке. А потом выдай последние 10, которые не попадают в первые две пачки, но тоже являются ответами на исходную задачу. Я это прошу, потому что LLM часто думают слишком шаблонно, особенно при первом заходе на задачу. А я хочу, чтобы ты вышла за рамки шаблонных ответов


———

Так что мы осознанно пошли с n = 5, чтобы уместить оба варианта в один пост и не перегружать "жюри"

Важно было понять не столько, хорошее ли саммари в абсолютном зачете, сколько, какое вариант лучше (пусть и в урезанной версии на 5 предложений).

Формально победил LLM вариант. Но с небольшим отрывом.

Неформально, я согласен с комментарием @nobilix – LLM выигрывает гибкостью.

Отдельное спасибо @izpodshtorki за готовность поучаствовать в такой активности

P.s. посмотреть результат работы с 20 предложениями можно в комментариях
  • ❤ 9
  • 🔥 3
  • 👍 2
  • 🤝 1
More from @oestick
  1. Oct 4, 2026Саша Поляков собрал стату по банам (меня тоже в этот раз задело). Мб кому-то полезно будет…
  2. Oct 4, 2026Собрал статистику по банам Claude из комментариев в канале Пост с разбором телеметрии, кот…
  3. Oct 2, 2026О, мой баг репорт в getbb.app приняли. Приятно быть причастным к развитию того, чем сам по…
  4. Oct 1, 2026А у вас тоже есть задачки, в которых нужно очень много и глубоко думать, но вы их откладыв…
  5. Sep 30, 2026Anthropic > OpenAI, но есть пара но Предпосылки 1. opus-5.5 очень хорош 2. DevDay openai –…
  6. Sep 27, 2026Скоро: видео-монтаж-слоп во всех лентах страны Opus-5.5 теперь сам такое ваншотит на remot…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →