TGViewer
Рид. Сознание и Инвестиции. Рид. Сознание и Инвестиции. @eugene_rid · 2.37K subscribers
Post #82 1.39K
Как я провел Август

Начнем с истории, в 1961-м Марвин Минский описал задачу, которая никуда с тех пор не делась. Партия выиграна, ходов было сорок, успех распределён между ними. Какому ходу приписать победу? Минский назвал это задачей присвоения заслуги и считал её ключевой.
(Это потому что он GP у них есть деньги, или потому что она ведьма и держала поле за него, - знакомо?)

Шестьдесят пять лет спустя препятствие на месте. Модели научились объяснять. А отвечать на вопрос Минского они не научились.

Задача через /goal клодику: уменьши размер кода моей апки - даётся агенту легко, одно действие, одно измерение.

А вот управление кофейней задача посложнее. Круассаны, дождь, сосед напротив или матч в тот вторник? Между действием и результатом встал целый мир. Так устроено большинство задач, ради которых мы строим системы. Но к сожалению большинство не понимает, что контекст в миллон токенов не самое главное.

CogniLoad меряет, как модель держит состояние при последовательных фактах. У gpt-5 с medium reasoning выходит ~99,7% на двадцати переходах уже 76%. Это модели 2025 года. Но окно контекст и удерживаемая связность фактов и их количество живут отдельно: факт лежит в контексте, и это не значит, что он будет связан с другим. LLM не ищет математически-достоверно корреляции между фактами, а пишет достоверный похожий на правду текст. Который может быть хорошим выстрелом, и хорошей гипотезой, но не обязательно правдой. Это следует помнить.
А вы как? Даете клоду управлять вашим здоровьем?

В 1996-м физик Алан Сокал отправил в Social Text бессмыслицу языком постмодерна про «трансформативную герменевтику квантовой гравитации». Напечатали. Через три недели он объявил: это был эксперимент. Рецензирования журнал тогда не практиковал, и у текста не было места, где он мог бы оказаться неправым.

Отличить ум от слопа по качеству объяснения нельзя, объяснение производить дешевле всего, особенно это опасно в медицине и инвестициях. Поэтому я сейчас много копаю в сторону статистики, и доказательных подходов в социальных науках.

Слоп старше нейросетей. И он везде, каждая вторая науная работа это слоп ради статуса кандидата наук. Просто раньше было не так явно что это. Это не низкое качество, это текст, которому нечего проиграть, система, типология - которую не проверить, под которую факты ложаться потому что она абстрактна. Или выполняет функцию утешения.

Нравится мне читать Кармака, недавно он писал, что текст кода есть плоское дерево, а в его контексте куски связаны только позиционно. Он предлагает собирать код в контекст. Отсюда способ кодить сложные системы отгружать граф связей в контекст.

Еще читал работу Белкина по теме, он тоже топит, что простые локальные модели работают не хуже большой сети, если дать им правильное разбиение на ветви.

Разбиение на ветви/режимы/слои/иерархии и есть знание. Утренняя и вечерняя кофейня живут по разным законам.

А теперь про людей. Рабочая память человека держит около четырёх объектов, и кривая деградации у нас не мягче чем у LLM, просто когда мы говорим про контекст, мы не говорим про обьекты внимания хотя должны.

По теории внимания, субъективная осознанность есть упрощённая модель собственного внимания, которую мозг строит, чтобы вниманием управлять.

Модель оптимизирована под управление, не под точность. Поэтому единство и ощущается единством.
Кто понял, тот понял.
То же чувство даёт полный контекст LLM. Кажется, что всё видно, а работает как способ увереннее проигнорировать увиденное.

Поэтому если вы думаете что человек это венец творения, уверяю вас, это забагованное произведение эволюцинного процесса, в котором оригинальные находки смешаны с легаси, и часто вообще не понятно как оно вообще двигается. Ум часто помогать увереннее игнорировать важное. И берем мы эту реальность лишь числом агентов и экспериментов, так сказать, а не архитектурой.

Полный контекст против рабочего представления при одном бюджете, и считать надо только пропущенные факты. Если я прав, эти вещи обгонят замену модели на более сильную. Собираюсь померить и взять количеством, как матушка природа.
  • ❤ 20
  • 🔥 7
  • 👍 5
More from @eugene_rid
  1. Sep 24, 2026Ребята, 23-25 октября я делаю ai-инвест-коворкнинг для своих-своих в Швейцарии (40 мин от…
  2. Sep 15, 2026Ситуация с уравнением Навье Стокса
  3. Sep 15, 2026Это прекрасно))))
  4. Sep 2, 2026Никаких глубокий рассуждений сегодня, просто если вы вдруг не знали, то начали снимать "Со…
  5. Aug 21, 2026Обратите внимание на новый вид фишинга, в коментариях к постам часто пишут что-то соотвест…
  6. Aug 16, 2026Не рановато для недвойственности? Свобода или контроль. Доход или риск. Государство или ры…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →