TGViewer
Жабаскрипт (веде Віктор Турський) Жабаскрипт (веде Віктор Турський) @jabascript · 4.73K subscribers
Post #417 5.41K
Антропік змогли подивитися в думки моделі (частина 2)
Початок тут:
https://t.me/jabascript/416

Що перестає працювати, коли моделі вимикають J-space (умовно зануляють J-space в рантаймі):
❌ Багатокрокове логічне міркування: Модель більше не може вирішувати задачі, які потребують проміжних розрахунків "у голові", тому вона почне галюцинувати або видавати випадкові відповіді в будь-яких запитах, де їй немає можливості виписати розгорнутий ланцюжок думок (Chain-of-Thought) у текст.
❌ Спрямований фокус: Втрачається здатність "тримати в голові" один концепт під час виконання іншого завдання, через що модель не зможе дотримуватися глобальних обмежень із системного промпту (наприклад, "пиши код без бібліотеки X" або "зберігай саркастичний тон") і просто губитиме цей контекст під час об'ємної генерації.
❌ Гнучке узагальнення: Модель не може маршрутизувати проміжні результати для нових висновків, що ламає роботу зі складними запитами (multi-hop QA) - наприклад, якщо під час читання документа вона зрозуміла, що мова йде про Францію, вона не зможе автоматично "підтягнути" з пам'яті її закони, щоб виконати наступну частину вашого промпту.
❌ Складна оцінка ситуації: Відключаються "вищі" функції моніторингу власних дій, через що модель стає абсолютно "сліпою" до маніпуляцій, перестає розпізнавати приховані prompt injections і перетворюється на наївну систему, яка бездумно виконує шкідливі інструкції.

Що продовжує працювати (тобто наявність J-space не впливає):
✅Вільна генерація тексту: Модель не втрачає здатності розмовляти. Вона генерує абсолютно зв'язний, граматично правильний і природний текст.
✅ Відтворення базових фактів: Прямі асоціації та прості факти (рефлекторні знання, завчені під час тренування) видобуваються без проблем.
✅ Автоматична взаємодія: Модель здатна підтримувати звичайний, поверхневий діалог на рівні базових відповідей (що не вимагають послідовного міркування).

Можливо ви цю новину вже читали, але якось в новинах я не отримах тих відповідей, які зміг відкопати в самому ресерчі.

Пишіть в коментарях, як вам такі пости. Цікаво чи краще менше таких концептуальних речей й краще щось більше практичніше?
Telegram Жабаскрипт (веде Віктор Турський) Антропік змогли подивитися в думки моделі (частина 1) Якщо коротко, то модель може думати одне, а говорити інше. Й Антропік знайшли спосіб подивитися в думки моделі. Й це не chain of thoughts, які ми бачимо як аутпут моделі, а внутрішня репрезентація, що…
  • 👍 74
  • 🔥 14
  • ❤ 8
  • ❤‍🔥 1
More from @jabascript
  1. Sep 30, 2026Ну шо... https://youtu.be/I5_D15gCDDQ
  2. Sep 29, 2026🏎️🏁Забирайте трофеї й знову нові тижневі челенджі 🏎️🏁
  3. Sep 26, 2026"Найкраща мова програмування - англійська" DHH Зараз багатьом підгорає від останньої допов…
  4. Sep 22, 2026Забирайте трофеї й знову нові тижневі челенджі 🏎️🏁
  5. Sep 14, 2026Втомилися чекати на дашборди? Не знаєте, як тестувати AI-агентів? Або цікавитесь, як працю…
  6. Sep 14, 2026Понеділок й нові челенджі вже доступні 🏁🏎️ 👉 Поміняв систему розподілу призів, щоб не б…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →