TGViewer
Channel Public Channel
guided by the beauty

guided by the beauty

@guided_by

@ultima_rat картины
@truly_part мысли
@sortbyc чувства
@guided_by эфир
Subscribers
88
Photos
149
Videos
4
Links
102

Showing posts older than #233 · Back to latest

Older Posts 8 shown
Post #227 160
День, когда я впервые пришел в военкомат по повестке, был поистине замечательным. Скучаю по всем, с кем не пообщались (в т.ч. толком).

Повестка, кстати, считается автоматически врученной через 7 дней после появления уведомления в госуслугах. Я абсолютно случайно зашел туда за 2 дня до этого момента. Достаточно удобно.
  • 🤯 3
  • ❤ 2
  • 🫡 1
Post #226 194
Обнаружил блог Бена Куна (ныне сотрудника Anthropic), полный интересных постов. Этот максимально резонирует с моим опытом на протяжении всей жизни, честно говоря:

> Attention is your scarcest resource


> Как и у многих людей, большинство моих лучших идей приходят ко мне в душе. [..]

> Этот мой опыт сильно перекликается с наблюдением Бирна Хобарта о сосредоточенности в интеллектуальном труде:

Результативность работников умственного труда чрезвычайно зависит от сосредоточенности. Уровни продуктивности, похоже, таковы:
<10% сосредоточенности на текущей работе: значительный риск быть уволенным.
10-50% сосредоточенности: «соответствует ожиданиям», получает регулярные повышения.
50%+ сосредоточенности: суперзвезда, 10-кратный инженер, которому суждено величие.


> «50%+ сосредоточенности» — это примерно тот момент, когда что-то становится главной идеей в вашей голове. Это когда вы начинаете заботиться об этом достаточно, чтобы думать об этом в душе. Это когда вы начинаете постоянно спрашивать: «как это можно сделать быстрее?» Это когда вы становитесь неутомимо изобретательным. Примерно в этот момент вы начинаете раздражать своих коллег и/или вторую половинку. [..]

> Самое главное, вы можете быть сосредоточены на 50%+ не более чем на одной вещи одновременно. [..]

Из четырех методов концентрации внимания, которые он советует далее, три (Care viscerally, Monotask, Evade obligations) независимо занимают мои мысли этой осенью. Заголовки могут звучать не слишком проницательно. Я всегда кивал такого рода утверждениям, но ментальные модели, связанные с их содержанием, отличались радикально. Можно заценить соответствующие абзацы в эссе Бена, которые подсвечивают важные аспекты (своими инсайтами я поделюсь позже). А четвертый метод (Timebox bullshit) — это база, конечно, тут без новостей.
benkuhn.net Attention is your scarcest resource how to ration your shower thoughts • care viscerally • monotask • evade obligations • timebox bullshit
  • 👍 5
Post #220 139
  • ❤‍🔥 2
  • ❤ 2
Post #217 143
ARC-AGI — это бенчмарк созданный в 2019 специально так, чтобы

1) проверять глубокую способность обобщать (гибкий интеллект)

То есть, способность вникать в условия любой новой задачи, конструировать многоуровневые концепции, которые применять уже в конечном вопросе. В духе «с нуля кратко иллюстрируются основы алгебры и просят доказать теорему Безу», но только в таких темах, чтобы...

2) тест был простым для людей, но непроходимым для современных AI систем

Но.. поскольку рассуждающие LLM (появившиеся прошлой осенью) подбирались на нём к человеческому уровню... в марте вышел ARC-AGI-2 (на втором фото пример задачи).

Посмотрите как уложились три года поступательного прогресса снизу на нём.

И как выглядит то, что произошло сейчас.

Да, ARC-AGI-3 уже на подходе. Зацените вообще их страницу, там много красивого.

Картинка и тейк найдены в клёвом substack-блоге Alberto Romero.

К слову о том насколько велика разница между ведущими моделями и открытыми китайскими: DeepSeek — желтый.
Post #215 136
guided by the beauty Через сколько лет llm начнут решать его на > 95% ?
Итак,

FrontierMath — набор неопубликованных математических задач экспертного уровня, решение которых занимает у специалистов от нескольких часов до нескольких дней. Уровни сложности 1–3 охватывают задачи уровня от бакалавриата до начальных курсов магистратуры, а уровень 4 — исследовательскую математику.


Ноябрь 2024: все LLM решают <2%

Ноябрь 2025:
  • 😱 4
  • 🫡 1
Post #214 156
попросил Gemini по мотивам приложенной пикчи "тяжёлые времена создают сильных людей" изобразить цикл сезонных отношений с телеграмом

как же он без подсказок прочувствовал каждый период...
  • 🔥 5
Post #213 192
Gemini 3.0 — the most intelligent model ever — is finally here

Доступна бесплатно с позавчерашнего вечера в AI Studio и на сайте Gemini (нужен впн сша). Много прорывных результатов, но строчка MathArena — это просто безумие. Ждём когда прогонят на FrontierMath...

Как хорошо известно в узких кругах, я давно убежден, что Google демонстрирует принципиально более глубокий потенциал в гонке искусственного интеллекта, чем конкуренты (главные из которых: OpenAI с их ChatGPT и Anthropic с их Claude). Расскажу подробно о происходящем позже.
  • ❤ 4
  • 🔥 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →