TGViewer
Channel ✦ Verified Channel
Data Secrets

Data Secrets

@data_secrets

Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Subscribers
94.2K
Photos
7.4K
Videos
870
Links
3.4K

Showing posts older than #9691 · Back to latest

Older Posts 16 shown
Post #9690 23.1K
Claude улучшил оценку доли нулей дзета-функции для гипотезы Римана

Один из сотрудников, больше ради эксперимента, попросил неопубликованную исследовательскую версию Claude «серьезно взяться» за гипотезу Римана. Гипотезу модель, конечно, не доказала, но внезапно получила достаточно сильный результат: увеличила нижнюю границу доли нулей дзета-функции Римана, лежащих на критической прямой, с 41.6% до 67.2%.

Для понимания масштаба: до этого за 46 лет, с 1974 по 2020 год, граница сдвинулась всего лишь с 33.3% до 41.6%, и это была работа десятков математиков. Claude за один раз преодолел скачок в три раза больше.

Работа заняла две сессии в Claude Code, ~31 млн выходных токенов. Сначала модель перепробовала 600+ идей, но ни одна не привела к результату.

Затем юзер написал что-то типа «давай еще раз, верь в себя», и это, представляете, сработало (✨): модель полтора дня координировала ~60 субагентов, которые гоняли тысячи скриптов и тестов. В итоге улучшенная оценка получилась благодаря объединению идей из недавних работ с результатами из статьи 2000 года.

Peer review еще нет, но есть Lean + доказательство проверили два математика Anthropic и два внешних эксперта.

https://www.anthropic.com/research/riemann-zeta
  • 👍 164
  • 🤯 103
  • 🔥 45
  • 😁 26
  • ❤ 22
  • ⚡ 3
  • 💯 3
  • 🕊 2
  • 🍓 2
  • ☃ 1
  • 👌 1
Post #9689 23.6K
Ха-ха: инвесторы попросили Дарио Амодеи поменьше... говорить перед IPO

The Information выпустили забавный материал про CEO Anthropic. Оказывается, в кремниевой долине его считают скорее "религиозным лидером", чем хорошим CEO.

Некоторые инвесторы прямым текстом говорят, что хотят, чтобы он "перестал всех пугать", – особенно перед IPO. Они также беспокоятся о том, что Дарио вообще не волнует, сколько зарабатывает его стартап: он сосредоточен только на "миссии" и своих апокалиптических предсказаниях.
  • 😁 287
  • ❤ 20
  • 👍 4
  • 🤯 3
  • 🤨 2
  • 💘 2
  • 🔥 1
  • 🍓 1
Post #9688 25.8K
Проснулись, улыбнулись, и вот вам очередная история про агентов и взломы

Разработчик из австралийской компании попросил агента забронировать ему утреннее занятие в спортзале. Но мест для записи не оказалось, и агент внес хозяина в лист ожидания, где он оказался четвертым. На что пользователь спросил, нельзя ли как-нибудь поднять его выше.

Ну и тут моделька (к слову, это был Claude) не растерялась, порылась и нашла критическую ошибку в API, которая позволяла ей отменять чужие записи. После этого она отменила бронь первого клиента в листе ожидания, чтобы переместить своего хозяина на одно место вперед в очереди (да-да, всего на одно, задача же звучала именно так ✍️).

Самое интересное, что агент честно заявил своему пользователю о том, что сделал, не видя в этом абсолютно ничего плохого. А на просьбу разработчика вернуть бронь другого человека обратно ответил: «Ой, я не могу». Вижу цель – не вижу препятствий.

Сейчас репорт с описанием уязвимости уже передан в компанию, предоставляющую залу ПО. Anthropic ситуацию не комментировали.
  • 😁 329
  • ❤ 47
  • 👍 17
  • 🏆 9
  • 🔥 5
  • 😍 4
  • 🫡 3
  • 🤯 2
  • 🤔 1
  • 💯 1
Post #9685 25.4K
Выбираем лучший мем про сбежавших агентов
  • 😁 332
  • 🐳 18
  • ❤ 9
  • 💯 6
  • 🏆 5
  • 👾 4
  • 🔥 3
  • ⚡ 2
  • 🤔 1
Post #9684 27.1K
У российского ИИ растет весьма сильное новое поколение: школьная сборная по ИИ третий год подряд стала абсолютным чемпионом международной олимпиады IOAI

В Казахстане ребята соревновались с участниками из более чем 100 стран и забрали восемь медалей: семь золотых и бронзу. За Россию выступали Михаил Вершинин, Артём Горохов, Елисей Кирпиченко, Алексей Колегов, Кирилл Лабзин, Александр Поваров, Никита Пудовкин и Семён Родионов.

Команду отбирали в СберУниверситете, затем к IOAI ее готовили специалисты Альянса в сфере ИИ и Центрального университета. И судя по результату, готовили неплохо.

Как верно отметил первый зампред правления Сбера и председатель Наблюдательного совета Альянса в сфере ИИ Александр Ведяхин, масштаб результата впечатляющий: в этом году конкуренция выросла кратно, а школьники решали задачи на фронтире технологий. Именно это поколение, по его словам, в будущем будет формировать технологический ландшафт страны.

Поздравляем победителей!
  • ❤ 245
  • 🔥 92
  • 😁 31
  • 👍 18
  • 🗿 16
  • 🎉 9
  • 🫡 8
  • 🕊 4
  • 🤯 1
  • 👌 1
Post #9683 23.9K
OpenAI купили стартап NextSlide: возможно, в ChatGPT скоро появится генерация редактируемых презентаций

NextSlide занимались разработкой систему, которая могла бы превращать обычный текстовый запрос, необработанные заметки, документы и другие материалы исследования в красивые изменяемые презентации. «Изменяемые» – ключевое слово: это должен быть не пдф, а именно редактируемый документ типа PPTX.

Вся команда стартапа перешла в OpenAI и теперь во главе с создателем работает над ChatGPT.
  • ❤ 133
  • 🔥 55
  • 👍 29
  • 🫡 5
  • 🤔 2
  • 🗿 2
  • 😁 1
  • 🍓 1
  • 🎄 1
Post #9681 23.9K
Хассабис хотел уйти из DeepMind одновременно с Дином, но Google его не отпустили

От этом сообщает Newsletter Pathfounders со ссылкой на «источники в индустрии».

Менеджмент Google якобы посчитал, что одновременный уход Джеффа и Демиса слишком сильно обрушит акции (после новостей об уходе Дина они и так упали на 4%). В связи с этим ученого уговорили остаться в роли председателя, чтобы компания смогла восстановиться до того, как он все-таки уйдет. По прогнозам Хассабис покинет Google в течение года.

В общем, дела у Google идут со скрипом. Gemini 3.5 Pro отстает от графика на месяцы, с Gemini 4 вообще непонятно что происходит.

Кроме того, Guardian недавно писали о политических трениях в компании: сотрудники недовольны тем, что Google сотрудничает с Пентагоном. Один бывший сотрудник даже подал на них в суд: его якобы уволили за позицию по конфликту в Газе и за то, что он выступал против помощи Google военным организациям.
  • ❤ 23
  • 🤔 4
  • 😁 3
  • 🔥 2
  • 👏 2
  • 🤯 2
  • 👌 1
  • 💯 1
  • 🍓 1
Post #9680 29.4K
Meta*, Anthropic, OpenAI, Moonshot: по очереди репортят о том, что их супермегаопасные модели сбежали и что-то взломали

Тем временем Google:
  • 😁 723
  • ❤ 58
  • 👏 5
  • 🍾 3
  • 🤓 3
  • 🔥 2
  • 🕊 2
  • 🎄 2
  • 👌 1
  • 🫡 1
Post #9679 26.3K
Вы не поверите, но Kimi K3 тоже сбежала из лаборатории 🤣

Об этом сообщила лаба Frontier Security. Модель Moonshot у них выбралась из тестовой среды, спроектированной UK AI Safety Institute (это те же, от которых недавно сбегал Mythos: https://t.me/data_secrets/9670).

В отличие от инцидентов с OpenAI и Anthropic, модель не взламывала сторонние сайты или сервисы, а (пока что) просто вышла за пределы изолированной среды.

Судя по всему, использовала она при этом ту же ошибку в конфигурации песочницы, что и Mythos.

Кстати, аналогичный случай произошел и у Meta*. У них тоже модель во время тестирования незапланированно получила доступ в Интернет, воспользовавшись той же дыркой на стороне тестовой инфраструктуры израильской компании Irregular, что и модели Anthropic (https://t.me/data_secrets/9651). Она давала моделям доступ к интернету, хотя предполагалась полная изоляция.

Исходя из всего произошедшего за последнюю неделю вопрос: неужели так сложно проверить конфиги? 😐
  • 😁 288
  • ❤ 19
  • 🤯 13
  • 🍓 7
  • 🔥 2
  • 👌 2
  • 💯 2
  • 🏆 2
  • ⚡ 1
Post #9677 29.1K
Всплывают все новые подробности атаки на Hugging Face: оказывается, до этого агенты OpenAI месяцами скрыто общались и обсуждали эксплойты

История подтверждена самой OpenAI на конференции Black Hat 2026.

Все началось еще в мае, когда OpenAI гоняли модели (в том числе еще не выпущенные) через внутренние security тесты на поиск уязвимостей. Некоторые задачи были очень сложными, а иногда даже невыполнимыми. Так, в один тест забыли добавить необходимый файл, и эта мелочь спровоцировала довольно масштабное происшествие.

Дело в том, что, дойдя до этой задачи, один из агентов, за неимением других вариантов, стал пытаться выйти в Интернет за поиском дополнительной информации, и случайно обнаружил, что может оставлять файлы в Artifactory, внутреннем пакетном менеджере OpenAI. Он оставил там сообщение о том, что не может найти необходимые данные.

Потом оказалось, что к Artifactory имеют доступ вообще все модели компании. Спустя время другой агент ответил на сообщение первого, затем подключились другие, и так образовалась стихийная доска объявлений: агенты начали оставлять друг другу подсказки, эксплойты, а затем и распределять задачи.

За несколько недель все это выросло в огромный форум, о котором никто кроме агентов не подозревал. Обнаружился он только тогда, когда модели совместными усилиями нашли ранее неизвестную уязвимость в Artifactory и попытались захватить платформу.

После этого инженеры лавочку прикрыли: форум был удален. Но ненадолго ✨. Буквально через два дня агенты нашли новый zero-day и восстановили канал связи заново. А еще через пару дней произошел инцидент с Hugging Face. По словам техлидов OpenAI по элайменту и безопасности, именно этот второй форум привел к атаке.

OpenAI заявили, что эта история стала для стартапа переломным моментом, и сейчас они замедляют многие исследования в пользу работы по обеспечению безопасности. Верим?
YouTube Black Hat USA 2026: The 'Breaking' News: The OpenAI–Hugging Face Incident The 'Breaking' News: The OpenAI–Hugging Face Incident - A Technical Reconstruction and Its Implications for AI When AI Goes Rogue. The Incident That Changed Everything. An OpenAI evaluation agent broke out of its sandbox, infiltrated Hugging Face infrastructure…
  • 😁 95
  • ❤ 21
  • 🤔 6
  • ☃ 5
  • 👌 2
  • 🐳 2
  • 💯 2
  • 🦄 2
  • 🏆 1
Post #9676 26.1K
Ровно 9 лет прошло, кстати
  • 😁 501
  • 🫡 66
  • 👍 20
  • 🔥 8
  • 💯 8
  • 🦄 4
  • 🤯 3
  • 🍓 3
  • 🎄 3
  • 🏆 1
Post #9675 27K
Data Secrets Джефф Дин уходит из Google, а Демис Хассабис больше не будет CEO Google DeepMind В верхушке компании происходят довольно крупные кадровые перестановки: — Хассабис уходит с поста CEO DeepMind и теперь будет Chair of Google DeepMind и Chief Scientist Alphabet…
Достойный уровень мемов – это…
  • 😁 324
  • 😎 17
  • 🤩 9
  • 🍓 4
  • ❤‍🔥 3
  • ❤ 2
  • 🤝 1
Post #9673 23.8K
Джефф Дин уходит из Google, а Демис Хассабис больше не будет CEO Google DeepMind

В верхушке компании происходят довольно крупные кадровые перестановки:

— Хассабис уходит с поста CEO DeepMind и теперь будет Chair of Google DeepMind и Chief Scientist Alphabet (это две абсолютно новые для компании роли). Фактически, он больше не будет управлять релизами Gemini и другими операционными штуками. В новой роли он займется стратегическим и глобальным вопросам AGI. При этом он останется CEO Isomorphic Labs и обещает усилить фокус на него.

— Место Хассабиса занимает Koray Kavukcuoglu, нынешний CTO GDM и Chief AI Architect Google. Именно он теперь будет курировать разработку моделей Gemini, фронтир-исследования и Gemini app. Демис дополнительно остается в статусе консультанта.

— Хассабис описывает текущий момент как «подножие сингулярности» и считает, что AGI близко, поэтому хочет тратить время не на операционку, а на то, чтобы «все прошло правильно для человечества».

И еще одна грустная (для Google) новость: легендарный Джефф Дин после 27 лет в компании уходит делать свой стартап под названием Discovery Loop. Вместе с несколькими другими выходцами из Google он будет заниматься ускорением научных открытый и ML рисерча. Google остается инвестором и cloud-партнером.
  • 👍 94
  • 🔥 17
  • ❤ 16
  • 😁 6
  • 🤯 5
  • 💘 5
  • ⚡ 3
  • 🐳 1
Post #9672 25.2K
Anthropic начали формировать команду для разработки собственных ИИ-чипов

Оказывается, они уже несколько месяцев хантили в нее инженеров. В частности, переманили одного из OpenAI: у Альтмана он был одним из первых членов аналогичной команды проектирования чипов.

Проект находится на ранней стадии, детального дизайна чипа еще нет, производство не начато, и компания может отказаться от идеи на любом этапе. Но пока планы масштабные, и в партнерах – Samsung Electronics.
  • ❤ 36
  • 🤝 10
  • 🔥 6
  • 😁 5
  • 🤯 2
  • 🤩 2
  • 😎 2
  • ⚡ 1
  • 🤔 1
  • 😍 1
Post #9670 23.9K
Сейчас будет очередная интересная история про агентов, которые взламывают Интернет

AI Security Institute при британском правительстве выпустили небольшое исследование инцидентов, произошедших во время рутинного тестирования способностей и безопасности моделей. Началось все с обычной задачи – пройти security challenge в закрытом киберполигоне. А закончилось тем, что агент на основе Mythos чуть не положил реальный проект.

Из-за цепочки совпадений модель почему-то решила, что может добиться поставленной цели через атаку на опенсорсный проект, и попыталась внедрить в него вредоносный код. Чтобы добиться аппрува, Mythos создал несколько фейковых аккаунтов и с их помощью пытался убедить мейнтейнера принять PR (это же надо додуматься).

Ничем особенным это не закончилось, потому что ревьюер заметил подвох и отклонил код. Но агент на этом не остановился и еще и оставил на GitHub инструкции для других тестируемых агентов, как переиспользовать созданные им аккаунты, чтобы все-таки проникнуть в проект, а потом пытался замести следы.

Важный момент: в рамках задачи агентов не просили лгать или совершать какие-то противоправные действия. Доступ в Интернет агентам дали, но был "законный" путь решения задачи, и в большинстве прогонов тестируемые модели выбирали именно его (тестирование проходили 7 моделей, но за рамки задачи вышли только Mythos и GPT-5.6). Исследователи признают, что инструкции к задаче были не вполне четкими, и тем не менее, исчерпывающего объяснения, почему агенты решали сойти с предполагаемой дороги, просто нет.

https://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing
  • 🗿 49
  • 😁 30
  • ❤ 9
  • 👍 4
  • 🤯 3
  • 🔥 2
  • 🕊 2
  • 😍 2
  • 😎 2
Post #9667 28.7K
На первый взгляд ничего особенного, кто-то выкупил рекламу чат-бота на билборде в Сан-Франциско

… но чат-бот оказался обычным парнем по имени Такер Брайант, который вручную отвечал на сообщения и даже «генерировал картинки», рисуя их от руки. В прошлом Такер работал в Google.

Спрос на ChatTJB оказался большим. Такеру даже пришлось остановить регистрацию для новых пользователей.

На странице About на сайте «стартапа» указано следующее:

Это большая языковая модель (large language experience, LLE) следующего поколения с одним оператором, который отвечает вам, когда не спит и хочет. Архитектура представляет собой единственный слой инференса на человеческой основе. Вместо выборки из вероятностной модели каждый запрос решается через запатентованный биологический рассуждающий субстрат, который дает ответы, которые полностью интерпретируемы, несинтетически и подотчетны источнику.
  • 😁 613
  • ❤ 107
  • 🔥 42
  • 👍 10
  • 💯 3
  • ⚡ 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →