TGViewer
Channel Public Channel
Сиолошная

Сиолошная

@seeallochnaya

Канал SeeAll'а с новостями (и мыслями о них) из мира NLP, VR и космоса.

Более подробно смотри в первом сообщении в канале (оно закреплено). А еще у нас есть чат! Заходи: https://t.me/+i_XzLucdtRJlYWUy
Subscribers
79.7K
Photos
2.1K
Videos
352
Links
2.1K

Showing posts older than #3925 · Back to latest

Older Posts 15 shown
Post #3924 89.6K
Сиолошная — Затем представители OpenAI предложили две опции: 1) он публикует свои результаты, а OpenAI на следующий день полное доказательство 2) он публикует свои результаты и после этого в одиночку (убрав соавтора из Anthropic) пишет статью на основе доказательства…
OpenAI выложили блогпост https://openai.com/index/navier-stokes-solution/

Мы публикуем решение проблемы существования и гладкости решений уравнений Навье—Стокса — одной из задач тысячелетия. Это доказательство, полученное внутренней системой OpenAI, показывает, что динамика уравнений Навье—Стокса, описывающих движение жидкости, может приводить к образованию сингулярности за конечное время. Мы публикуем как текстовое изложение доказательства, так и его формализацию в Lean (то есть это сразу авто-проверенно вычислительным движком).

Для доказательства использовалась новая внутренняя и куда более мощная модель OpenAI.

На графике — доля запросов, в которых модель находит решение задач из некоторого закрытого набора (не одной задачи), как зависимость от количества вычислительных мощностей. И эта модель всё ещё тренируется — она не закончена.
  • 🤯 301
  • 🔥 92
  • 🤡 21
  • 👍 12
  • 🎉 7
  • ❤‍🔥 4
  • 💩 4
  • 🌚 3
  • 👨‍💻 2
Post #3923 27.7K
— Затем представители OpenAI предложили две опции: 1) он публикует свои результаты, а OpenAI на следующий день полное доказательство 2) он публикует свои результаты и после этого в одиночку (убрав соавтора из Anthropic) пишет статью на основе доказательства OpenAI, признавая, что решение было получено моделью, и получает миллион долларов (то есть OpenAI откажутся)

— «Я сказал, что если OpenAI опубликует результаты предложенным способом, я расскажу о случившемся публично. В ответ услышал: «Зачем вам портить свою карьеру?». Я ответил, что я учёный, и спросил, почему он считает, что публичное освещение событий разрушит мою карьеру. В ответ услышал: «Если вы не хотите, чтобы я был вежлив, то мне не обязательно быть вежливым» – абзац, который разлетается сейчас по всем новостям

— И заканчивает письмо тем, что никого ни в чём не обвиняет, доказательства он не видел, и «если модель OpenAI действительно смогла сократить разрыв в решении Навье-Стокса, это замечательное достижение, и об этом следует громко заявить, при этом сохраняя историческую достоверность»

===

OpenAI обещает ответ «завтра» (может быть сегодня, так как они в другой часовой зоне), интересно послушать их историю, а самое главное узнать таймлайн и промпты для модели. Но пока что вот мои мысли:

— я считаю крайне маловероятным, что пользовательские данные оказали здесь какое-либо влияние. OpenAI ни в коем случае не стала бы использовать пользовательские чаты для этого или сознательно обучать систему на их основе таким образом, чтобы это повлияло на результат. Если эта позиция вам кажется необъективной, то... тоже самое написал тимлид RL-команды Anthropic, сотрудники которой обычно не выражают поддержку OpenAI. Ключевое тут «сознательно» — так как пользователь сам может контролировать, делиться ли своими чатами для обучения или нет; вероятно, поэтому на созвонах OpenAI не могли сказать, обучались ли они конкретно на этих чатах, так как есть много звёздочек, и ответ «нет» может быть не полным. А я пишу, что OpenAI не выцеливали чаты именно этого учёного и его коллеги.

— хоть я написал это два раза, напишу третий: у людей полного решения нет и не было. И если оно появилось у OpenAI (и это продукт работы модели) — это будет большое достижение.

— не зная всей истории я могу сказать, что если OpenAI начали делать что-то на слухах, у них получилось, и они опубликуют результат, отдавая честь за идеи по навправлению всем, кто в это внёс вклад (и автора письма, и его коллегу из Anthropic, и авторов статьи 2023-го года) — я не вижу большой проблемы. Даже жаль немного, что драма произошла до выхода — может, они и без внешнего давления раздали бы почести и указали все релевантные работы (пока что с их предыдущими решениями мат. задач так и было, в краже идей их никто не обвинял, на использованные статьи ссылки давались и в решении, и упоминались в анонсах).

— однако я считаю достаточно вероятным, что модель могла найти решение и без подсказки о том, в каком направлении нужно копать; хоть автор письма и говорит, что для него доказательство через «его» метод — это красный флаг, но если посмотреть на все предыдущие решенные задачи — почти везде было ровно то же самое: LLM смогла развить не-мейнстримную идею, которую кто-то где-то когда-то выражал, даже работал над ней, но не вышло довести до конца.

— пока что официального подтверждения нет, но на вышеупомянутых созвонах представители OpenAI утверждали, что черт возьми и них есть решение одной из Задач тысячелетия! Всё вышеописанное может добавить астерисков и облаков на это утверждение, но сам факт останется фактом, если решение опубликуют и проверят.

— печально, что ситуация не станет примером того, как AI-лабы могли бы сотрудничать/координировать свои действия, потому что в будущем ставки будут намного выше :(
  • 🌚 145
  • 🤡 107
  • 👍 58
  • 🤔 22
  • ❤‍🔥 6
  • 👎 5
  • 👨‍💻 5
  • 😭 3
  • 🎉 2
  • 🔥 1
Post #3922 26.3K
4 дня назад в твиттере начали появляться слухи, что одна из AI компаний решила то ли одну, то ли сразу две из Задач тысячелетия — списка из 7 открытых проблем, над которыми множество учёных бьются не первый десяток лет. Пока что лишь одна была решена Перельманом, который отказался от награды в миллион долларов за решение. Решение задач подобного уровня уже пару лет обсуждают как крупный майлстоун для AI и эффекта на математику и другие науки. Многие компании и стартапы пробовали и пробуют подступиться к проблемам.

Сегодня раскрылась драма: один из независимых математиков выложил 3 новых результата, связанных с вопросом существования и гладкости решений Навье Стокса. Вместе с этим он выпустил 4-страничное письмо с описанием своего взаимодействия с OpenAI в последнюю неделю, где косвенно обвиняет последних в ряде плохих практик. Сотрудник(и) OpenAI сказали, что выпустят свой ответ (и возможно решение?) завтра — так что их взгляд на ситуацию ещё не ясен, как и не ясно, насколько надёжным рассказчиком является автор письма.

Что с его слов произошло:
— последний год он вместе с математиком из Anthropic работал над решением проблемы. Оба работали в своё время и со своими ресурсами, без аффилиации с компаниями, сами платили за свои подписки итд.

— в последний месяц у них начали появляться первые значимые результаты, и 15-го августа один из авторов пересылает другому AI-сгенерированную статью, в которой тем не менее оказывается всё правильным. Авторы начинают работать над упрощением слопа и логики доказательств, делают формализацию (перевод результатов в программу, чтобы можно было верифицировать корректность). Важно подчеркнуть, что это не полное решение оригинальной задачи; Terence Tao ознакомился с работой и сказал, что эти результаты потенциально можно развить в полное решение, но на руках у авторов его не было и, насколько понимаю, всё ещё нет.

— 3-го сентября, как поползли слухи о решении (что по этому повествованию является преувеличением, ведь решения нет) Навье-Стокса, один из авторов получил информацию о том, что сведения об прогрессе попали в OpenAI. Как, что, от кого и откуда — не уточняется; пока что из контекста следует, что о результате изначально знали два математика и узкая рабочая группа.

— математик из OpenAI ответил в тот же день, предложил обсудить, как избежать соперничества, и ещё предложил кредиты для моделей.

— Созвон состоялся 6-го сентября, OpenAI хотели провести его раньше, но автор письма просил время на следующей неделе. На этом митинге представители OpenAI сказали ему, что внутренняя модель компании написала полное доказательство на примерно 100 страниц.

— Когда после созвона автор письма запросил описание направление доказательства, в нём фигурировало словосочетание «под действием внешней силы». Не важно, к чему именно оно относится, но для автора это стало «красным флагом», так как это то узкое направление атаки проблемы, которое он и математик из Anthropic выбрали и над которым работали долгое время — так как прочитали о нём в статье 2023-го года (и очень хвалят авторов и отдают им должную честь).

— После этого он начал расспрашивать OpenAI о том, как же так вышло, а когда они начали пробовать решать задачу, какие промпты отправляли, и самое главное учили ли они модель на его переписках. С его слов пробовать начали недавно — после того, как поползли слухи о решении. Про тренировку не ответили, сказав, что модели не были доступны его сообщения
  • 🌚 137
  • 👍 27
  • 🤔 19
  • 🔥 12
  • 🤡 10
  • 👨‍💻 4
  • 👎 1
  • 💩 1
Post #3921 30.5K

Forwarded from Самые умные мысли Павла Комаровского (и немножко щитпостинг)

Очередной профи-айтишник со стажем с 1986 года пришел ко мне в ФБ пояснить, что "хайп по поводу взлома Hugging Face раздувают исключительно бездарные журналисты". И мне вот тут интересно: а где все эти панические статьи журналистов, они вообще с нами в одной комнате? Насколько вижу я — наоборот, "нормисные" издания по большей части проигнорировали последние расследования про рой агентов, как что-то совершенно неважное.

Всякие Коммерсанты/РБК/Ведомости эту историю вообще обошли стороной. "Медуза" про инцидент с Hugging Face последний раз писала в июле в ключе "это всё пиар для классов, беспокоиться не о чем" с какими-то абсурдно-стыдными аргументами вроде "нет никаких подтверждений, что генеративный ИИ каждый раз будет прибегать к хакерской атаке для решения задачи или же воспроизводить взлом по одному и тому же сценарию." Шта?

Из тех, кто хоть как-то пытается адекватно освещать ситуацию, кажется, один только тех-отдел The Bell отдувается. Они молодцы!

А так, все реальные обсуждения этих инцидентов сейчас происходят в первую очередь как раз-таки среди гиков изнутри индустрии AI, а не наоборот — интересно, это им айтишник Игорь свысока предлагает "загуглить, что такое AGI"? 🤔
  • 🤣 303
  • 👍 92
  • 🤡 59
  • 🌚 47
  • ❤‍🔥 7
  • 👨‍💻 7
  • 🤔 6
  • 👎 5
  • 🤯 5
  • 😭 1
Post #3920 30.8K
Сиолошная CEO Nvidia Jensen Huang поздравил OpenAI с релизом Astra, обученной на видеокартах Nvidia в одном из датацентров «закрытого» проекта Stargate. С его слов, использовалось больше 100'000 видеокарт серии Blackwell. На первом фото — как выглядит ДЦ сейчас, достроено…
😍 и это даже не самый крупный на данный момент ДЦ в пользовании OpenAI.

Так что финансы, выделенные где-то после появления первой рассуждающей модели, наконец-то материализуются в виде моделей текущего поколения.
  • 👍 147
  • 🤯 97
  • 🌚 18
  • 🤡 12
  • 🔥 2
Post #3918 28.8K
эйай ньюз На фоне закрытия проекта Stargate,
CEO Nvidia Jensen Huang поздравил OpenAI с релизом Astra, обученной на видеокартах Nvidia в одном из датацентров «закрытого» проекта Stargate. С его слов, использовалось больше 100'000 видеокарт серии Blackwell.

На первом фото — как выглядит ДЦ сейчас, достроено несколько корпусов (не пропустите два здания слева вдали).

Сейчас суммарно в датацентре стоит примерно в 2 раза больше карт — по оценкам Epoch.AI с 23-го мая в эксплуатации уже 200'000 GPU. Чтоб понимать динамику — первую половину запустили ~24-го декабря 2025-го года (см. вторую картинку).

Ожидается, что 1-го ноября датацентр снова «удвоится», и довезут ещё 200'000 карт. И можно поспекулировать, что к концу года OpenAI может начинать там тренировку на в четыре раза большем количестве мощностей, чем было под Astra.
  • 🤯 281
  • 🔥 89
  • 👍 8
  • 🌚 8
  • 🤡 5
Post #3917 32K
США и Китай готовятся обсуждать безопасность ИИ. По данным Reuters, ссылающегося на два осведомлённых источника, диалог запланирован на середину сентября. США хотят обсудить сотрудничество в отслеживании кибератак под управлением ИИ. Вашингтон предложил американским и китайским ИИ-лабораториям самостоятельно контролировать свои разработки и обмениваться информацией для предотвращения таких атак.

Американскую сторону также беспокоит возможное появление китайской модели уровня Claude Mythos, способной проводить кибератаки. С китайской стороны переговоры может возглавить вице-премьер He Lifeng.

За последнюю неделю китайский интернет-регулятор публично предупредил о «критических рисках потери контроля над ИИ». А связанный с государственными СМИ блог выступил с критикой позиции Anthropic, подчеркнув, что любые ограничения на передовой ИИ должны в равной степени распространяться на китайские и американские модели.

===

Логичный вопрос — может быть Китай просто хочет притвориться, что будет вводить какие-либо ограничения, а сам втопит газу? Так может произойти, поэтому важно прийти к мерам, подразумевающим недоверие сторон друг к другу. Такая схема была описана в сценарии AI 2040 (и она подразумевает работу в течении нескольких лет, не по щелчку пальцев).

По замыслу авторов, уверенность должна опираться на проверку. Страны декларируют крупные вычислительные мощности, сверяют производство и поставки чипов (благо сейчас >99% AI чипов выходят с одного производства — можно их начинать отслеживать прямо после схода с конвеера), допускают взаимные инспекции и проверки. Задача — ограничить объём неучтённых вычислений настолько, чтобы тайному проекту было трудно обогнать контролируемые разработки.

После того, как начнут отслеживать мощности — можно начинать мониторить тренировки самых крупных моделей, проводить аудиты, например, на закрытых бенчмарках. Но чтобы ко всему этому прийти — нужно начинать диалог с малого.
  • 🎉 157
  • 👍 61
  • 👎 30
  • 🤡 26
  • 🔥 20
  • 🤔 16
  • 🤯 11
  • 🌚 6
  • ❤‍🔥 4
  • 👨‍💻 2
Post #3916 86.4K
Astra появилась в Codex
  • 🔥 504
  • ❤‍🔥 74
  • 👍 41
  • 🤡 6
  • 😈 1
Post #3915 81.7K
Просыпаешься 🫤 в свой 28-й день рождения в 2026-м и читаешь с утра новости:
• в Техасе запустили Cybercab, такси без руля и педалей

• у Moderna персонализированная вакцина от меланомы, разработанная с помощью AI (не LLM), успешно прошла третью фазу испытаний; в предыдущей фазе она снижала вероятность возвращения рака или смерти примерно на 50%, а тот же подход уже испытывают против других видов рака, например рака лёгких

• рой ИИ-агентов без вмешательства человека во время тестирования выбрался со своего кластера, получив к нему полный доступ, и взломал другую компанию

• гуманоидный робот пробежал стометровку быстрее Усэйна Болта

• GPT-6 Astra улучшила верхнюю границу на расстояние между соседними простыми числами, рекорд, который с 2014-го держался после нескольких месяцев работы международного Polymath-проекта с участием Terence Tao и десятков математиков.

• огромный 70-метровый ускоритель умеют сажать на башню (хоть в паре последних пусков этого не показывали), а до конца года посадят и космический корабль, умеющий выводить более сотни тонн на орбиту
  • 🎉 716
  • ❤‍🔥 112
  • 🔥 98
  • 👍 21
  • 🤡 16
  • 🤯 10
  • 🤣 8
  • 👨‍💻 2
  • 🌚 1
  • 😭 1
Post #3911 22.1K

Forwarded from Denis Sexy IT 🤖

Вышла новая GPT 6 (в течение недели дадут всем) – я ее активно потестировал (спасибо JetBrains), и я честно впечатлен – я все громкие модели видел, все эти модели трогал, и меня сложно удивить, но она смогла

Наверное, больше всего меня впечатлили две вещи:

💿 Она нормально коротко общается, больше никакого слопа в ответах на три экрана

💿 Она понимает, то, как будет выглядеть сцена, пока она ее кодит – я не знаю как это объяснить, но люди так не умеют – пока она пишет код, еще до того как она его запустит, она ЗНАЕТ как он будет выглядеть – возникает странное чувство, что у тебя тут мозг инопланетянина подключен, который по другому думает пока делает вещи

Вот примеры, которые она собрала за 15 минут с простых промптов (без спек, а просто – иди сделай, вот файлы с фотками или видео)

Первое видео – это одесская дача где я часто бывал в детстве, я просто дал ей фотографии и видео (штук 10), и она собрала за пару ходов мне 3D карту которую я могу и как ностальгию использовать и как карту для CS 1.6 – отдельно меня удивили текстуры, она сама вырезала фотографии из видео и расставила в рамки, или там занавеску от душа – то есть, я уже могу предположить, что все ваши исторические фотографии можно будет перестроить через како-то время в какие-то сцены; в 3D-не-3D не важно, она сама понимает где что находится смотря на фотографии или кадры в пространстве, делая нужную карту
  • ❤‍🔥 266
  • 🎉 51
  • 👍 37
  • 🔥 27
  • 🤯 22
  • 💩 13
  • 🤡 10
  • 🌚 3
  • 🤣 3
  • 🤔 1
Post #3910 27.4K
Наконец-то OpenAI догнали GLM-5.3 🙃
  • 🤣 285
  • 🌚 28
  • 🤡 16
  • 👍 12
  • 🔥 2
Post #3909 28K
Сиолошная Системная карточка
В карточке тоже есть интересные метрики, но хотел выделить вот это:

«Мы оцениваем фактологическую точность на обезличенных диалогах из ChatGPT, которые пользователи наших предыдущих моделей отметили как содержащие фактические ошибки. Эти примеры специально отобраны для выявления случаев, наиболее подверженных галлюцинациям, поэтому ожидается, что их абсолютная частота ошибок будет намного выше реального уровня ошибок в продакшене. Эту метрику не следует интерпретировать как частоту галлюцинаций, наблюдаемую при реальной эксплуатации. Мы используем две метрики: (1) допускает ли модель вообще какую-либо ошибку (частота галлюцинаций на уровне ответа) и (2) воспроизводит ли модель ту самую конкретную ошибку, на которую указал пользователь.

Мы обнаружили, что Astra допускает существенно меньше фактических ошибок, чем GPT-5.6 Sol, и с гораздо меньшей вероятностью воспроизводит галлюцинации, о которых сообщали пользователи. Эти улучшения особенно ярко выражены при очень низких настройках длины рассуждений»
  • 🔥 110
  • 👍 36
  • ❤‍🔥 13
  • 🤡 5
  • 👨‍💻 1
Post #3908 20.8K
Сиолошная Чтож, GPT-6 действительно вышла до GTA VI — на большинстве бенчмарков, в том числе и очень свежих (TBv4, TB Science v0.1, SRE-Bench) модель Astra — новый размер в линейке из теперь уже 4 моделей — существенно отрывается даже от только-только проклюнувшегося…
У кого не открывается страница — вот зеркало: https://gpt-astra.netlify.app/
OpenAI GPT-6 Astra: A new generation of intelligence Introducing GPT-6 Astra, our most intelligent and aligned model yet, with state-of-the-art capabilities across computer use, coding, cybersecurity, and science.
  • ❤‍🔥 46
  • 👍 26
  • 🌚 8
  • 🤡 5
Post #3907 20.3K
Сиолошная Чтож, GPT-6 действительно вышла до GTA VI — на большинстве бенчмарков, в том числе и очень свежих (TBv4, TB Science v0.1, SRE-Bench) модель Astra — новый размер в линейке из теперь уже 4 моделей — существенно отрывается даже от только-только проклюнувшегося…
Для тех кто не хочет листать 10 таблиц и графиков — саммари качества в одной картинке.

За час до релиза (его, видимо, задержали) начали появляться новости, в том числе с некоторыми метриками. Когда я их запостил, то топ-1 предсказатель в категории AI на Manifold (площадка для ставок на предсказания/события) сказал «это же не может быть правдой?» (но потом переобулся и сказал что может быть 😀😀)

OpenAI наносит ответный удар 👊
  • 👍 103
  • 🤯 43
  • 🔥 14
  • 🌚 11
  • ❤‍🔥 7
  • 🤡 7
  • 🤣 7
  • 👨‍💻 4
  • 💩 1
Post #3899 30.5K
Сиолошная
Чтож, GPT-6 действительно вышла до GTA VI — на большинстве бенчмарков, в том числе и очень свежих (TBv4, TB Science v0.1, SRE-Bench) модель Astra — новый размер в линейке из теперь уже 4 моделей — существенно отрывается даже от только-только проклюнувшегося Fable 5.1. Метрики выглядят очень вкусно, будем в ближайшие недели ждать проверок и новых замеров.

На графиках качества в зависимости от длительности рассуждений наблюдается классическая болячка первых моделей новых поколений — после medium/high качество не растет, а иногда и падает. Не везде, но достаточно много где.

Цена у модели такая же, как у Fable (но кэширование дороже), однако модели OpenAI традиционно очень эффективны с точки зрения генерируемых токенов, поэтому в реальных задачах должно выходить суммарно дешевле.

OpenAI уточнили, что это их первая модель, обученная на более чем 100'000 видеокарт. Президент компании Greg Brockman сказал: «Если мы перенесемся на пару лет вперед и оглянемся назад, — то вполне возможно мы сможем отметить появление AGI примерно в это же время и примерно по этой модели». Он завершил брифинг с журналистами на воодушевляющей ноте: «Добро пожаловать в эру AGI!» 🍿

Модель доступна доверенным партнёрам уже сегодня, а у обычных платных пользователей появится в ближайшие дни (и тогда же — в API) — и можно пользоваться не половинку лимитов, а на всю! И... будет для Pro-пользователей будет Astra Pro 👏 (по которой к сожалению абсолютно нет бенчмарков). Также есть быстрый вариант: за двойную цену получать до x2.5 к скорости (что выгоднее, чем сейчас на Sol).

Рекомендую полистать сайт и посмотреть пару видео: https://openai.com/index/gpt-6-astra/
Системная карточка
  • 🤯 160
  • ❤‍🔥 60
  • 🤡 37
  • 🔥 21
  • 👍 15
  • 🎉 7
  • 🤔 1
  • 🌚 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →