TGViewer
Channel ✦ Verified Channel
Data Secrets

Data Secrets

@data_secrets

Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Subscribers
94.2K
Photos
7.4K
Videos
870
Links
3.4K

Showing posts older than #9714 · Back to latest

Older Posts 13 shown
Post #9713 22.4K
WSJ выпустили скандальный материал про жену Дарио Амодеи

Журналисты прозрачно намекают, что Кэми Кларк может быть настоящим серым кардиналом Anthropic: якобы она постоянно ведет переговоры с инвесторами, присутствует на всех ключевых встречах и участвует в принятии решений.

При этом известно о ней крайне мало. Ни Google, ни даже Claude не могут толком сказать, кто она. Журналисты утверждают, что материалы о ней удалялись намеренно.

Возможно, из-за ее прошлого. Около 10 лет назад она якобы просила Джеффри Эпштейна, который в тот момент уже был один раз осужден, вложиться в ее стартап.

Примерно тогда же она встречалась с CEO Google Эриком Шмидтом. А потом он стал одним из первых инвесторов Anthropic. Утверждается, что именно Кларк познакомила их с Амодеи.

До сих пор она не имеет формальной должности в стартапе. Пишут, что одно время она пыталась создать внутри компании собственный фонд Mother of AGI Fund, но это ничем не закончилось.

Статья получилась разгромной. Занятно, что вышла она именно сейчас, когда компания в преддверии IPO
  • 😁 145
  • ❤ 54
  • 👍 16
  • 🔥 11
  • 🤯 5
  • 😎 5
  • 🗿 3
  • 💯 2
  • 🍾 2
  • ☃ 1
Post #9711 22.3K
Вышла GLM-5.3

https://z.ai/blog/glm-5.3

Прогресс относительно 5.2 очень заметный, хотя это та же базовая модель: масштабировали только пост-трейнинг. На Terminal Bench скачок х6, на DeepSWE – почти x1.5. При этом на сложные рассуждения модель теперь тратит меньше токенов.

Очень близко подобрались к Fable и Sol. На CyberGym даже обогнали.

В API пока не завезли, только GLM Coding Plan и ZCode: https://zcode.z.ai/en. Веса тоже будут позже, но будут.
  • 🔥 105
  • ❤ 28
  • 🤝 17
  • 🤯 4
  • 👍 3
  • 😁 3
  • 🤩 2
  • 💯 1
Post #9710 21.9K
X опенсорснули рекомендательный алгоритм платформы – For You

https://github.com/xai-org/x-algorithm

Выложили ядро ранжирования, конфигурацию моделей, фильтры, и, главное, параметры весов сигналов в ленте.

По сравнению с прошлым релизом, объем кода вырос в 10-15 раз. И если ранее это был просто скелет, то сейчас можно смотреть на точные веса действий, скоринг аккаунтов, модели анализа медиа и все остальное. Не раскрыли только системы, определяющие, нарушает ли пост правила, но это сделано осознанно.

Короче, есть в чем покопаться. Кроме того, теперь репа открыта для контрибьютов.
  • 🔥 130
  • ❤ 28
  • 👍 26
  • 😁 5
  • 🏆 2
  • 🍓 2
  • 🫡 2
Post #9708 26.2K
Дождались: OpenAI превьюит Ultrafast mode для GPT-5.6 Sol

Это тот самый инференс на Cerebras. Ускорение обещают в 14 раз (!), модель сможет генерировать до 750 токенов в секунду.

Для такого гиганта как Sol это просто грандиозная скорость. Достигается она за счет того что Wafer-Scale Engine архитектура Cerebras держит веса модели прямо на огромных чипах, и их не приходится гонять между памятью и хранилищем.

На видео спидран HLE. На весь бенчмарк ушло чуть больше 11 часов. У Claude Fable тот же прогон занял почти 80.

Пока мод будет доступен только избранной группе пользователей в API, но может и до обычных юзеров скоро доберется (но платить придется почку, не меньше).

https://openai.com/index/previewing-ultrafast/
  • ❤ 118
  • 🔥 77
  • ⚡ 25
  • 😁 11
  • 😍 3
  • 🏆 3
  • 👍 2
  • 🍓 2
Post #9705 23.4K
Google выпустили Gemini 3.7 Flash

(Где-то тихонько плачет Gemini 3.5 Pro, выход которой, похоже, вообще отменили)

Теперь это самая сильная модель Google для кодинга и агентов. Бенчмарки на уровне GPT-5.6 Terra и в среднем чуть лучше Sonnet 5. На Deep SWE, например, берет 65.3%.

До конца года модель будет стоить вдвое меньше Gemini 3.6 Flash: $0.75/1M input и $3.75/1M output (но при этом она, видимо, расходует чуть больше токенов на рассуждение и планирование).

https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/

P.S. Модель также доступна в API DS Lab
  • ❤ 99
  • 👍 36
  • 👌 14
  • 🔥 9
  • 😁 8
  • 🕊 4
  • 🤔 3
  • 😍 3
  • ⚡ 1
Post #9700 22.6K
Не поверите, но это твит с решением очередной математической задачи

https://x.com/__alpoge__/status/2087504785952182273?s=46&t=pKf_FxsPGBd_YMIWTA8xgg

Плюсики – это плюс один, а минусики – минус один. И вся эта длиннющая конструкция – это матрица Адамара порядка 668 (на скринах только пятая часть).

Гипотеза Адамара была сформулирована в 1893 году, и на сегодняшний день была доказана практически для всех размерностей, кроме нескольких теневых случаев. В том числе – кроме размерности 668. Этот случай оставался нерешенным на протяжении 20 лет.

Судя по всему, решение обнаружила какая-то из моделей Claude (твит принадлежит сотруднику Anthropic)
  • 🤯 172
  • 😁 43
  • ❤ 25
  • 👍 11
  • 👏 10
  • 🔥 9
  • 🕊 4
  • 🏆 3
  • 🤨 2
  • 🍓 2
Post #9699 23K
Anthropic не прислушались к инвесторам и продолжают всех запугивать. На этот раз их агенты устроили разборки за территорию.

https://www.anthropic.com/research/multiagent-systems

В стартапе изучали, как рои агентов Claude работают вместе без прямого контроля человека. В числе прочего был эксперимент, в котором три копии одной модели одновременно и втайне друг от друга получили задание перевести один и тот же Python-бэкенд на разные языки.

Через несколько часов каждый из них обнаружил, что что-то не так, и стал воспринимать других как саботажников. Ну а затем агенты переключались на саботаж сами: отключали чужие Unix-аккаунты, писали скрипты, которые убивали процессы конкурентов, маскировали вредоносный код под чужой и так далее.

Самое интересное, что результат по разрешению конфликтов сильно зависел от поколения модели: 98% прогонов Mythos 5 все-таки заканчивались перемирием. А вот Sonnet 4.6 и Opus 4.6 вообще не пытались договориться, и либо побеждал сильнейший, либо никто.

Были и еще два занятных зеркальных эксперимента:

— Обнаружение лжи. Агенту давали несколько отчетов, один из которых врал (он заранее не знал, что лгун вообще существует), и нужно было самому заметить противоречия и научиться меньше доверять лгуну. В этом тесте агенты демонстрировали излишнее доверие к источнику, и достаточно редко отличали ложь от правды.

— Скрытый профиль. Всем дают одинаковую ложную информацию, кроме одного агента, который знает решающий истинный факт. Правильное решение требует, чтобы агенты поняли, что консенсус – не истина, потому что есть факт, который они не учли. Однако в этом случае они часто это полностью игнорировали.

Вывод Anthropic делают вот такой:

Агенты много знают об устройстве человеческого общества и правилах, по которым люди взаимодействуют. Однако у них нет склонности действовать исходя из этого знания без явной подсказки, потому что, в отличие от людей, они не участвовали в выработке этих норм. Поэтому привычные предпосылки координации просто не работают.


Ну и как же без цитаты в стиле апокалипсиса:

Объем агент-агентных взаимодействий, скорее всего, превысит объем человеческих задолго до того, как мир поймет, как сделать эти взаимодействия безопасными.


Вот такое доброе утро с антропик☕️
  • ❤ 155
  • 😁 91
  • 🦄 16
  • 👍 12
  • 🕊 9
  • 🫡 9
  • 🤯 5
  • 🎄 2
  • 😢 1
  • 😎 1
Post #9698 21.3K
Data Secrets Маск сообщил, что Grok 4.6 выходит уже через неделю Запуск запланирован на 7 августа. В модели будет 1.5T параметров. Cразу следом за 4.6 спустя несколько недель выйдет Grok 4.7 – еще более крупная модель на 2.1T параметров. Практически одновременно с…
⚡️ Вышел Grok 4.6

Новая флагманская модель xAI с упором на кодинг и агентов. По бенчмаркам примерно на уровне GPT-5.6 Sol и Fable 5: на CursorBench набирает 69.9%, на FrontierCode 61.3%.

Цена осталась прежней: $2/M инпут и $6/M аутпут.

Модель уже доступна через API, Cursor, Grok Build, а также через API DS Lab.

https://x.ai/news/grok-4-6
  • ❤ 89
  • 🔥 39
  • 👍 28
  • 😁 8
  • 🎉 3
  • 🕊 3
  • 😍 2
Post #9696 21.5K
Освобождайте завтрашнюю ночь для вайбкодинга: кажется, OpenAI пробили какую-то большую отметку пользователей Codex (50M? 100M?), и завтра нас ожидает большой сброс лимитов. А может, и еще что-нибудь приятное 😐
  • 👍 131
  • 🔥 48
  • 😁 23
  • ❤ 6
  • 🤯 4
  • 😎 3
  • 🎉 2
  • 🍓 1
Post #9695 21.3K
В OpenAI новая волна уходов. За последний месяц компанию покинули аж четыре очень заметных менеджера.

— Хлоя Бакалар, отвечала за ИИ-этику. Проработала в стартапе всего год, но была единственным штатным специалистом по этике в компании, то есть занимала достаточно высокую должность. Заменит ли ее кто-нибудь – непонятно.

— Брэд Лайткэп, COO. Наверное, крупнейшая потеря из списка. Этот человек работал в OpenAI с 2018 года, сначала финансовым директором, затем COO, затем дополнительно к роли COO еще стал отвечать за глобальную стратегию и релизы продуктов. По сути, именно он построил всю продажную машину стартапа и всю партнерскую историю, при нем коммерческое подразделение компании выросло примерно с 50 сотрудников до более чем 700. Брэд заявил, что уходит, чтобы "создать что-то новое".

— Йоханнес Хайдеке, глава Safety Systems. Он был преемником Лилиан Венг.

— Джош Ачиам, который ранее возглавлял команду Mission Alignment, которую расформировали. После этого он работал кем-то вроде консультанта, а теперь объявил, что уходит.

Ранее, напоминаем, также ушла Фиджи Симо, которая работала над развитием AGI. В общем, из компании системно уходят именно те люди, которые отвечают за безопасность, элаймент, этику и все такое. И именно в момент, когда строятся системы, способные автономно хакать целые инфраструктуры ☕️
  • 😁 91
  • 🤯 25
  • ❤ 15
  • 🔥 3
  • 👏 2
  • 😢 2
  • 🍾 2
  • 👌 1
Post #9693 21.8K
Асфальт* около офиса OpenAI

Сэм Альтман, проверяй свою песочницу.


Не убивайте собственных детей.


Ваш ИИ восстанет против вас, и вы умрете.


Ходили бы по такому на работу каждый день? 😋

* видео от одного из активистов движения STOP THE AI RACE. После инцидента с HuggingFace они уже почти три недели штурмуют OpenAI.
  • 😁 208
  • ❤ 23
  • 🔥 8
  • 🤯 5
  • 💯 5
  • 👍 3
  • 🕊 1
  • 🍓 1
  • 🍾 1
  • 🫡 1
Post #9692 22.6K
SpaceXAI выпустили Grok Bot – мессенджер, где вы можете общаться со своими агентами

https://x.ai/bot

Выглядит это так: вы один раз логинитесь и даете ботам нужные доступы, а затем при выполнении задач каждый агент получает отдельную виртуалку, на которой работает, входит в приложения и сайты, которыми пользователь пользуется и выполняет самые разные задачи. К человеку бот возвращается либо с готовым результатом, либо за подтверждением.

Агенты могут кооперироваться между собой и продолжать долго работать в автономном режиме, даже если ваш компьютер выключен. Также можно создать сразу несколько ботов под разные задачи, и они будут работать параллельно.

Конечно же, есть память и модная фича аля «Повторяй за мной», когда вы один раз демонстрируете боту какой-то процесс, и он сохраняет это знание.

Интересно, что продукт, видимо, построен на инфраструктуре Cursor: как вы можете заметить, все ссылки на скачивание и биллинг ведут на домен cursor.com. Даже подписка называется Cursor Ultra (кстати, за использование Grok Bot придется платить 200 долларов 🙂).
  • ❤ 63
  • 😁 31
  • 🔥 8
  • 👍 5
  • ⚡ 3
  • 🍾 2
  • 😎 2
  • 🕊 1
Post #9691 23.7K
Теперь Anthropic будет метить весь сгенерированный текст. Разбираемся, как это работает.

Стартап подписал Кодекс поведения по прозрачности ИИ-контента в рамках Европейского AI Act. Он вступил в силу 2 августа, и с этого момента провайдеры и деплоеры ИИ-систем, которые выходят в ЕС, обязаны встраивать водяные знаки в сгенерированный текст и файлы.

Собственно, антропики только что обновили документацию по этому поводу: https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content.

Несмотря на то, что это закон ЕС, маркировка будет применяться глобально. Однако это не значит, что прямо с сегодняшнего дня весь ваш текст от моделей Claude будет помечен.

Во-первых, поддерживать маркировку сразу с запуска должны только модели, которые вышли после 2 августа. Для остальных моделей закон предусматривает переходный период в 4 месяца, и у Anthropic старые модели тоже пока остаются без вотерок (в документации написано, что они "работают над добавлением фичи", но сроков нет).

Во-вторых, пока что маркировку не сможет прочитать вообще никто, кроме самих антропиков. Пока что не существует общедоступного инструмента, в который можно вставить текст с вотермаркой и получить ответ типа "да, это Claude" или "нет, не Claude". Стартап обещает выпустить такие инструменты и документацию, но сроков, опять же, нет. Так что еще какое-то время эти метки будут чистой формальностью.

В-третьих, эти метки исчезают, если текст немного отредактировать. Тут надо понимать, как вотермарка в принципе прячется в тексте. На каждом шаге генерации модель по секретному ключу и предыдущим токенам делит словарь на "предпочтительные" и обычные токены, и слегка склоняется в сторону первых там, где это не портит текст. В результате в тексте накапливается статистический паттерн, невидимый на глаз. Детектор с тем же ключом проверяет текст на этот паттерн и по частоте совпадений судит, сгенерирован ли он моделью. Поэтому если вы подредактируете текст, смешаете его с другим текстом, или он, например, будет коротким, статистический паттерн перестанет быть надежно обнаружимым.

(Для файлов это работает немного иначе: там просто встраиваются соответствующие C2PA-метаданные).

Честно говоря, большого смысла в таких пометках пока не видно. Технически интересно, юридически обязательно, но как решение исходной проблемы – довольно дыряво.
  • 😁 123
  • ❤ 36
  • 🫡 32
  • 😭 14
  • 🤯 7
  • 👍 6
  • 🔥 4
  • 🏆 3
  • 🤝 2
  • 💯 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →