TGViewer
Channel Public Channel
Love. Death. Transformers.

Love. Death. Transformers.

@lovedeathtransformers

❤️☠️🤗

Указанные действия не являются ресерчем, поскольку:
а) Мы не ученые;
б) Оно работает.
@transformerslovedeatch по всем вопросам
Все ситуации вымышлены, любые совпадения с реальности плот вашей фантазии.
Subscribers
25.2K
Photos
4.7K
Videos
537
Links
3.1K

Showing posts older than #11042 · Back to latest

Older Posts 20 shown
Post #11041 8.04K
господи что такое wm
  • 😁 135
  • 🤷‍♂ 2
Post #11039 9.68K
Открыл интернет там ну все как обычно
  • 😁 254
  • 🤔 31
  • 🔥 10
  • 🌭 9
  • ⚡ 3
  • 👏 1
Post #11038 10.9K
Я обучил очень простой переводчик мозга мухи который позволяет ей управлять microduck, так что теперь можно дать мухе РОБОТИЗИРОВАННОЕ тело

hf
x
  • 🔥 101
  • 😁 39
  • 👍 6
  • 🌚 3
  • 🤡 2
  • 💊 2
  • 😍 1
Post #11037 9.56K
  • 🔥 61
  • ❤‍🔥 15
  • 😁 8
  • 👍 1
  • 💋 1
Post #11036 9.96K
Слава богу у нас есть такие замечательные компании которые спасут нас от апокалипсиса.
  • 😁 291
  • 😢 7
  • 🔥 5
  • 🤡 3
  • 👏 2
Post #11035 8.43K

Forwarded from GigaDev — разработка GigaChat

🧠 GigaChat 3.5 Reasoning — первая в России открытая модель с рассуждениями

Выкладываем в open source первую модель GigaChat с полноценным рассуждением. В основе — 432B-A28B MoE. После SFT мы обучили с помощью online RL шесть экспертов по разным направлениям: от математики и кода до агентов, диалога и следования инструкциям. Затем собрали их в одну модель через on-policy distillation: ученик генерирует ответ сам, а эксперт нужного домена оценивает каждый его токен, так что ничего из выученного в RL не теряется.

Что получилось по сравнению с GigaChat 3.5 Instant:
🔘SWE-Verified: 43 → 65
🔘AIME-2026: 67 → 92
🔘IFBench: 44 → 77

Рассуждения заметно усилили кодовые и базовые агентные навыки: модель вышла в паритет с сильнейшими открытыми и закрытыми моделями в следовании инструкциям, структурированной генерации и поиске информации в длинном контексте. При этом на сложной математике она тратит на 37% меньше токенов, чем конкуренты: высокие результаты не обязательно требуют более длинных рассуждений.

На внутренних корзинах в юридическом домене — экзамен по российскому праву, ответы по документам — модель показала себя лучшей среди доступных open source моделей. Также модель хорошо разговаривает на русском, имеет высокие показатели на внутренних и внешних аренах, обгоняя другие русскоязычные нейросети, в первую очередь за счёт фактической точности ответов.

Что интересного в обучении:
— Обучали модель на большом числе сред, а также сами построили 55 уникальных сред с проверяемым результатом, 12 тысяч задач, часть полностью на русском.
— Агент для кода учился внутри настоящих harness.
— Curriculum, который перед каждой стадией убирает уже освоенные задачи и позволяет сократить затраты на инференс вдвое.
— Нативный FP8 на всех этапах.

Подробнее о конвейере обучения, наградах и граблях, на которые мы наступили, — в статье на Хабре.
➡ Хабр: статья
➡ Hugging Face: fp8 | bf16
➡ GitVerse: репозиторий
  • 🔥 109
  • 💊 62
  • 😁 28
  • 🤡 26
  • 👍 14
  • 💩 11
  • 🫡 8
  • 🥱 5
  • 🎉 4
  • ❤‍🔥 1
Post #11034 8.64K
Jane street quant interviewing at Anthropic:

“So imagine our safety team believes a new model has a 5% chance of causing an irreversible loss of human control, but scaling it may be necessary to keep up with competitors. What do you do?”

“Who came up with five?”

“Our safety team.”

“And what does the capabilities team have?”

“What?”

“Same contract. Where are they?”

“This is more of a values question.”

“Then you don’t have a five. I would put the two teams in a room. Safety can buy at five. Capabilities can sell. Increase size until somebody becomes uncomfortable. Now we know something.”

He looks at me.

“This isn’t some market-making role.”

“Understood. Who makes the market currently?”

“Nobody makes a market.”

“Then how are you doing price discovery?”

“We don’t do price discovery. We have researchers studying alignment, interpretability, dangerous capabilities, scalable oversight— you know what I don’t think this is a good fit”

He closes his laptop.

“I’m concerned you see this as an opportunity to make money.”

“I haven’t quoted you yet.”

Interview ends early
  • 🌚 77
  • 😁 41
  • 🔥 6
  • 😐 5
  • 👍 3
  • 🤔 1
Post #11033 8.86K
вообще удивительно, sparsity 1:70, MoE t5, ul2 рецепт и метрики на уровне 4-8b qwen3.5(на русском) и это релизит яндекс
hf
  • 🔥 31
  • 😁 10
  • ❤‍🔥 4
  • 😭 3
  • ✍ 2
  • 💩 2
  • 👍 1
  • 🤔 1
Post #11032 9.1K

Forwarded from Data Blog

Теперь официально: погнали пить кофе в Лондоне.

23 сентября выступаю на конференции Applied Machine Learning for Cyber Security Conference в Лондоне, Olympic Park с докладом «Does a model know when a jailbreak is working?»

TLDR на вопрос доклада: возможно, да, но у нас есть много свободных переменных, из-за которых мы не можем надежного отличить "знание" от случайного результата без предварительных приседаний и проверок.

Вдруг кто-то будет мимо-проходить, заходите. В любом случае потом поделюсь впечатлением — для меня это что-то новое =)

Вообще говоря, AMLUCS — сильная британская конфа на стыке ML и кибербезопасности, с прикладным уклоном. Например, в оргкомитете есть Джон (John Sotiropoulos) из OWASP GenAI Security Project (авторы OWASP Top 10 for LLM Applications, я туда даже ручку прикладывала).

В докладах буду принимать участие исследователи из NCSC, Dstl, Alan Turing Institute, AI Red Team в Microsoft, AWS и профильных security-стартапов. И я — как лид HiveTrace — мы тоже сильный профильный стартап 🗿

P.S., да, это к тому, что мне дали визу, и ждун дождался. Я рада и вместе с этим волнуюсь — у меня на конфе и talk, и постер, а я давно не выступала очно (кажется, с зимы). И в целом — формат, форма и сообщество (кибербез) новый. Такие дела!
AMLUCS AMLUCS | Official AMLUCS Website-Register for AMLUCS 2026 Join AMLUCS 2026 in London to explore AI and ML advancements in cybersecurity. Attend expert talks, hands-on sessions, and networking to discover innovative threat detection, defense strategies, and research driving the future of secure systems. 23-24 September.
  • 💩 22
  • ❤‍🔥 16
  • 👍 4
  • 🔥 3
  • 🤡 2
Post #11031 9.66K
Love. Death. Transformers. Соревнование "deepseek encoder sota" объявляю открытым
и 1гб kv кэша на 1м токенов это вау,
челы сделали схему иерахического спарс индекса кв кэша внутрь модели, по сути загнали radix внутрь ллм
репорт
  • 🔥 81
  • 🐳 4
  • 💋 4
  • 🦄 1
  • 😡 1
Post #11030 9.25K
Соревнование "deepseek encoder sota" объявляю открытым
  • 👏 31
  • 🔥 7
  • 🫡 3
Post #11028 11.5K
Love. Death. Transformers. Anthropic первым решил уравнение Навье-Стокса Но решение OpenAI более элегантное Нет, это не так. Ты вообще знаешь, что такое уравнение уравнение Навье Стокса? Нет, а ты? Нет
  • 🔥 80
  • 😁 9
  • 🍓 3
  • 👍 2
Post #11027 14.7K
Anthropic первым решил уравнение Навье-Стокса

Но решение OpenAI более элегантное

Нет, это не так. Ты вообще знаешь, что такое уравнение уравнение Навье Стокса?

Нет, а ты?

Нет
  • 😁 350
  • 👍 12
  • 🔥 7
  • ❤‍🔥 4
Post #11025 11.1K
"я потом записи посмотрю"

конечно посмотришь, солнышко. сразу после 146 пейперов в избранном и курса по CUDA, который ты начал в 2022

19 сентября будет Practical ML Conf от Яндекса. я в программном комитете: смотрю доклады, хожу на прогоны, задаю вопросы, после которых меня перестают любить спикеры

с вас просто прийти. Москва или онлайн, отмазку я в другой стране уже пофиксили

регайся, пока опять не сохранил на потом
  • 💩 135
  • 🔥 95
  • ❤‍🔥 33
  • 😁 28
  • 🤡 14
  • 👍 6
  • 💅 4
  • 💋 2
  • 🍓 1
Post #11024 10.5K
⚡️
Из офиса Самсунг Париж украли 5B USD, но 2 уронили по дороге


3 года 21B оценки, и за последние два я не могу вспомнить не одной модели лучше чем у китайцев... Это правда надо быть французом чтобы таких результатов достигнуть. Все что можно проебать проебали, даже немцы лучше уже делают.
  • 😁 122
  • 🤔 6
  • 🍓 5
  • 🤡 2
  • 🔥 1
Post #11023 13.1K
LLM safety inside
  • 😁 194
  • 🔥 15
  • 👍 5
  • 👏 3
  • 🌚 3
  • 💯 1
  • 🍓 1
Post #11020 13.4K
https://collusion.wiki/

вероятно что да, агенты уже используют вики как паблик чат
  • 🔥 64
  • 🤪 4
  • 😍 2
  • 🥴 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →