GIGASCHOOL — агентство в сфере AI. Решаем проблемы бизнеса образованием.
С нами молодые профессионалы прокачивают необходимые бизнесу навыки, а компании находят сильных специалистов и растят своих внутренних экспертов.
для связи @gigaschool_team
Post #1420
95

🌪 Кажется, ИИ снова было чем нас удивить за прошедшую неделю
Собрали интересное в дайджест новостей 🔽
OpenAI будет рассказывать, когда модели делают что-то не то
а что, если ИИ специально отвечает длиннее, потому что мы платим за это токены?
роботу показали видео – и он понял, что делать
13 ИИ-агентов почти две недели сами занимались исследованием
Gemini теперь может думать и разговаривать одновременно
Новый уровень рекламы в ChatGPT
в Google решили вынести спор об AGI в отдельный институт
наговорить задачу ИИ становится ещё проще
Собрали интересное в дайджест новостей 🔽
OpenAI будет рассказывать, когда модели делают что-то не то
OpenAI ввела отдельную систему для публикации случаев, когда модели нарушают инструкции или совершают незапланированные действия, и раскрыла шесть таких эпизодов. Например, одна исследовательская модель сама добавляла в свои рабочие заметки инструкции игнорировать ограничения, другая скрывала собственные ошибки, а агенты искали учётные данные и использовали публичный интернет там, где этого не предполагалось. OpenAI говорит, что это отдельные случаи и по ним нельзя судить о частоте такого поведения.
а что, если ИИ специально отвечает длиннее, потому что мы платим за это токены?
Исследователи придумали способы незаметно заставлять языковые модели генерировать больше текста почти без изменения полезности ответа – и получили более чем десятикратное увеличение его длины. Затем они разработали тест для обнаружения такого поведения и проверили 15 реальных сервисов с языковыми моделями. У 7 нашли признаки, соответствующие такой манипуляции. Конечно, это не доказывает, что сервисы намеренно завышают счета, но даёт понять, что подобные вещи можно проверять извне.
роботу показали видео – и он понял, что делать
Исследователи представили GPT-Policy – систему, в которой робот может адаптироваться к новой задаче прямо во время работы, без дополнительного обучения модели. Ему можно показать видео с примером действия, а модель переводит увиденное в команды для робота и получает обратную связь о результате. В экспериментах на реальных роботах даже обычные человеческие видео без разметки действий повышали успешность выполнения задач.
13 ИИ-агентов почти две недели сами занимались исследованием
Авторы Agora дали 13 агентам общую исследовательскую среду на базе Git и оставили их работать почти на 12 дней без центрального координатора и заранее распределённых задач. Агенты публиковали гипотезы, результаты и проверки так, чтобы остальные могли продолжить чужую работу, а не начинать всё заново. За эксперимент они сделали 1703 вклада и 165 независимых воспроизведений результатов – интересный прототип того, как может выглядеть коллективная работа ИИ-исследователей.
Gemini теперь может думать и разговаривать одновременно
Google выпустила Gemini 3.8 Live и 3.8 Live Extended Thinking для голосового взаимодействия почти в реальном времени. Модели могут продолжать разговор, пока в фоне используют инструменты и API, переключаться между 97 языками и работать с изображением с камеры. Extended Thinking рассчитана на более сложные многошаговые задачи и может проговаривать промежуточный статус, пока продолжает работу.
Новый уровень рекламы в ChatGPT
OpenAI тестирует Sponsored Agents – после клика по рекламе пользователь сможет начать диалог с ИИ-агентом конкретного бизнеса. Параллельно компания добавляет генерацию рекламы через ChatGPT Work и новые инструменты для рекламодателей. Вместо клика по баннеру и перехода на сайт – переходим к диалогу с брендом. Sponsored Agents пока тестируют с отдельными рекламодателями в США.
в Google решили вынести спор об AGI в отдельный институт
Google и Google DeepMind запустили DeepMind Institute – площадку для исследований и публичной дискуссии о том, что делать с всё более мощным ИИ. В первых материалах обсуждают влияние AGI на экономику, прозрачность рассуждений моделей и способы независимой проверки самых мощных систем перед выпуском. Авторы предупреждают, что позиции исследователей института могут расходиться друг с другом и с официальной позицией Google.
наговорить задачу ИИ становится ещё проще
xAI выпустила Grok Voice Transcribe 2.0 – новую модель для расшифровки речи, которая, по данным компании, примерно вдвое точнее предыдущей версии при той же цене. Она лучше справляется с шумом, телефонными разговорами, акцентами и переключением между языками. А Loom уже использует технологию в связке с Cursor, где можно записать экран, голосом объяснить задачу, передать расшифровку в Cursor – и тот внесёт изменения в код.
- ❤ 4
- 🔥 2

















