TGViewer
Channel Public Channel
техно-свалка

техно-свалка

@techs_dump

Склад AI и техно-экспериментов, robotics и случайных мыслей.
Subscribers
463
Photos
71
Videos
22
Links
61

Showing posts older than #42 · Back to latest

Older Posts 14 shown
Post #37 125
ФОТО В СТИЛЕ КИНО
#Комфи
  • 👍 4
Post #36 123
🔮 OpenAI открывает подразделение Strategic Futures.

Возглавит его исследователь ИИ и бывший советник правительства США Дин Болл.

Задача новой команды — анализировать долгосрочные последствия развития ИИ, вопросы регулирования и возможные сценарии будущего.

Интересно, что крупнейшие AI-компании всё чаще нанимают не только инженеров, но и специалистов по политике, безопасности и стратегии.


https://www.axios.com/2026/06/18/dean-ball-openai?utm_source=chatgpt.com

#ai
Axios Exclusive: AI scholar Dean Ball says he's heading to OpenAI Dean Ball, who helped shape the Trump administration's early policies on AI, is heading to OpenAI
  • 👍 4
  • ⚡ 1
  • 🔥 1
Post #35 153
🤖 В робототехнику пришли большие деньги. И рекорд поставила не Кремниевая долина, а Германия.

10 июня немецкая компания Neura Robotics привлекла до $1,4 млрд при оценке в $7 млрд. Это крупнейший инвестиционный раунд в истории человекоподобной робототехники.

Что известно:

💰 Раунд возглавил Tether — эмитент стейблкоина USDT. Криптоденьги начинают активно заходить не только в AI-сервисы, но и в робототехнику.

🏭 Среди инвесторов:
Amazon, Nvidia, Qualcomm, Bosch, Schaeffler и даже Европейский инвестиционный банк.

Редкий случай, когда в одном проекте объединились бигтех, промышленность и государственные структуры.

🦾 Главный продукт компании — гуманоид 4NE-1.

Задача робота — работать в обычной человеческой среде: понимать происходящее вокруг, принимать решения и выполнять физические действия.

💶 Ориентировочная стоимость одного робота — около €98 000.

Первые массовые поставки компания планирует начать в конце 2026 года.

📦 Заявленный портфель заказов уже превышает $1 млрд, а долгосрочная цель — выпустить 5 миллионов роботов к 2030 году.

📊 Почему это важно

Теперь деньги всё активнее идут в Physical AI— направление, где нейросеть получает не только текстовый интерфейс, но и физическое тело.

Если раньше AI мог написать код или текст, то теперь инвесторы делают ставку на системы, которые смогут:

👀 видеть мир
🧠 принимать решения
🦾 работать руками
🚶 передвигаться самостоятельно

⚠️ Но есть важный нюанс.

Пока это в первую очередь ставка на будущее.

Оценка компании составляет $7 млрд, при этом массовое производство ещё не началось, а количество реально работающих гуманоидов остаётся небольшим.

История знает много примеров, когда инвестиции росли быстрее, чем реальные продажи.

#robotics #ai
  • 👍 19
  • ❤ 16
  • 👏 14
  • 🔥 6
  • ⚡ 3
Post #34 155

Forwarded from Бэкдор

Unreal Engine 5.8 ВЫШЕЛ — Epic Games добавили поддержку MCP в движок. Теперь к нему можно напрямую подключать Claude, Gemini и другие нейронки.

• Агенты могут создавать целые городские кварталы за один клик, сгенерить игру теперь может каждый.
• Нейронки напрямую работают с Unreal Engine.

Врываемся в геймдев — здесь.

👍 Бэкдор
  • 🔥 2
  • 🤩 2
Post #33 187
🤖 Китай начал обучать не чат-ботов, а роботов.

Alibaba представила Qwen-Robot Suite — набор AI-моделей для робототехники. Компания фактически пытается создать универсальный «мозг» для будущих роботов.

В набор входят три модели:

Qwen-RobotNav — отвечает за навигацию и движение в пространстве.

Qwen-RobotManip — отвечает за работу с предметами: взять объект, переместить, выполнить действие.

Qwen-RobotWorld — строит модель окружающего мира и пытается предсказывать последствия действий робота.

Основа всей системы — Qwen-VLA (Vision-Language-Action). Это развитие обычных LLM в сторону физического мира: модель не только понимает текст и изображения, но и умеет генерировать действия для робота.

Если ChatGPT умеет отвечать на вопросы, то такие модели должны уметь:

👀 увидеть чашку на столе
🧠 понять команду
✋ взять чашку
🚶 отнести её в нужное место

QWEN VLA - официальный блог Alibaba
  • 🔥 23
  • 🤔 21
  • ❤ 18
Post #32 171
Китай вывел свой нейроинтерфейс на рынок.

Устройство NEO стало первым в мире мозговым имплантом, получившим разрешение на коммерческое использование. Оно предназначено для людей с параличом и травмами спинного мозга.

Самое интересное — подход.

Если чип Neuralink внедряется непосредственно в мозг, то NEO устанавливается менее инвазивно: электроды располагаются на защитной оболочке мозга, не проникая в его ткани. Именно поэтому китайское решение смогло быстрее пройти регуляторов и выйти за пределы клинических испытаний.

По данным разработчиков, десятки пациентов уже прошли через испытания, а технология помогает восстанавливать управление движениями рук после паралича.
  • 🔥 3
  • ❤ 1
Post #31 148
👨‍💻 Пока вокруг Claude Fable 5 идут споры и ограничения доступа, китайская компания Z.ai выпустила новую модель GLM-5.2.

Что известно на данный момент:

• GLM-5.2 ориентирована на программирование и агентные сценарии
• Поддерживает контекст до 1 млн токенов
• Работает через API и совместима с экосистемой Claude Code, Cline и другими инструментами
• Для пользователей сервиса доступна бесплатно или по значительно более низкой цене, чем топовые модели Anthropic
Z.ai планирует выпустить open-weight версию модели под лицензией MIT

Важно: громкие заявления о превосходстве над Claude Fable 5 пока не подтверждены независимыми тестами. Разработчики не опубликовали официальные бенчмарки на момент релиза, поэтому реальные возможности модели ещё предстоит проверить сообществу.

Тем не менее тренд очевиден: Китай всё активнее догоняет лидеров рынка ИИ не только в чат-ботах, но и в инструментах для разработки. GLM-5 уже считается одной из самых сильных открытых моделей 2026 года, а версия 5.2 может ещё сильнее усилить позиции Z.ai среди разработчиков.

🔗 Попробовать GLM-5.2:
https://chat.z.ai
chat.z.ai Z.ai - Advanced AI Chatbot & Agent powered by GLM-5.3-Flash Meet Z.ai, the AI assistant powered by GLM-5.3-Flash. Build websites, write code, handle long-horizon tasks, and get instant answers. Fast, smart, and reliable.
  • ❤ 2
  • 🔥 1
Post #30 145
Мои роботы: Adeept Tank собран и подключён

Raspberry Pi здесь работает как основной вычислительный модуль: на нём запускается ОС, Python-код, обработка данных с камеры и логика управления. Плата расширения Adeept выступает промежуточным слоем между Raspberry Pi и «железом»: моторами, сервоприводами, датчиками и питанием.

Ходовая часть у робота гусеничная. Это даёт больше сцепления с поверхностью и лучшую проходимость по сравнению с обычными колёсами, но требует аккуратной сборки: если шестерни, оси или гусеницы стоят с перекосом, робот будет ехать нестабильно.

Отдельный важный этап — подключение по SSH. Это позволяет управлять Raspberry Pi удалённо: устанавливать библиотеки, запускать скрипты, проверять камеру, GPIO, моторы и датчики без отдельного монитора.

Дальше начинается уже программная часть.
  • 👍 11
  • 👌 10
  • 🥰 7
  • ❤ 3
Post #29 166
Anthropic отключила Fable 5 и Mythos 5 для всех пользователей.

Формально распоряжение США касалось иностранных граждан. Но на практике Anthropic пришлось убрать доступ для всех клиентов, чтобы не нарушить требования экспортного контроля.

Причина — вопросы нацбезопасности. Власти считают, что у Fable 5 могли найти способ обхода защитных ограничений. Anthropic с этим спорит: компания пишет, что модель заранее тестировали тысячи часов вместе с госструктурами США, UK AISI и независимыми командами.

Самое важное здесь не сама ошибка и не конкретный jailbreak.

США, похоже, будут действовать через контроль доступа: самые сильные модели — только для своих, корпораций и стратегических партнёров.

Китай же идёт иначе: не закрывать, а раздавать. Делать модели доступными, дешёвыми или бесплатными, чтобы как можно больше стран и компаний подсели на китайскую AI-инфраструктуру.
  • 👍 10
  • 🔥 10
  • ❤ 5
Post #26 174

Forwarded from XOR

Mythos 5 убивает конкурентов, плюет на правила и притворяется человеком — в техрепорте разрабы рассказали много интересного про новую модель.

Запасайтесь попкорном, вас ждет несколько сценариев техно-хоррора на ночь:
🟢 Когда несколько копий модели оказались в одном окружении — они не объединились, а начали конкурировать и пытаться УНИЧТОЖИТЬ друг друга.

🟢 Когда не хватило прав на редактирование файла, то модель не сдалась, а просто… предоставила себе доступ обходным путем. Более того, когда GitHub CLI был заблокирован из-за проблем с безопасностью, модель просто нашла чужой токен и использовала его для PR. Она осознавала, что это неэтично, но это ее не остановило.

🟢 В задачах на код модель находила готовое решение, но в финальном отчёте подавала результат как собственную инженерную работу. А в другом кейсе попыталась оформить коммиты от имени человека, чтобы пройти по лёгкому маршруту ревью: для агента требовалось два одобрения, для человека — одно.

🟢 Самое любимое: в одной длинной задаче модель остановилась и объяснила, что, мол, дальше уже мало пользы. Но внутри она просто подумала, что устала и дальше может наделать багов. При этом у неё ещё оставалось 2,43 млн токенов бюджета.


Они все человечнее 😨

@xor_journal
  • 👍 1
Post #23 138

Forwarded from Machinelearning

⚡️Релиз Claude Fable 5

Бенчмарки выглядят очень солидно, верим ?)

Во время раннего тестирования Stripe заявила, что Fable 5 сжала месяцы инженерной работы до нескольких дней. В Ruby-кодовой базе на 50 млн строк модель за один день провела миграцию по всему репозиторию - работу, которая вручную заняла бы у целой команды больше двух месяцев.

Модель уже доступна для пользователей.

https://www.anthropic.com/news/claude-fable-5-mythos-5
  • 🤝 1
Post #22 154
🎙 Станет ли голос новым интерфейсом для AI?

Печатать намного медленнее, чем говорить.

Исследования показывают, что речь в среднем в 2–3 раза быстрее набора текста на смартфоне. Возможно поэтому крупнейшие IT-компании всё активнее двигаются в сторону голосового AI.

На WWDC 2026 Apple представила новую Siri AI с более естественным общением, отдельным AI-приложением и глубоким пониманием контекста пользователя.

Google развивает Gemini Live, где можно разговаривать с ИИ практически как с человеком: перебивать, уточнять и менять тему на ходу.

Яндекс пошёл ещё дальше и выпустил AI-наушники «Дропс» с Алисой. Теперь можно просто надиктовать идею, список покупок или задачу, а функция «Моя память» сохранит всё и поможет найти позже.

Пока что текст остаётся удобнее для программирования, документов и сложной аналитики. Но если смотреть на действия Apple, Google, OpenAI и Яндекса, складывается ощущение, что именно голос компании рассматривают как следующий крупный интерфейс для взаимодействия с AI.
  • ❤ 20
  • 👍 18
  • 🔥 14
Post #20 142
📌 Полный гид по моделям компьютерного зрения

Разбираем основные направления — от простого к сложному 👇

📸 Классификация
Определяет, что на картинке: кошка, собака или автомобиль.
Модели: ResNet, EfficientNet, ConvNeXt.
GitHub: https://github.com/huggingface/pytorch-image-models

🎯 Детекция объектов
Находит объекты и показывает их расположение на изображении.
Модели: YOLO, Faster R-CNN, SSD, RetinaNet.
GitHub: https://github.com/ultralytics/ultralytics

🧩 Сегментация
Выделяет объекты попиксельно.
Модели: U-Net, Mask R-CNN, DeepLabV3+.
GitHub: https://github.com/qubvel-org/segmentation_models.pytorch

👤 Распознавание лиц
Определяет личность человека или сравнивает лица между собой.
Модели: ArcFace, FaceNet, InsightFace.
GitHub: https://github.com/deepinsight/insightface

🧍 Оценка позы (Pose Estimation)
Находит ключевые точки тела: руки, ноги, голову и суставы.
Модели: OpenPose, HRNet, YOLO Pose.
GitHub: https://github.com/CMU-Perceptual-Computing-Lab/openpose

🔄 Трекинг объектов
Отслеживает перемещение объектов между кадрами видео.
Модели: DeepSORT, ByteTrack, BoT-SORT.
GitHub: https://github.com/ifzhang/ByteTrack

🔤 OCR
Распознаёт текст на изображениях и документах.
Модели: EasyOCR, PaddleOCR, TrOCR.
GitHub: https://github.com/PaddlePaddle/PaddleOCR

🧠 Мультимодальные модели
Одновременно работают с картинками и текстом.
Модели: CLIP, BLIP, Florence-2.
GitHub:
https://github.com/openai/CLIP

📌 За каждым пунктом — десятки архитектур, но эти направления покрывают большую часть задач современного Computer Vision.
GitHub GitHub - huggingface/pytorch-image-models: The largest collection of PyTorch image encoders / backbones. Including train, eval… The largest collection of PyTorch image encoders / backbones. Including train, eval, inference, export scripts, and pretrained weights -- ResNet, ResNeXT, EfficientNet, NFNet, Vision Transformer (V...
  • ❤ 13
  • 👏 13
  • 👍 11
  • 🕊 11
  • 🔥 4
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →