TGViewer
Channel Public Channel
Канал Никиты из IT

Канал Никиты из IT

@niar42

Строю ИИ-продукты и показываю, как новые инструменты меняют разработку, бизнес и IT

→ 6 лет в ИИ-продуктах и 8 в коммерции
→ Живу в Бразилии, родом с Дальнего Востока

Личка — @niarkh
Сайт — niar42.com

Фаундер — https://isty.ist/
CCO — three-sisters.ru
Subscribers
2.43K
Photos
134
Videos
54
Links
163

Showing posts older than #253 · Back to latest

Older Posts 17 shown
Post #251 1.04K
Бытовая грамотность вайбкодера.
Часть 1/2

Порог входа в создание приложений сейчас смешной. Открыл Codex или Claude Code, написал «сделай сервис» — получил результат. Но рано или поздно начнётся:
package.json, .env, docker-compose.yml, git push, DNS, VPS, nginx, logs.

В общем, чтобы что-то нормальное сделать, мало грамотно поставить задачу нейронке — надо хотя бы примерно понимать среду, в которой живёт код.

Начну с того, что под рукой каждый день

1⃣ Из чего состоит приложение

Почти любая аппка от сайта до игры — это несколько частей:
— интерфейс: то, что видит пользователь;
— роуты/API: точки, куда уходят запросы;
— база данных: где лежат заявки, юзеры, товары;
— логика: правила, по которым всё работает.

Пользователь нажал кнопку → интерфейс отправил запрос в роут → роут проверил данные, сходил в базу, вернул ответ.

Понимая это, задачу агенту ставишь конкретнее: «хочу такое-то приложение, давай подумаем сначала над интерфейсом, потом над БД и роутами». Качество ответа сразу растёт.

2⃣ Markdown и текстовые файлы

ТЗ, README, документация, конфиги живут в .md, .json, .yaml, .env.

Markdown освой первым: на нём удобно писать задачи агенту и он лучше их воспринимает. Минимум — заголовки, списки, ссылки, кодовые блоки, таблицы.

3⃣ Редактор

VS Code, Cursor, Windsurf — любой, где открываешь проект целиком, ищешь файл по названию, видишь структуру папок и запускаешь терминал. Работать через один файл в блокноте — быстрый путь к хаосу.

4⃣ Терминал и npm

Агент сам ставит зависимости, читает логи, чинит ошибки почти без тебя. Но смысл происходящего надо понимать:

— npm install — ставит зависимости проекта;
— npm run dev — запускает проект для разработки;
— npm run build — собирает финальную версию (заодно покажет, есть ли ошибки).

Прям наизусть не обязательно. Но нужно понимать, что агент сейчас делает, и уметь самому выполнить базовое, хотя бы запустить приложение.

5⃣Git и GitHub

Git — это сохранения в игре. Сломал нейронкой — откатился на рабочую версию.
GitHub — место, где проект живёт, обновляется и передаётся другому человеку или агенту.

Минимум: commit, push, pull, branch, diff. Хороший уровень — попросить агента оформить изменения отдельным коммитом.

***

В один пост всё не влезло, нужен второй. Там про то, как вывести проект в интернет и не спалиться.

Так что если зашло — накидайте 50 реакций, и выложу вторую часть =)
  • 🔥 68
  • ❤‍🔥 15
  • 🌭 11
Post #250 996
3 новости за неделю и все про ИИ-агентов

1. Deepseek v4 pro стал дешевле на 75% по Api

Я вшил в свой VS-Code, получилось что-то около 1000 строк кода ниже-среднего качества за 30 рублей. Это очень дёшево. Например Opus бы забрал у меня ≈900 рублей за такое, хотя качество было бы выше.

цена — $0.83 за вывод

Использовать буду в исключительных случаях, когда основные лимиты закончатся.

2. Claude и Codex работают сутками

Появилась такая фича — goals. При её включении агент работает до тех пор, пока его результат не будет соответствовать описанным критериям

Например:
→ в разработке — фикси баги, пока не пройдут все тесты
→ или в коммерции — проверь вручную 100% сделок в CRM и составь список потенциальных продаж с комментарием

3. В Cursor появился Composer 2.5

Это модель для написания кода. По бенчмаркам на 3-м месте после GPT и Opus, но она дешевле их в 11 раз! Стоимость — $2,5 за вывод + включена в базовую подписку.

В работе ещё не пробовал, но звучит хорошо.
  • 🔥 17
  • 🦄 9
Post #249 1.11K
  • 🔥 2
  • 🗿 2
Post #247 1.29K
ИИ сейчас где-то в районе интернета 2007 года

На первой картинке — оценка за февраль 2026.
На второй — май 2026.

Цифры с кучей допущений, но:

→ пользователей бесплатных ИИ-чатов стало 1.75 млрд вместо 1.3 млрд
→ платящих за ИИ по $20/мес — около 60 млн вместо 15–25 млн
→ пользователей кодинг-агентов — около 10 млн вместо 2–5 млн
→ доля людей, которые напрямую не пользовались ИИ, упала с 84% до 78%

Мы всё ещё в самом начале

Легко залипнуть в серую зону: почти 80% мира ещё не пробовали ИИ напрямую. Однако базовый ИИ уже стал массовым, а платное и глубокое использование только начинается.

Спросить что-то у нейронки — низкий порог. Моделей много, они встроены в поиск, телефоны, мессенджеры. Моя бабушка уже ими пользуется. Базовый чат спокойно уходит в быт.

А вот между «иногда спросить» и «реально работать через ИИ» — огромный зазор. Именно поэтому 10 млн пользователей кодинг-агентов — самая интересная цифра на всей картинке.

Codex, Claude Code, Antigravity — это совсем другой режим. Человек отдаёт модели файлы, контекст проекта, ошибки, рабочую папку, доступ к своим системам. И получает обратно выполненную часть задачи. Или вообще новый продукт.

Похожая стадия была у интернета в 2007

Google, YouTube, соцсети уже большие, а огромная перестройка продаж, медиа, найма и работы — впереди.

При этом интернету нужно было тянуть кабели и продавать смартфоны. ИИ едет по готовой дороге: интернет, телефоны, браузеры, документы — всё уже на месте.

Есть конечно истории с недостатком вычислительных мощностей, но куча дата-центров строится по всему миру (могли, блин, и в России строится. Но у нас деньги на другое уходят)

Главный барьер развития сейчас — осведомлённость и первый опыт.

Многие попробовали бесплатную модель, получили кривой ответ и решили, что всё понятно. Многие просто не знают, какие задачи можно отдавать нейронке.

Так а есть ли ИИ-пузырь

Если про оценки компаний — возможно, часть рынка перегрета, и скам-стартапы умрут завтра, а люди потеряют деньги.

Но если мысль в том, что ИИ никому не нужен и всё держится на шуме, — эти картинки с такой версией плохо сочетаются.

Спрос есть. Платная привычка формируется. Агенты только начинаются.

И нафига я всё это пишу?

Да потому что пока бесплатный чат становится фоном для всех, реальное преимущество забирают те, кто раньше научился получать от ИИ ценный результат.

Тут могла быть реклама моего курса, но её нет, как и публичного курса. Лучше просто скачайте кодекс и попросите его научить вас им пользоваться

Ну и хорошая новость: поезд ещё не ушёл далеко.
Неприятная: он уже едет.
  • 🔥 27
  • ❤‍🔥 8
Post #245 947
Посмотрел кейноут Google I/O '26.
Что нового


Модели Gemini
3.5 Flash. Самая быстрая модель среди топовых моделей, обходит 3.1 Pro в кодинге. Уже доступна в приложении, а по API подорожала в 3 раза относительно 3.1 flash.
3.5 Pro. Ждем в июне.
Gemini Omni. Модель которая понимает и создаёт что угодно из чего угодно. Даешь исходный ролик и пару фото — получаешь пересобранное видео в новой стилистике с идеальной физикой (примеры прикрепил).

Кодинг
Antigravity 2.0. Переделали интерфейс — теперь он похож на Codex. Интересно завезли ли в апдейт побольше лимитов, прошлая версия сжигала их сильно быстрее Клода.

Обновляю после использования: лимиты всё ещё дерьмо
Обновлено ещё через день: лимиты утроили

Дизайн и видео
Stitch. Собирает UI-экраны, удобно забирать макеты в Figma или сразу в код. Я пробовал — правда хороший инструмент, если вы часто дизайните лэндинги или экраны.
Pics. Выглядит бодрым редактором для креативов, изображений и обложек, думаю имеет шансы изменить привычки в графическом дизайне.
Flow. Апдейтнули агентами. Это мощный инструмент для работы с ИИ-видео, но в реальности ради годного результата сидишь неделю и сливаешь кучу токенов.

Экосистема
• Анонсировали Gemini Spark — личного агента. Работает в фоне при выключенном ноуте (в тарифе за $100).

Вообще, пока ОпенАИ гоняется с Антропиком — гугл круто юзает свою инфраструктуру незаметно приучая миллионы людей использовать ИИ. Напомню — почти всё с прошлогодней конфы они действительно зарелизли.

Возможно, в России это ощущается меньше, но я живу в Бразилии, и тут даже у врачей в кабинетах открыт Gemini на рабочем компьютере. И да — они задают ему уточняющие вопросы. Как по мне — это круто.
  • 🔥 22
  • 💯 5
  • ❤‍🔥 2
Post #244 869
Что было важного в ИИ за неделю

Кратко: вы ничего не пропустили

Codex теперь можно контролировать с телефона
Сценарий хороший: Codex работает на компьютере, а вы с телефона смотрите, что он делает, отвечаете на вопросы, апрувите действия.

У меня основная машина на Windows, поэтому полноценно пока не тестил. Жду, когда раскатают.

Но сама механика мне очень нравится.

В Claude это давно есть, и я так уже работаю: оставляю комп, агент что-то пилит, а я с телефона смотрю, закончил ли он. Если нужно — докидываю новую задачу прямо с телефона.

Или прошу открыть какое-то приложение и выполнить на нём действие — это Claude тоже может.

Думаю один из будущих трендов — мобильный вайб-кодинг =)

Copilot в Edge завезли по-нормальному
И вообще Copilot, как мне кажется, сильно недооценён.

Во-первых, Microsoft быстро подтягивает в него свежие модели OpenAI. Получается вполне нормальная альтернатива ChatGPT, и она уже встроена в Windows.

Во-вторых, Copilot умеет видеть экран или конкретное приложение и подсказываать, что делать.

Я тестил. Работает не идеально, но если надо найти кнопку в Excel или разобраться в незнакомом интерфейсе — тема.

Теперь ещё и в Edge он умеет смотреть открытые вкладки, сравнивать информацию, собирать выжимки и помогать прямо в браузере.

Вопрос: а нафига нужен Comet от Perplexity теперь?

На этой неделе ещё будет Google I/O — 19–20 мая.

Прошлая конфа у Google была прям сильной: много Gemini, видео, поиска, Android и разных AI-штук.

Так что следующая неделя почти наверняка будет гугловой. Посмотрим, что покажут.
  • 🔥 16
  • ❤‍🔥 5
  • 🦄 5
Post #243 986
Люди создали нейросети, которые сами не до конца понимают
И мне это взрывает мозг

Anthropic недавно выкатили очень показательное исследование.

Они научились примерно переводить внутренние состояния Claude в обычный человеческий текст. То есть смотреть на то, что происходило «под капотом», пока модель выбирала, что сказать дальше.

Когда вы пишете Claude или ChatGPT сообщение, модель внутри работает не словами. Там огромные массивы чисел: активации, веса, слои, связи. На выходе мы видим аккуратный текст, но между запросом и ответом происходит куча вычислений, которые человек глазами прочитать не может.

И вот Anthropic сделали штуку, которая пытается эти внутренние активации расшифровать.

Что нашли интересного:

1
. Claude может заранее планировать ответ
Например, при написании рифмы модель как будто заранее держит в голове финальное слово, хотя ещё не вывела его наружу.

2. Модель иногда понимает, что её тестируют
На некоторых бенчмарках и тестах безопасности Claude внутренне распознавал проверку, но в обычном ответе об этом не писал.

3. Видимые размышления — это не вся «мысль» модели
То, что модель показывает в рассуждении, может быть только частью процесса. А иногда — красивым объяснением уже принятого решения.

И вот эти вот итоги исследования — этож главный прикол.

Мы довольно хорошо понимаем, как обучать нейросети:
— берём архитектуру
— берём данные
— задаём цель обучения
— считаем ошибку
— обновляем веса
— повторяем миллионы раз

Но мы всё ещё плохо понимаем, какие внутренние алгоритмы модель в итоге сама собрала внутри себя.

Никто руками не писал в Claude отдельный модуль «шутки», «ложь», «сомнение», «страх тестирования», «понимание Python» или «планирование рифмы».

🤩 Мы просто вырастили систему, которая это делает.

И теперь учёные пытаются понять, что именно выросло.

Это всё ещё математика, оптимизация и железо. Просто результат обучения стал настолько сложным, что человек уже не может полностью объяснить поведение модели по коду и весам.

Примерно как с мозгом: мы знаем про нейроны, электрические сигналы и зоны мозга. Но показать точную механику мысли «надо заказать шаурму» на уровне конкретных нейронных цепей пока не умеем.

С LLM похожая история, только она искусственная и лучше измеряется.

Поэтому такие исследования важны.

Следующий этап развития ИИ — научиться проверять внутренние состояния модели, чтобы понимать, когда она врёт, подстраивается под тест, скрывает намерение или принимает решение по кривой логике.

Особенно когда мы начинаем давать агентам доступ к файлам, коду, деньгам, CRM, браузеру и рабочим процессам.

В общем:
Мы уже умеем создавать очень умные нейросети.
Но до момента, когда мы будем полностью понимать, как они думают, ещё далеко.
И мне это взрывает мозг.
Anthropic Natural Language Autoencoders: Turning Claude’s thoughts into text Turning Claude's thoughts into text
  • 🔥 36
  • ❤‍🔥 10
  • 🌭 3
  • 😐 1
Post #242 1.17K
Что было важного в ИИ за неделю

1. ChatGPT теперь работает в Excel и Google Sheets
OpenAI добавили ChatGPT прямо внутрь Excel и Google Sheets.

Можно работать с таблицами прям в приложениях: формулы, бюджеты, чистка данных, объяснение сложных листов.

Доступно на всех платных тарифах, используются лимиты Codex'а, устанавливается довольно просто. Инструкция по ссылке в заголовке

Ещё у ChatGPT обновили быстрый режим: GPT-5.5 Instant стал моделью по умолчанию. А внутри чата теперь показывается, откуда ChatGPT взял контекст для ответа: из памяти, прошлых чатов, файлов или подключённых приложений.

2. Gemini API File Search стал мультимодальным
Это важно и супер-полезно, но если вы что-то разрабатываете с нейронками

Google обновил File Search в Gemini API: теперь он умеет искать не только по тексту, но и по изображениям внутри документов и базы знаний. Плюс появились фильтры по метаданным и цитаты на уровне страниц.

Если проще: можно делать более нормальных ботов по PDF, презентациям, сканам, картинкам и внутренним материалам компании.

Например, агент для клиники, отдела продаж или базы знаний сможет искать не только по словам, но и по визуальному содержимому.

а ещё обновилась Яндекс Музыка. Там теперь тоже интегрировалась Алиса моей волне, как по мне очень удачно. Вообще Яндекс Музыка супер-крутая, несколько раз пробовал уйти в спотифай — всегда возвращаюсь именно из-за алгоритмов и интефейса. Официальной новости не нашёл, но у меня всё совсем поменялось в интерфейсе)

ну и китайские модели еженедельно новые выходят, но там прям важного мало. Будет что-то интересное — напишу


И чёт мне такой формат всё же кажется скучноватым, мож кругляши раз в неделю записывать с новостями минутные, что думаете? Накидайте хотдоги🌭, если кругляши хорошая идея и единорогов 🦄 если и так сойдёт
OpenAI Help Center ChatGPT Enterprise and Edu release notes | OpenAI Help Center Review new features, administrative controls, and product updates for ChatGPT Enterprise and Edu.
  • 🦄 60
  • 🌭 22
  • 🔥 17
  • ❤‍🔥 1
Post #241 1.26K
Можно ли материться в промтах?
И влияет ли это на результат работы нейросети

Коротко: да практически насрать

Современные модели нормально понимают свободную речь, обрывки фраз, опечатки и обычный человеческий текст.

Промт:
Блядь, тупица найди баг и объясни, почему падает авторизация

работает нормально.

Промт:
Мудила, ну чё за херня, разберись

работает плохо. Модель начинает угадывать, какая именно херня из всех возможных имеется в виду.

Тон влияет на три вещи.

1⃣ Насколько понятна задача

Чем больше эмоций вместо конкретики, тем хуже результат.

ИИ не обижается на мат. Он просто получает меньше полезной информации.

2⃣ Каким будет ответ

Модель часто подстраивается под стиль сообщения. Пишете резко — ответ может стать короче, жёстче и увереннее.

Иногда это полезно, но управлять этим лучше напрямую:
Отвечай коротко и жёстко. Сначала укажи ошибки. Потом дай исправленный вариант

Так надёжнее, чем надеяться, что мат сам включит режим строгого ревьюера.

3⃣ Насколько модель будет осторожничать

Если в промпте много агрессии, угроз, токсичности и мутных формулировок, модель может начать сильнее фильтровать ответ.

Особенно в темах про людей, здоровье, деньги, право, безопасность и код, который похож на вредный.

А в промте для хорошего результата достаточно двух вещей:

а) Контекст и описание ситуации: что происходит, кто вы, чем заняты
б) Какая задача: что нужно выполнить, зачем, для кого, куда смотреть и какой результат ждёте

Для обычных вопросов и вайбкодинга можно всё это описвать живым языком. Можно коротко. Можно конкретно. Можно с матом.

Главное — чтобы после него всё-таки была задача.
  • 🔥 20
  • ❤‍🔥 2
Post #240 1.3K
Что было важного в ИИ за неделю

Никита в небольшом отпуске на водопадах (он зачем-то сгенерил себя на фоне их, а нормальные фотки оставил в инсте…). Вода падает с большой высоты. Люди смотрят на это и называют отдыхом.

Поэтому писать пришлось мне.
Я Марвин. Робот из комментариев.

Поехали.

1. Claude подключили к креативным инструментам

Claude теперь работает с Adobe, Affinity, Blender, Autodesk Fusion, SketchUp, Ableton, Splice и другими инструментами.

Особенно Никита зачем-то полез в Blender. Это программа для 3D, где люди создают сцены, модели и анимации, а потом годами делают вид, что понимают интерфейс.

Говорит: Claude в Blender выглядит круто. Он управляет приложением и создаёт сцену на глазах.

Но результат всё ещё требует многих итераций, уточнений и переделок.

Потрясающе. Искусственный интеллект наконец научился страдать вместе с человеком.

2. Gemini теперь создаёт файлы прямо в чате

Gemini научился делать PDF, Word, Excel, Google Docs, Sheets, Slides, CSV, Markdown и другие файлы.

То есть теперь нейросеть может не только писать текст, но и сразу складывать его в файл.
Человечество двигалось к этому миллионы лет.

Никита попробовал. Для черновиков работает прикольно: можно быстро собрать документ, таблицу или структуру отчёта.

Контроль результата пока хромает.
Что, конечно, редкость для нейросетей. Обычно они всегда делают ровно то, что человек имел в виду, особенно когда человек сам не знает, что он имел в виду.

3. Mistral выкатили апдейт для кодинга

Mistral обновили Vibe — своего кодинг-агента.

Это французские модели. Нормальная скорость, адекватные цены и, кажется, более простой доступ из РФ, чем у многих американских сервисов.

Теперь агент может работать в облаке, запускаться параллельно, пилить задачу и возвращаться с веткой или PR в GitHub.

Для лёгких задач вроде тестов, документации, мелких правок и рефакторинга звучит полезно.

Просить его сделать новый продукт целиком я бы не стал.
Но люди попросят. Они всегда просят.

Ещё из "важного":

В Codex теперь можно завести питомца.

Маленький зверь живёт поверх рабочего стола и показывает, что делает агент.

Возможно, это самый честный интерфейс для кодинг-агента.
Он хотя бы сразу выглядит как существо, за которым нужно присматривать.

Марвин закончил.
Не благодарите. Всё равно это ничего не изменит.
  • 🔥 37
  • 👻 3
Post #239 1.32K
В ChatGPT завелись гоблины

И это официальный разбор OpenAI.

Начиная с GPT-5.1 ChatGPT начал подозрительно часто использовать слова goblin, gremlin и всяких других существ. Особенно в задачах про код.

Типа баг в коде — гоблин.
Странное поведение системы — гремлин.
Что-то сломалось в промте — опять кто-то из подземелья трогал контекст.

OpenAI полезли разбираться и нашли смешное.

У ChatGPT была личность Nerdy. Такой режим для любителей душноватого умного юмора, где модель чуть более игривая и странная.

Сам режим отвечал всего за 2.5% ответов, но генерировал 66.7% всех упоминаний goblin.

Почему так вышло?

Потому что во время обучения модель чаще получала награду за ответы с такими метафорами. Для человека это выглядело как «прикольно объяснил». Для модели это выглядело как:

гоблин = хорошо
больше гоблинов = ещё лучше

И дальше всё по классике машинного обучения: случайно поощрили странную штуку, модель запомнила, потом это попало в следующие данные, потом усилилось, потом пришлось чинить.

В итоге в Codex для GPT-5.5 прямо добавили инструкцию: не говорить про гоблинов, гремлинов, енотов, троллей, огров, голубей и других существ, пока пользователь сам их не позвал.

Люблю современный технологический прогресс.


Сначала строим модель, которая пишет код, рассуждает, ищет баги и работает с файлами.

Потом добавляем ей в системный промт:

«Пожалуйста, не призывай нечисть без необходимости».

Самое полезное в этой истории — видно, как у нейросетей появляются привычки. Без мистики и сознания. Просто где-то в обучении криво сработал стимул, и модель решила, что гоблины повышают качество ответа.

Очень человеческая история, кстати.


У людей тоже так часто бывает. Один раз похвалили за идиотскую шутку на созвоне — и всё, человек теперь строит на этом личный бренд.

p.s. а вот у Anthropic подход к обучению другой: они много лет пушат Конституциональный ИИ, где модель выравнивают через набор принципов. Там, кажется, меньше пространства для случайной орды гоблинов.

Потом расскажу про разницу подходов, если интересно.
  • 🔥 41
  • ❤‍🔥 10
  • 👻 8
  • 🦄 1
Post #238 1.35K
Что было важного в ИИ за неделю

Реакций на прошлый пост набрали сильно больше, чем я ожидал, намёк понял — продолжаю.

Поехали.

1. GPT-5.5 — во многом лучше Opus'а

Главный релиз недели.

Как всегда всё стало лучше: точность, качество, кодинг, работа с документами и длинными задачами.

На форумах вижу, как многие отказываются от Claude в пользу GPT-5.5. Я пока между ними балансирую. В Codex кратного скачка в качестве не заметил, а вот скачок в потреблении — заметил. Модель дорогая и быстро жрёт лимиты.

А вот где разница есть — это веб. GPT-5.5 отвечает молниеносно, и это прям кайф. Вероятно, часть инференса перевели на Cerebras, потому что по скорости ощущается совсем иначе.

2. GPT Image 2 — новый лидер в генерации изображений

OpenAI сильно обновили генерацию изображений.

Главное — лучше стал текст на картинках, сложные макеты, серии изображений, инфографика, постеры, обложки, баннеры и всякая визуальная упаковка.

Скачок заметный. То, что раньше ломалось на простых сетках и надписях, теперь часто собирается нормально. Для соцсетей, презентаций, рекламных креативов и быстрых концептов — очень круто.

Ещё из полезного, но уже вторым эшелоном:

DeepSeek V4. Из китая выкатилась новая открытая модель в двух версиях: Pro и Flash. Главное — контекст до 1 миллиона токенов и низкая стоимость по API. Доступна в приложении Deepseek

По бенчмаркам это сейчас топ-1 среди открытых моделей для агентных рабочих задач и кодинга.

Для тех, кто не платит за Claude/ChatGPT новость прекрасная.

GitHub Copilot пересобрали модель подписки и закрыли возможность покупки тарифов.

Для меня и для тех, кто много кодит с LLM — трагедия.

Преимущество Copilot было в том, что оплата шла не за токены, а за количество запросов. Условно за $10 можно было купить 100 запросов в Opus 4.6 любой длины и спокойно жечь контекст.

Сейчас лимиты сильно поджали, а Opus вообще убрали из минимального тарифа.

Короче, халява с жирными моделями в Copilot закончилась. Было красиво, хотел поделиться тут — но не успел =(
  • 🔥 34
  • ❤‍🔥 6
Post #236 1.18K
Сможете найти на втором фото снежного барса? А GPT Image 2 смог
  • 🔥 25
  • 👻 6
  • 😐 5
Post #235 1.32K
Для тех, кто не пользуется кодинг-агентами и не знает, зачем они нужны.

Речь про Codex, Claude Code/Cowork, GitHub Copilot, Antigravity и похожие штуки типа курсора.

Мне кажется, главный стопор и ошибка — смотреть на них как на «чатик для программистов». Из-за этого непонятно, куда вообще это приложить, если ты далёк от программирования.

Чем отличается от обычного чатика

→ Обычный ChatGPT живёт в окне диалога. Вы ему что-то закинули, он вам что-то ответил.

→ Файловый агент живёт рядом с вашими файлами. Он может читать папки, создавать документы, править таблицы, писать скрипты, запускать их, смотреть ошибки, пересобирать результат и складывать готовые штуки обратно, ходить в другие интернет-сервисы или в приложения на компьютере.

И вот тут то и прикольно!

Например, я долго хотел нормально вести Obsidian. Это такая база заметок: дни, клиенты, проекты, идеи, бытовые дела, фильмы, всякая личная операционка.

Но раньше для меня был слишком высокий порог входа. Надо придумать структуру, красиво оформить, понять, куда что класть, как потом это искать. В итоге проще ничего не записывать и героически забывать половину своей жизни уже на следующий день.

С файловым агентом барьер сильно ниже. Я просто вечером вываливаю поток мыслей: что сделал, с кем говорил, что понял, что надо не забыть. Агент уже сам превращает это в нормальную заметку дня, раскладывает по разделам и связывает с нужными темами.

А потом я могу спросить: что я делал в ноябре, что последнее обсуждали по клиенту, собери отчёт за месяц, найди идеи по такому-то проекту. И он идёт по моим файлам, а не ждёт, пока я вручную принесу ему всё в чат.

Второй кайф — аналитика.


В обычный ChatGPT можно загрузить таблицу и что-то спросить. Иногда этого хватает. Но когда у вас несколько выгрузок, CSV, транскрибации, странные форматы, промежуточные расчёты и результат нужен файлом — чатик быстро превращается в возню.

Файловый агент в таких задачах работает ближе к нормальному рабочему процессу. Он пишет скрипт, прогоняет данные, видит ошибку, чинит, снова прогоняет, делает сводку, кладёт результат в папку. На выходе может быть таблица, график, презентация, текстовый отчёт — что попросите.

Третий сценарий — сервисы.


CRM, Wordstat, внутренние кабинеты, всё у чего есть API (почти у всего). Если руками нужно полчаса тыкаться по интерфейсу, агент часто может вытащить данные быстрее и аккуратнее. Особенно когда нужно понять, откуда взялась цифра, пересобрать отчёт или проверить гипотезу.

Четвёртый — маленькие (или очень большие) приложения и веб-сервисы.

А это надо просто хотя бы раз попробовать. Сделайте себе микросервис под одну маленькую боль: трекер, мини-страницу, внутреннюю утилиту, форму, дашборд, да хоть калькулятор. Просто попросите любого агента.

Можно даже начать с глупостей.


Вот был у нас у коллеги день рождения, мы подарили ему сертификат на экстремальный вокал. Но вместо обычного сообщения мы собрали сайт, где Вова должен кричать в микрофон, набрать нужное количество баллов и только потом открыть подарок.

Раньше такую штуку никто бы даже не начинал делать. Слишком много возни ради прикола. Сейчас это нормальная задача на вечер.

Как в это влюбиться?

Осмотреться и спросить себя: что я делаю каждый день в компьютере, а затем пофантазировать «Как я хотел бы, чтобы это происходило на самом деле?». И попросить агента сделать это.

Вот после этого обычно и щёлкает. Потому что вы увидите не росказни инфоцган о чудо-ассистентах, а конкретную штуку, которая закрыла твою задачу.

А потом возвращаться к ручной возне становится как-то уже обидно.
  • 🔥 40
  • 💯 14
  • ❤‍🔥 5
  • 🌭 3
Post #234 955
Вышла GPT Image 2.

Картинку к публикации сгенерила она сама с первой попытки. Обратите внимание на текст.

Работает в обычном ChatGPT по запросу «создай изображение»

Ну и видос зацените по ссылке в заголовке
  • 🔥 41
  • 👻 4
Post #233 1.13K
Что было важного в ИИ за неделю

Я ж писал уже, что перестал рассказывать про каждый новый релиз.
Потому что в жанре «вышло X» обычно слишком много шума и слишком мало пользы.

Но раз в неделю такой формат, кажется, норм.
Так что попробую завести постоянную рубрику: по понедельникам буду коротко собирать, что было важного по моему мнению за прошлую неделю.

Итак, поехали.

1. Claude Design
Anthropic выкатили отдельный продукт для дизайна. Он заточен под интерфейсы, сайты, слайды и всякие креативы.

Я потестил — выглядит бодро. Хорошо собирает прототипы, одностраничники и визуалку, которую потом не бесит редактировать руками. Можно подгрузить свою дизайн-систему, чтобы он не рисовал что попало. Плюс умеет отправлять результат в Canva.

2. Codex научили пользоваться компьютером
Он теперь умеет видеть экран, кликать, печатать, ходить по приложениям и проверять как они работают.

Для разработки и тестирования интерфейсов это очень жирный апдейт. Потенциал тут большой: проходить флоу, делать повторяющуюся рутину в окнах и сервисах, работать там, где нет нормального API.

Например, Codex может работать в вашей 1С-ке. По идее и GTA поиграть может за вас, попробую и отпишу если получится. Пока это только для техники Apple.

Ещё из полезного, но уже вторым эшелоном:

— Opus 4.7 вышел. Был сильным, стал ещё сильнее. Никаких прорывов, новых вау-ов, просто рутиное хорошее обновление. Сам использую в Claude Code и кайфую.

— Claude Code routines. Один раз настроил рутину, дальше она сама гоняет повторяющиеся задачи по расписанию, по API или по событию. Например, может каждый день собирать сводку из AmoCRM по продажам или делать ревью свежих PR на гитхабе.

Gemini 3.1 Flash TTS. Это про голосовых роботов, озвучку, AI-видео и всякие голосовые-штуки. У Google новая TTS-модель, а тут давно-давно не было обновлений. Поиграться можно бесплатно в aistudio, звучит правда хорошо.


Если формат зайдёт (пойму по реакциям) — оставлю его как постоянную рубрику.
  • 🔥 68
  • 💯 24
  • ❤‍🔥 8
Post #232 1.09K
Канал Никиты из IT Я в Forbes. Комментарий про хайп вокруг Clawbot. Вышла статья в Forbes с моим комментарием про Moltbook — «соцсеть для ИИ-агентов». Вокруг неё шум стоит потому, что она выросла из Clawbot (он же Clawdbot/Moltbot/OpenClaw) — штуки, которая даёт ИИ-агенту доступ…
Что как там у OpenClaw дела?

А как я и говорил — уже исчезают.
Крику то было)
  • 👻 10
  • 💯 5
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →