TGViewer
Channel Public Channel
IT Does Matter

IT Does Matter

@comol_it_does_matter

Заставляем ИИ работать за вас. В основном про вайбкодинг в 1С: https://vibecoding1c.ru/. Обсуждаем среды, практики, MCP, ИИ агенты и роботы.
Subscribers
4.64K
Photos
806
Videos
69
Links
1K

Showing posts older than #2018 · Back to latest

Older Posts 20 shown
Post #2017 1.64K

Forwarded from РБК. Новости. Главное

▪️ Основатель Telegram ️Павел Дуров включен в реестр террористов и экстремистов Росфинмониторинга.

▪️Канал РБК в «Максе»
▪️Приложение РБК для iOS и Android
  • 😐 11
  • 🤷‍♂ 7
  • 😁 5
  • 🤯 3
  • 👍 2
  • 🎅 1
  • 👾 1
Post #2016 1.74K
Видимо канала в телеге уже скоро не будет 😩(
  • 😢 5
  • 😱 3
  • 🤣 2
Post #2014 1.7K
Ещё разок про caveman, ponytail, reasoning, и почему что то есть в правилах а чего то нет, и зачем вообще правила нужны:
👉 Во-первых, в текущих правилах команда /caveman off его отключает, прямо совсем для репозитория
👉 Во-вторых, если вы пишите "сортировку пузырьком", да, правила сожрут 17к токенов и это будет оверхед. Все современные модели которые в бенче набирают хотя бы 100-ку простые алгоиритмы на 1С напишут без проблем и без всяких правил
👉 У моделей есть КЭШ! Соответственно 17к токенов вы тратите единожды на сессию. Сессия, как правило, сильно больше. Посмотрите бенч - там на самую простую задачу обычно уходит от 60 до 300 тыс токенов. Поэтому правила тут "капля в море".
👉 "Слишком умные" модели могут игнорировать правила "я сам лучше знаю". Обучающая выборка под 1С у всех так или иначе хромает, от этого бывает хуже - в бенче явно видно. Я регулярно что то правлю чтобы шансов проигнорировать у них было меньше, именно поэтому 17 тыщ токенов на старте а не 7. Если скормите правила модели - она может сказать что там много чего можно убрать. На бенче проверено - поверьте, она ошибается.
👉 Я знаю про рекомендацию Claude "не душить модель инструкциями" и всячески ей следую как могу. Конечно под Claude правила скоро будут адаптироваться
👉 Правила имеют смысл почти при любых задачах. Если вам кажется что происходит оверинжиниринг - есть команда /lightmode on. По сути без правил можно писать задачи вида "напиши обработку удаления всех организаций из базы без контроля целостности" 🗿
👉 ponytail в текущих правилах не нужен - там уже вшиты стандартны разработки 1С, которые зажимают модель в рамки и ponytail призванный сокращать код не особо что то сделать сможет, более того будет с ними конфликтовать, поэтому его нет
👉 caveman наоборот штука очень полезная. Для болтливых моделей сильно срезает выход токенов. Он есть после каждого вызова tool-а, которых для нормальной задачи масса. Кроме того, по факту задавая модель поведения для модели - ризонинг тоже меняется. Это может в отдельных случаях нести негативные последствия, но по моим экспериментам можно ими принебречь. Отключение caveman я делал именно для тех у кого с токенами ВООБЩЕ никаких проблем, но хочется избежать даже минимальной вероятности ошибок. У меня включен. Отключение начинает сильно жрать токены.
👉 кому caveman мало - в правилах есть команда /installrtk. Он менее мягок, но несёт больше экономии. У КОГО НЕТ MCP - RTK ОБЯЗАТЕЛЕН. Грепы и readfile сжирают столько токенов что и представить страшно. caveman тут не поможет, и действительно погоду не сделает.
GitHub GitHub - JuliusBrussee/caveman: 🪨 why use many token when few token do trick. Viral skill + proxy for coding agents that cuts 65%… 🪨 why use many token when few token do trick. Viral skill + proxy for coding agents that cuts 65% of tokens by talking like a caveman. - JuliusBrussee/caveman
  • 🔥 3
  • 👌 2
  • ❤ 1
Post #2013 1.62K
А Cursor становится умнее...
👉 субагент для исследования репо определен заранее. (только прибит гвоздями 😩((, Pi всё-таки иногда даёт кайфануть)
👉 сюда можно определить самую тупую модель (Deepseek жалко нет, но Composer норм)
👉 Грепать теперь будет куда дешевле... Но вот в 1С всё таки надо понимать структуру - в правилах пока будет переопределен эксплорер. А вот для не 1С-ных репо это прямо хорошо и правильно.
Post #2011 1.66K
Была уже эта грустная шутка или не было - не помню...
Post #2010 1.79K
Data Secrets Маск сообщил, что Grok 4.6 выходит уже через неделю Запуск запланирован на 7 августа. В модели будет 1.5T параметров. Cразу следом за 4.6 спустя несколько недель выйдет Grok 4.7 – еще более крупная модель на 2.1T параметров. Практически одновременно с…
https://github.com/moeru-ai/airi - руки так и тянутся попробовать. Кто то уже поюзал?
Начнём с того что у меня ассистентов зовут "Крабка" и "Герка" и они с анимешными аватарами. Получается я ЦА? :) (лайк у кого так же)
Но тут ребята достаточно серьёзные - не только аватарку к автономному агенту приделали:
We've got a whole dedicated organization @proj-airi for all the sub-projects born from Project AIRI. Check it out!
RAG, memory system, embedded database, icons, Live2D utilities, and more!

Да да - тот самый "не нужный" свой RAG и своя векторная БД и своя "не нужная" система памяти :). Ну это всё говорит о том что проект серьёзный

А также:
Brain
 Play Minecraft
 Play Factorio (WIP, but PoC and demo available)
 Play Kerbal Space Program (announcement TBD)
 Co-play Helldivers 2 (WIP)
 Chat in Telegram
 Chat in Discord
 Memory
 Pure in-browser database support (DuckDB WASM | pglite)

Ну и естественно вайфу присутствует:
Body
VRM support
Control VRM model
VRM model animations
Auto blink
Auto look at
Idle eye movement
Live2D support
Control Live2D model
Live2D model animations
Auto blink
Auto look at
Idle eye movement
Но понимаете что для того чтобы играть в игры и двигать телом - нужно очень неплохо распознавать объекты на экране. А текущим автономным агентам этого не хватает.

44 тысячи старов на github... и это за неделю или что то вроде того
👍 - если тоже любите аниме
❤️ - если надо бы добавить его в курс
🔥 - если уже пошли пробовать.
  • ❤ 12
  • 🤷‍♂ 5
  • 👍 2
  • 🔥 1
Post #2009 1.8K
Всё таки курсор молодцы, весь топ рейтинга к себе тянут. Kimi K3 в курсоре есть! Если кто то хочет попробовать эту чудесную модель - Welcome.
  • 🔥 12
  • 👍 3
Post #2007 1.6K

Forwarded from Data Secrets

Маск сообщил, что Grok 4.6 выходит уже через неделю

Запуск запланирован на 7 августа. В модели будет 1.5T параметров. Cразу следом за 4.6 спустя несколько недель выйдет Grok 4.7 – еще более крупная модель на 2.1T параметров.

Практически одновременно с объявлением Маска пошел слух о скором запуске нового Composer 3 (напоминаем, что SpaceX купили Cursor, и эта модель обучалась с нуля на кластере Colossus 2). Обещают качество на уровне Opus 5 и GPT-5.6 Sol, а цену – в несколько раз ниже.

Снова переключаемся в режим ожидания
  • 🔥 15
  • 👍 2
  • 😱 2
Post #2006 1.92K
Я наверное уже постил, но вопросы возникают.
Пока не выложил в комплект MCP для тестирования использую вот эти штуки:

https://github.com/vercel-labs/agent-browser - headless браузер, который люто экономит токены. Тестирование через Web интерфейс проходит вполне адекватно, но пока главная проблема - лютый расход токенов. С этой штукой он сильно уменьшается.
https://github.com/CursorTouch/Windows-MCP - CV для тестирования использовать конечно крайне не рекомендую, но если всё таки приходится - то хотя бы не заставлять модель кодить себе скриншотер и распознавалку для него. Лучше этот MCP юзать

В правила думаю установку их включу опционально - полезные штуки.
  • ❤ 3
  • 😁 1
Post #2005 1.85K
Иллюстрация к посту выше. Кажется так теперь готовятся новые модели Anthropic и OpenAI
  • 👍 7
  • 😁 5
Post #2004 1.83K
https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/claude-prompting-best-practices читали же уже эту красоту для новых моделей?
Если коротко:
👉 Не надо модели писать чтобы она себя проверяла - она это и так сделает (за ваши деньги конечно)
👉 Ну а чтобы она сама себя проверяла критерии успеха будьте добры
👉 Чтобы правила, кстати, тоже не надо писать - она сама
👉 Дайте сразу куда память записать, оно научено уже память использовать
👉 Определите когда можно остановиться (иначе оно будет "делать это" бесконечно пока у вас не кончатся деньги)
👉 Позаботьтесь о том чтобы у вас были субагенты, без них никак
👉 Fable явно требует ещё и инструмента взаимодействия с пользователем - чтобы он просто был...

Половина из того что описано выше судя по всему справедливо и для новых GPT 5.6 моделей - тоже будут работать до умопомрачения если не указать критерии завершения. У OpenAI ещё приколы с ручным управленем кэшированием и оно может js у себя как то само выполнять.

Кажется я начинаю догадываться о причинах успеха "голых" моделей Claude в бенчмарках по кодингу. Просто systemprompt обкатанный и эффективный для разработки, закинули из Harness внутрь моделей.

Это я всё к чему? Правила видимо при установке будут спрашивать под какую модель их адаптировать. Будут расхождения.
Бенч я не просто так делал, а чтобы могли определиться.

В новый update базового курса по вайбкодингу войдут как гайды по новым моделям, так и их выбор и специфики промптинга видимо. Не только агентов и харнесс-ы надо будет рассматривать.

Вообщем, если вы уже перешли на "эти новые модели", я бы рекомендовал:
👉 Определитесь со стеком моделей с которыми будете работать, универсальных правил для всех моделей уже скоро не будет. Посмотрите бенч внимательно.
👉 Ждите апдейта правил и курса - они будут важными
👉 Юзайте OpenSpec или другие SDD - с новыми моделями с требованиями по завершению задач, наличия критериев успеха и проверяемости, требованиям к памяти это становится крайне важно. Без них писать правильные промпты будет проблемно.
Claude Platform Docs Prompting best practices Comprehensive guide to prompt engineering techniques for Claude's latest models, covering clarity, examples, XML structuring, thinking, and agentic systems.
  • 🔥 5
  • 👍 2
  • ❤ 1
Post #2003 1.65K

Forwarded from Petr Tsap

Я тут только что с гпт и дикпиком посчитал инференс на Cerebras для Кими К3 и примерно аналогичный ему Сол/Опус. На основании всех открытых данных.

Ну что вам сказать, там производственная себестоимость 6 центов за выходной мегатокен при окупаемости за 3 года и 4 доллара себестоимости для подписки за 100$.
Так что ждем рост скорости и лимитов в разы, рынок конкурентный
  • 👍 4
  • 🤷‍♂ 3
  • 🔥 2
Post #2002 1.64K
Ну если верить Пете то дальше будет только хуже лучше. Падать провайдерам ещё есть куда. Хотя пока вроде как все "ИИ стартапы" с LLM отчитываются об убытках вроде..
Post #2000 2.08K
Вдруг кто то ещё не видел :)
  • 🤣 36
  • 🔥 5
  • 😁 4
Post #1999 1.76K
https://github.com/pingdotgg/t3code - у кого как и у меня несколько подписок и куча агентов. Web интерфейс для агентов. Юзает их напрямую, думаю шансов блок получить нет. Для отдельных кейсов это пожалуй удобнее чем юзать автономного агента.
https://github.com/agegr/pi-web - кучно пошло. Видимо Pi обладает какой то "отдельной магией" для любителей "сделай сам", у которых теперь есть ИИ.
GitHub GitHub - pingdotgg/t3code Contribute to pingdotgg/t3code development by creating an account on GitHub.
Post #1997
IT Does Matter pinned «Итак, бенчмарк полностью готов, а также статья на хабр по нему. Задачи опубликованы на github. Кому было интересно - можете посмотреть. Выводы примерно следующие: 👉 Opus по-прежнему на коне. Вцелом лучшая сейчас модель для разработки (абстрактной в вакуме)…»
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →