TGViewer
БЕДÓВАЯ БЕДÓВАЯ @dsbim · 1.53K subscribers
Post #502 1.2K
Мем в тему сегодняшнего вебинара 😁

Когда компания начинает на корпоративном уровне внедрять ИИ, она, с одной стороны, экономит трудочасы, а с другой возникает новая статья расходов - оплата лицензий и токенов для ИИ сервисов. Зрелые компании мониторят использование токенов пользователями и составляют инструкции по их разумному потреблению.
Итак, что нужно делать, чтобы снизить стоимость ответов LLM:

🎙Работайте в автоматическом режиме выбора модели
Не применяйте думающую модель там, где не требуется глубокий анализ - это как забивать гвозди микроскопом. Задача будет решена слишком высокой ценой.

🎙Ограничивайте объём ответа
Рекомендую заранее задать рамки результата.
Примеры формулировок:
«Ответ в 3–5 пунктах»
«До 120 слов»
«Только финальный ответ, без рассуждений»
«Верни только JSON, без пояснений»

🎙Перестаньте флиртовать с ИИ
Модели не нужен канцелярит и приветствия. Каждое лишнее слово — это токены.
Вместо «Привет, можешь, пожалуйста, подробно…» → «Сделай: …»

🎙Используйте структуру вместо текста
Короткий шаблон экономит токены и снижает шанс неправильного понимания:
Роль: <кто ты>
Задача: <что сделать>
Формат: <как вывести>
Ограничения: <длина/стиль/что исключить>
Вход: """..."""


🎙Не дублируйте контекст
Если контекст уже есть в диалоге — не переписывайте его.
Достаточно: «Используй предыдущий контекст. Новое: …»

🎙Сужайте запрос
Один «монстр-промт» часто дороже, чем 2–3 коротких шага.

Пример пайплайна:
«Составь план из 6 пунктов.»
«Раскрой пункт 3 (100–150 слов).»

🎙Минимизируйте примеры
Примеры — самые дорогие токены: используйте не более одного короткого примера

🎙Сжимайте большие входные данные
Если надо обработать лог/текст/таблицу — сначала сожмите файл, потом работайте с краткой версией. Если нужно проанализировать таблицу xlxs или pdf, лучше скормить ее в формате csv или xml

🎙Запрещайте лишнюю глубину
Если не нужна лекция — это надо явно сказать:
«Без исторической справки»
«Не объясняй базовые термины»
«Без примеров»
«Сразу к сути»

🎙Просить уточнения одним блоком
Чтобы модель не растягивала диалог:
«Если данных не хватает — задай до 3 вопросов одним сообщением.»

🎙Делать компактные разделители
Короткие кавычки/теги лучше длинных вводных:
✔️Вход: """..."""
❌ «Далее приведён текст, который нужно тщательно…»

🎙Запрещайте повторения
Модель часто пересказывает условие. Это лишние токены.
Используйте фразы:
«Не повторяй задачу»
«Без перефразирования входа»
«Сразу ответ»

🎙Для серийных задач — один раз задайте правила, дальше только данные
Один короткий «системный» стиль → потом дешёвые запросы.

Пример:
Правила (1 раз): «Всегда отвечай 5 буллетами до 15 слов.»
Далее: «Вход: """новый текст"""»

🎙Требования — через параметры
Вместо длинного описания желаемого ответа:
«Тон: нейтральный. ЦА: менеджеры. Цель: решение. Формат: 6 буллетов.»

P.S. С некоторыми людьми, иногда, хочется применить те же правила 😁
  • 👍 10
  • 🔥 8
  • 😁 7
  • ❤ 1
More from @dsbim
  1. Sep 18, 2026BIM-зарядка от ПСС 🔥
  2. Sep 16, 2026Департамент градостроительной политики Москвы разъяснил, как считать ТЭП проекта на этапе…
  3. Sep 12, 2026Мы снова это делаем. SYNERGY BIM TOUR 2027 — 19–21 февраля. Если вы были с нами в прошлом…
  4. Jul 25, 2026Post #565
  5. Jul 25, 2026Post #564
  6. Jul 25, 2026ПИК снова сделал крутой сервис, ИИ-агента, который создает планировки вместе с комплектаци…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →