TGViewer
Channel Public Channel
🍳 Датазавтраки ☕️ НСК (Академ)

🍳 Датазавтраки ☕️ НСК (Академ)

@databreakfast

Каждый вторник с 8:30 до 10:00 в "Shurubor coffeeshop" у фонтана ТЦ https://go.2gis.com/wlkqi

По всем вопросам к @promsoft . Рекламу не размещаем
Subscribers
696
Photos
253
Videos
15
Links
1.9K

Showing posts older than #1938 · Back to latest

Older Posts 20 shown
Post #1935 189

Forwarded from Красные пики (Serge Abdulmanov)

Я тут с интересом наблюдаю за экспериментом, как @illia_martyn убрал редакцию на одном из своих проектов. В смысле, там было несколько человек, включая редактора и копирайтеров. Они занимались новостями.

Теперь там zero-people-company. Эту фразу, я, кстати, на неделе увидел, и до сих пор ржу.

Качество текстов немного выросло — в частности, потому что теперь они всегда основаны на нормальных пруфах. Я чуть поделился фактчекерами и языковыми генераторами, которые делал для писец-бота в том числе, плюс Илья ещё долго учил модели на моих текстах. Пишут они всё равно ужасно, потому что важнее смыслов ничего нет, но это лучше, чем копирайтер с опытом до 5 лет. Модели умнеют. Копирайтеры набирают опыт медленнее.

Потом выяснилось на одном крупном федеральном бренде, замену людей на нейросети один хрен никто не отличит, потому что нормальные SOTA-модели (с развёрнутым в сторону генерации детектором LLM) делают человечнее людей. Я серьёзно. В прикладных применениях на довольно простых по смыслу текстах с очисткой от LLM-признаков — читаются лучше.

У Ильи трафик не упал.

Редакция стоила примерно 5 миллионов рублей за пару лет. Сейчас 100 баксов в месяц на подписку на модель + пару дней разработки (с учётом, что компоненты у Ильи уже были, в т.ч. от других проектов).

Скорость выхода новости уменьшилась со средних 3 часов до 4 минут после первых упоминаний в нормальных иностранных или российских источниках. Потом новость может ещё раз обновиться, если сюжет драматически поменялся.

Прямо сейчас он снимает сливки с того, что ещё не везде и не у всех так.

Дальше трафик, вероятно, переедет в поисковики и ИИ-выдачу, сайты будут не очень нужны. Почему я так думаю — потому что уже:
— Digital Trends, месячный трафик 8,5 миллионов на март 24-го, сейчас -97%
— The Verge, было 5,3 миллиона в месяц, -85%
— HowToGeek, было 2 миллиона, -85%
— TechRadar -74% с 15 миллионов
— Wired -62% с 7,7 миллионов
— CNET -47% с 20 миллионов
— PCMag -41% с 12,6 миллионов


Продолжаю вести наблюдение.
Post #1934 184

Forwarded from Красные пики (Serge Abdulmanov)

Я тут очень рад, потому что доделываю писец-бота. Он редактор и корректор.

Первая магия в том, что вы отправляете текст, и он исправляет все опечатки в режиме рецензирования в Ворде. То есть готовый текст исправленный + видно каждый косяк в родной среде для редактора. Если он сомневается по смыслам, то не корректирует, а пишет комментарий, что, возможно, вот тут имелось в виду другое. И это, мы сравнили корректуру от бота с корректурой опытных людей, и получилось то же качество, но примерно в 70 раз дешевле.

Вторая магия — я примерно 19 лет копил редакторский опыт и повидал всякое дерьмо. Достаточно, чтобы лет пять назад изложить это в виде фреймворка, добавить туда опыт других прекрасных людей — от Норы Галь до Пороховщикова (П. Сергеича) и от Шапиро до Бенсивеги — и сделать набор языкового анализа, который поможет разобраться, что не так с текстом на уровне формулировок. Это прям самое крутое в боте. Там структурный анализ, поиск канцелярита, поиск всякого сложного для восприятия и так далее.

Тоже отвечает отрецензированным DOCX и ещё PDF с теми же правками (списком) — что вам удобнее.

Третья штука — для пиарщиков есть анализ рисков и фактов. Очень полезно прогонять посты и пресс-релизы до выпуска. Там включён фактчекинг, медицинские риски, государственные риски, особенности российского законодательства, риск чужака для местных жителей (например, незнание какой-то особенности региона) и так далее. Очень крутая вещь, которая помогает понять, а не оскорбите ли вы кого-то постом — и понять ДО публикации.

Есть режим улучшения — подсказывает, что можно сделать с текстом по структуре. Ну или какого контекста может не хватать читателю.

Плюс расширенная детекция нейросети — не по жёстким признакам, а по структуре (ну или просто тупого канцелярита, это как пойдёт). Показывает в том числе случаи, где по шаблону от модели проходился правками редактор.

Ещё там есть всякие мелочи вроде обучения выживанию бренда в комментариях Хабра (поскольку мы в агентстве делаем Хабр) и ещё пара странных тестов.

Но главная сила — языковой анализ. Там передовые PRO-модели Antropic/Google, коммерческие API-тарифы (данные не используются для обучения) и куча работы по тому, как всё это сделать быстрым и практически-пригодным. Это писец дорого в плане инференса, потому что цены API очень сильно отличаются от чатов, но конвейер там прикольный.

Работает с любыми жанрами, адаптируется и под пресс-релиз, и под пост в блоге, и под страницу сайта. Но мой фреймворк такой, что он всегда любое лицемерие будет считать ошибкой и требовать исправить.

Собственно, он в бете, заходите тестировать — @pisets_bot.

Всем писца!

UPD: вы, по ходу, мне сейчас нагрузочное тестирование устроите, потому что через 10 минут от публикации сейчас 56 пользователей одновременно выполняют анализы.
  • 👍 2
  • 🔥 1
Post #1929 253
17.03.2026 🍳 датазавтрак по вторникам ☕️ в Новосибирском Академгородке с 08:30 до 10:00 в "Shurubor coffeeshop" у фонтана ТЦ https://go.2gis.com/wlkqi
Post #1918 356
Датазавтракам исполнилось 9 лет ;-)
  • 🔥 28
  • 🎉 14
  • ❤ 4
  • 👏 4
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →