TGViewer
Kotelok Kotelok @kotelok_longread · 319 subscribers
Post #247 217
А вы наймёте нейросеть? (продолжение)

Раньше я рассказывал как популярные LLM пытаются отвечать на вопросы с собеседований.
Контекст простой: LLM получает график в виде картинки и задание в виде текста, думает недолго и пытается ответить за человека, который претендует на позицию аналитика в коммерческой компании.
Результаты до этого были разные. Конечно, они были спорные, конечно, было много умных формулировок, была уверенность в своей правоте, были хорошие мысли, которые могли бы быть началом интересного разговора. Но важные смысловые мелочи терялись постоянно.

Есть у меня ещё одна задача. Меня часто за неё критикуют. Считается, что она слишком жестокая для собседования аналитиков.

А я считаю, что у неё очень "сильный сигнал", то есть результаты по этой задаче имеют высокую корреляцию с набором других важных навыков. Как сказали бы в ЧГК, это "разводящий" вопрос.

С одной стороны, вы уже знаете, что есть подвох. С другой стороны, ну мы же тут развлекаться пришли.
Давайте попробуем её посмотреть.

Задача №3
Представьте, что у нас есть хороший приносящий деньги бизнес, за который не стыдно: у нас есть много лояльных клиентов. Например, у нас есть интернет-магазин и есть email-рассылка с каталогом товаров, на которую законно и этично подписана большая аудитория. Они видят в своём почтовом ящике письмо от их любимого бренда, открывают его, смотрят описания товаров (акций, спецпредложений — ну чего-то), в конце письма есть кнопка “Купить” (нейтрального цвета как обычная кнопка в интерфейсе) после нажатия на которую переходим на сайт. Там уже можно что-то купить.

Продуктовой команде пришла в голову идея поднять продажи с помощью изменения цвета кнопки.

Нам опять повезло, не психология, не привязанность к бренду, не долгосрочные прогнозы, а продажи здесь и сейчас.

Решили провести тест: разделили всю нашу лояльную (давшую согласия на обработку персональных данных и рекламную рассылку) аудиторию на три группы: контрольную (в которой примерно 90% аудитории) и две экспериментальных, с зелёной и красной кнопкой (примерно по 5%).

Ждём фиксированное время и смотрим на следующие результаты теста.

Зелёным подсвечены места, где результат теста статистически лучше базового. Если бы где-то было статистически хуже — это было бы подсвечено красным.

Тест "крутился" правильное время, ошибок в формуле подсчёта статзначимости тоже нет.
  • ❤ 2
More from @kotelok_longread
  1. Sep 24, 2026А ещё у меня теперь есть своя книжка полка на Литрес! С UTM-метками и скидками. Не знаю по…
  2. Sep 23, 2026Завтра выступаю на конференции Marketing data analytics 2026 с темой "Широкие данные спеша…
  3. Sep 17, 2026Контакт Карл Саган Contact 1985 Крутой учёный и легенда научпопа пишет художественное прои…
  4. Aug 20, 2026А вот оно как вышло. На самом деле, и скорость, и расход сил бегунов - это очень хорошо из…
  5. Aug 20, 2026Не, а правда, какая скорость у бегунов на разных дистанциях? Там же миллион сложных процес…
  6. Aug 20, 2026photo post
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →