TGViewer
Channel Public Channel
Сповідь тестувальника

Сповідь тестувальника

@qa_confession

🔹Відверті думки тестувальника.
Автор: Олекса Мащиць.
🔸Підтримати автора або доєднатися до QA КЛУБУ: https://base.monobank.ua/3dHV4RUJM3fVn4
Subscribers
601
Photos
23
Videos
4
Links
24
Recent Posts 19 shown
Post #122 165
Привіт, мій щоденнику...

Так приємно чути, коли фахівці використовують правильні терміни! Дивився зараз щоденник однієї з сучасних ігор й на відео розробники кажуть, використовувати машинне навчання (ML) при створенні нового моба у грі. Саме машинне навчання, не штучний інтелект.

І це правильний підхід. Річ у тім, що формально AI є парасольковим терміном, що містить в собі цілу низку інших. Але в побутовому використанні таке узагальнення створює плутанину та призводить до того, що навіть президент США наказує називати ШІ суперінтелектом, підкреслюючи, що "штучний" занадто слабке слово для нього.

Ну а в професійному середовищі це ще важливіше — правильна термінологія.

Можна помітити ось який цікавий нюанс. Коли чуєш, як кажуть про ML, то чітке відчуття великого внеску людини. "Ми використовувати машинне навчання, щоб створити.... ". А коли кажуть AI, то це звучить як магія. "Це було створено із використанням AI" — наче ШІ (майже) самостійно щось робить.

Термін "ШІ" тепер дуже щільно прив'язаний до духу вайбкодингу. Це дух у стилі фрази про кольт: "Бог створив людей різними, кольт (револьвер) зрівняв їх права". Дух відкритих можливостей для не-фахівців. Тому й звучить "ШІ" як магія.

А ось коли кажуть про використання ML, то дух інший. Розумієш, що треба знати, як те ML використовувати, шо це не просто чат, не агент, якого зараз створюють школяри. Відчуття кваліфікації та знань.

Але ML є частиною AI. Й коли думаєш про це в контексті тексту вище, то розумієш, наскільки в неправильний бік зайшло використання терміну AI. Вже не кажучи про SI.
  • 👏 9
  • ❤ 2
Post #121 257
Привіт, мій щоденнику...

Знову про "ШІ"-пошук у Гугл. Щойно шукав інформацію про одну гру, прочитав відповідь вбудованого Gemini. Все виглядало дуже красиво, структуровано, українською...

Але після я пішов дивитися різні посилання зі "старомодного" гугл пошуку. І ось що сталося. Вся ця красива відповідь Gemini це просто перший коментар до схожого на моє питання на Reddit. Буквально. Бо сам гугл пошук видає посилання на цей Reddit першим.

Ось і все. Перше посилання з пошуку, перший коментар безіменного користувача давністю 1 рік — й будь ласка, відповідь від "ШІ".

Тут "ШІ" виступає як дуже й дуже обмежений інструмент швидкої генерації тексту, як бачите — ніякої інтелектуальної роботи зроблено не було.

Але скажу відверто: як же хочеться, щоб ці "ШІ" відповіді у пошуковику були правильними! Бо це дуже зручно. Але чим далі я вдивляюся в них, тим більше розумію, наскільки неточними вони є.

А тепер подумайте про те, що я зі своєю думкою та колупанням в такій меншості, що ніхто й не помітить. Люди масово користуються. Вірять.

Сумно.
  • 👍 11
  • ❤ 1
Post #120 269
Post #119 416
Привіт, мій щоденнику...

Все частіше чую тези про заміну тестувальників агентами/скілами. Мовляв, якщо створити агента, що пише тести (скажімо, навіть окремо по рівнях), то після цього тестувальник не потрібен.

Це велика помилка, бо агент/скіл — не людина, а створення агента — не навчання фахівця.

Ваш агент дійсно може працювати. Спочатку. А потім щось зміниться. Бо завжди змінюється. Нові фічі, нові архітектурні підходи, рефакторинг, навіть зміна підходу до тестування може знадобитися. І все, агент застарів й самотужки не зміниться. На відміну від людини, яка як раз навчена адаптуватися та використовувати для цього свою освіту та знання.

Але я чую це. Що від нас хочуть, щоб ми створили агентів, а потім нас звільнять, а агенти будуть працювати за нас.

Я досі не певен, що створення агентів/скілів з тестування лише тому, що це тренд, виправдано. Або що це виправдано у більшості випадків. Через те що скіл виконує лише частину роботи й не адаптується.

А ще цю роботу треба перевіряти... І нести відповідальність за неї. Це робота людини.

Складаючи все докупи, не складно зрозуміти, чому ми не бачимо реальних кейсів, щоб це працювало. Не одноразово, не на прикладі однієї фічі а-ля реєстрація користувача. А системно, де місяць за місяцем агент/скіл успішно замінює людину тестувальника. Замінює, збільшує якість роботи та зменшує її вартість.

Йдеться про індустріальний рівень. Пет-проєкти чи рідкісні випадки соло-тестувальників варто розглядати крізь зовсім іншу призму.

І не кидайте мені у відповідь тезу про "всі так зараз роблять". Бо це буде типовим Bandwagon Effect, когнітивним упередженням наслідування мас. Простіше кажучи, аргумент "всі так роблять" — це останнє, що я хотів би почути від інженерів. Бо це не аргумент
  • ❤ 17
Post #118 316
Привіт, мій щоденнику...

Безглузда статистика. Загальний досвід учасників конференції "Бетельгейзе-2026" — 175 років.

Але. Чомусь ось таке дуже люблять читати. Чому? Психологія? І до чого тут тестування?

Ну, йдеться ж про користувачів, правильно? Будь-то соцмереж чи іншого програмного забезпечення. Йдеться про поведінку та досвід користувача. І хоча це сильно у бік саме UX тестування, ніж інженерних деталей софту, є питання до тестувальників.

Скільки з вас почали читати цей допис та подумали: "Господи, як же це не потрібно для реального тестування!". Проте, це означає свідому відмову від кращого розуміння людей.

Розуміння людей. Але ж ми змалечку (у професії) вчимося, що ми такі собі "адвокати" користувача та маємо "дивитися його очами" й оце все. Правильно?

Думаю, ми лише поверхнево торкаємося цього аспекту поведінки (та очікування!) користувача. Трошки ми розуміємо: кнопка скасовування краще щоб була червоною/жовтою, тоді як кнопка підтвердження зеленою/синьою тощо. Але дуже швидко ми тут й зупиняємося. Тоді як психологія драматично впливає те поведінку користувача. Ця поведінка робить одні бізнеси заможними та вбиває інші.

І ось приклад. З тими ж кнопками. Як мають бути розташовані "OK" та "CANCEL", коли вони поруч одним блоком? Як з них ліворуч, а яка праворуч? А що, якщо я скажу вам, що обидва варіанти абсолютно нормальні в плані UX? Ось тільки існує ще ціла низка додаткових умов, коли працює то один варіант, то другий.

Не все так однозначно. Та ситуація, коли цей вислів є доречним.

Й цього не вчать буквально ніде. З власного досвіду скажу, що певна освіта в напряму графічного/комп'ютерного дизайну просунула мене в цьому напрямку, і це один зі способів навчитися. Почати розділяти UI та UX, Або... як раз не розділяти їх?

Вийшов допис про недооцінену навичку для тестувальника, яку навіть не одразу придумаєш, як правильно назвати. А дарма, дарма...

Ах, ось ще. Саме тут криється мега-супер-пупер популярність "ШІ" серед широкого(!) кола споживачів. Вони грають на психології людини максимально круто (що лякає). Зовсім не їх можливість бути гуглом на максималках робить "ШІ" таким популярним серед побутового споживача. Зовсім не це.

Отже...
  • ❤ 2
Post #117 340
Привіт, мій щоденнику...

Замість привітання з Днем тестувальника. Адже дивно вітати самого себе, якщо я пишу це у щоденник.

Так ось. Думка.

Якщо ми масово звикаємо (або нас спонукають) сприймати вайбкодинг та вайбкодерів секрйозно, мовляв, вони є майбутнім розробки і тут без варіантів. Звикни або помри. Нагадаю, що вайбкодер — не кодер. Інфопростір любить історії де саме той, що раніше не написав ані рядка коду, презентує готовий додаток.
Якщо так, то мають бути вайбтестери з такою умовою. Правильно? Ну, логічно ж!

Тестувальник майбутнього — це той, хто раніше ані хвилини не тестував програмне забезпечення, а зараз, озброївшись асистентами та агентами на базі LLM презентує нам чудово протестовані продукти.

Цікаво, чому так багато навколо про вайбкодерів. але зовсім нічого немає про вайбтестерів?

Ось таке. Вітаю з Днем тестувальника того, хто раптом підгляне у цей щоденник. Вітаю, друже! Підглядай на здоров'я!
  • 👍 15
  • ❤ 11
  • 😁 1
Post #116 319
Привіт, мій щоденнику...

Написав у лінкдин, а потім зрозумів, що краще місце для цієї цитати саме тут. Отже.

Євген, розробник гри "Острів" на власному 3D рушії:
Програмний код – це найкращий спосіб сформулювати ідею. Звичайна людська мова, якою звертаються до LLM, не здатна до такої точності. Це як нейрохірургія по телефону.

Завищені очікування від делегування написання коду чат-ботам чи агентам зумовлені хибним уявленням про те, що саме написання коду є обмежувальним фактором.

Якби це було правдою, враховуючи, як давно ми маємо LLM зі здатністю писати якісний код, ми б уже давно мали випущені Half-Life 4 та GTA 8. Натомість маємо кожні 20 хвилин нову гру на Steam, більшість із яких не варті й хвилини уваги.

Я мало чую в цьому контексті про один дуже важливий аспект будь-якої творчості – уміння розуміти чи вона "чіпляє". Ніхто не може навчити ШІ цьому розумінню, бо ніхто поки що не знає як це працює.

Визначні речі роблять, перш за все, визначні особистості, а не продуктивні інструменти. Я маю надію, що нові інструменти дозволять більшій кількості людей реалізувати свій потенціал і стати кращими (або, можливо, навіть визначними) фахівцями.

Але це, звісно, лише за умови якщо всі не будуть поклонятись нейромережам, як рішенню всіх задач і відповіді на всі питання.
  • 👍 10
Post #115 275
Привіт, мій щоденнику...

Вбудований в Chrome блок з відповіддю LLM працює погано. Раніше він буде схожий на звичайний Gemini своєю поведінкою, але з часом поведінка вбудованого у пошуковика Gemini ставала все більш специфічною.

Зараз пошуковий складник в ньому набагато сильніший за "великий розумний" Gemini, Здавалося б, так і має бути, адже це фіча саме пошуку. Але ось де це ламається максимально сильно.

Звичайна гігантська хмарна модель "ламається" на свіжих даних так, що це легко відчути. Наприклад, каже, що певна модель смартфона чи відеокарти ще не вийшла, хоча це сталося пів року тому. Або що певний політик ще не був обраним на посаду, хоча це вже давно не так.

Пошуковий LLM напроти — активно шукає свіжу інформацію. Але проблема у тому, що він не дуже розуміє її релевантність та легко видає чутки та поодинокі статті чи дописи за правдиве джерело. І робить це у фірмовому стилі мовних моделей — впевненим тоном. А якщо ви будете просити пораду "як зробити?", то він впевнено буде друкувати вам інструкції. Хибні.

Хибить він не лише у свіжих даних, але й у таких, яких мало на потрібну тему. Для моделі достатньо 1-2 джерел, щоб "натягувати" їх на будь-які запити на тему.

Порада тут незмінна й стосується як хмарних асистентів, так і й оцього пошуку. Аналізуйте, чи ваш запит про більш-менше поширену тему чи він специфічний. Будь-яка модель не схибить у датах Французької революції, але якщо ви хочете розібратися, чому ваш ПК не працює, як треба зі специфічним софтом, в чому може бути причиною ваше залізо, то відповідь буде просто спамом, в якому краще розбиратися вручну та самостійно.

Або можете запитати про автора якоїсь статті на DOU. Він знайде статтю, соцмережі автора, але додумає так багато навколо, що жах. Але впевнено. Ще гірше, якщо ви будете питати далі про мотиви людини чи її роль у спільноті. Вам буде надана відповідь. Вона буде на 80% вигаданою та спиратиметься на "сферичного коня у вакуумі", що був сформований при навчанні моделі на великому датасеті.

Я все одно користуюсь цією фічею пошуковика. Але зізнаюся — вона тримає мене у постійній напрузі. У цьому сенсі сторінка Вікіпедії набагато чіловіша. Її вірогідність дуже висока, а за потреби ви легко та спокійно аналізуєте джерела чи зауваження редакторів.

Стохастична природа мовних моделей збільшує рівень стресу. Детермінованість — знижує. Це проста психологічна аксіома. Інше питання, якщо ми почнемо масово сприймати стохастичність (невизначеність) за детермінованість (визначеність), і мені здається, цей процес вже активно відбувається.
  • 👍 7
  • 🥰 1
Post #112 334
Привіт, мій щоденнику.
Така рефлексія.

Коли я започаткував конференцію з якості та тестування "Бетельгейзе", я думав, що це логічно, бо я тестувальник. Через рік вона стала найбільшою в Україні онлайн конференцію в цій галузі.

Не одразу я зрозумів, що тут цікавий симбіоз вийшов. Річ у тім, що кілька років тому я активно працював у соціяльній галузі та в рамках ГО роками робив дуже великий фестиваль "День Музики у Харкові". В певний момент він став найбільшим музичним фестивалем в Україні, що відбувається просто на вулицях міста. А потім ми привезли його ще й у Краматорськ, Покровськ та Костянтинівку...

Я спеціяльно відшукав старі відео. Вони на зображеннях до допису. Якісь просто шалені цифри!

Коли мені погано (що буває частіше, ніж може здаватися), я пригадую такі досягнення й вони вселяють в мене позитивний дух та силу продовжувати. У депресивному стані я думаю, що "Бетельгейзе" не дотягує, що треба ще краще, ідеальніше, чіткіше. А у позитивному стані я думаю, що День Музики був настільки більшою подією, що переживати за (поки що) значно меншу "Бетельгейзе" зовсім не варто, і що вона доволі якісно та з душею зроблена.

Ось таке одкровення.
  • ❤ 16
  • 🔥 4
  • 👏 1
Post #111 424
Привіт, мій щоденнику...

Новий застосунок ChatGPT, який тепер став багато функціональним та містить не лише Chat, Work, але й Codex, мені подобається. Інтегрований браузер може здатися дрібницею, але це та дрібниця, яка допомагаю залишатися фокусованим та не витрачати зайвий час, перемикаючися між різними вікнами. Перемикання між Chat та Work відбувається органічно й це теж корисна фіча.

Не буду перелічувати інше, бо там дійсно багато всього, при чому дійсно корисного.

Трохи лякає те, як тепер застосунок "затягує" в себе та намагається тримати. Але він точно заслуговує уваги хоча б для знайомства.

Ще не визначився з улюбленцем (але вже створив власного), але ідея слідкувати за статусом роботи, поки ти перемкнувся на іншу роботу поза застосунком — гарна.

Це лише перші враження, які я накопичив за певний час та поділився зі щоденником. Тестую далі.
  • 👍 9
  • ❤ 2
Post #110 611
А чому б мені саме для вас не зробити ексклюзив? ✨

Ви перші дізнаєтеся про відкриття продажу квитків на конференцію Бетельгейзе 2026 (а це, на хвилиночку, найбільша онлайн конференція тестувальників в Україні). Вона відбудеться традиційно у треті вихідні жовтня (17-18).

Поки ми працюємо над програмою, є можливість придбати квитки "Рання пташка" за дуже зниженою ціною (‼️лише 50 квитків).

А якщо хочете подивитися, що таке "Бетельгейзе", то можна оцінити минулі події:
- Бетельгейзе 2024
- Бетельгейзе 2025
- AI-meetup від Бетельгейзе

А це офіційна сторінка Бетельгейзе, де можна слідкувати за програмою та придбати квитки: https://betelgeuse.qaukraine.online/
  • ❤ 11
  • 🙏 2
  • 🤝 1
Post #109 525
  • 😁 18
  • ❤ 1
Post #108 673
Привіт, мій щоденнику...

Зазвичай це я, той, хто каже, що треба піти почитати та дізнатися перед тим, як скаржитися. Це я про софт. Та випадки, коли він нього очікують чогось просто тому, що ось так хочеться і через те він має саме так і робити. А він не робить й ніколи не робив.

Але сам потрапив у ситуацію. Але...

Так, я міг піти почитати про те, що Codex тепер інтегрували у ChatGPT. Міг також почитати про те, що тепер є стара апка й нова. В страрій немає Codex, але він є в новій. Стара у мене запускається автоматично зі стартом ПК, нова — ні (на разі). І ось у чому річ.

Сам застосунок ChatGPT не сказав мені про зміни. Я не отримав також листа від OpenAI про це. Але з оновленням мій Codex просто зник. І, увага: старий застосунок не став новим, а отже я отримав лише те, що тепер Codex просто видалився. У пошуках проблеми я знайшов, що багато користувачів також "загубили" Codex.

Отже, я виявив причину та встановив новий застосунок і в ньому Codex є. Але знову ж — тепер я маю два застосунки, один з яких називається ChatGPT Classic, а інший просто ChatGPT.

Я про що? Зараз дуже багато софту по суті є монополіями. І розробники дозволяють собі все більше отакого ставлення. Лише вдумайтеся: не прочитавши новину, не слідкуючи за блогом на сайті OpenAI я б не дізнався про зміни. Але мій Codex був просто видалений без жодного попередження, він просто зник.

І це сумно. Здається, пророцтва про "злі корпорації" можуть виявитися не такими й смішними (як я думав все життя). І я не про теорію змови, а про ось таке ставлення. З "ШІ" це особливо яскраво проявляється. У нас взагалі не питають, чого ми хочемо — просто ставлять перед фактом. Це абсолютно інший світ софту і це виховує абсолютно інші корпорації. Бити на сполох рано, але тенденція мені не подобається.
  • 👍 8
  • ❤ 3
Post #107 400
А ви знаєте, що я разом з колегою створив вже 6 випусків подкасту? Якщо вам довподоби дописи тут, то дуже ймовірно, що сподобається й MRG podcast. Він також доволі нетиповий, як на мене.

Ми кажемо, що це вдумливий подкаст про технології, софт та тестування.

📱 🎵 📱 Доступний на YouTube (наживо), а також на Spotify та Apple Podcasts.

Зазирніть, підписуйтеся, якщо цікаво. Підтримуйте, якщо корисно.

➡️ https://linktr.ee/mrgpodcast
  • ❤ 12
  • 👍 4
Post #106 462
Привіт, мій щоденнику...

Контекст. контекст... ми так багато знаємо про контекст... у контексті роботи з мовними моделями а також і так мало! Ось свіжий приклад, який потрібно екстраполювати на інші сценарії роботи з LLM.

Роблю простий запит у гуглі:
- Confluence analog

Що може бути простіше, що може бути не так з контекстом цього елементарного запитання?

Вбудована модель починає мені казати про аналоги, а також доволі багато розповідати про аналоги саме для російського ринку.

Випереджаючи можливі запитання. Не маю російської мови ніде на ПК. Вона повністю вимкнена і у налаштуваннях хрому та пошуку гугл. Запити російською не робляться. Цей запит був англійською.

Отже, я питаю — чому ти мені кажеш про російський ринок? І модель каже, що подібні запити(!) частіше зустрічаються саме у контексті російського ринку, бо у них там проблеми з конфлюєнсом. Отже, модель зважила ймовірності та вирішила, що саме ця інформації мені потрібна.

Звісно, ми можемо думати про те, як уникнути подібного, міркуючи про цей випадок. Але подумайте про інше. Не про цей випадок. А про те, що ви НЕ ЗНАЄТЕ, що може вплинути на контекст вашого наступного запиту. Думати ретроспективно легко, але хто з нас міг очікувати подібної відповіді? Хіба що хтось в курсі того, що в росії популярні такі запити. А також, що їх так багато, що для моделі це стає важливим контекстом. А ще, що попри всі налаштування, модель вирішить сказати про це користувачеві на запит англійською.

Ось ще одне питання контексту, про яке модель не сказала, але я думаю, що воно існує. Не думаю, що якби запит був з якоїсь Великої Британії, то модель також говорила б про російський ринок. Я думаю, що модель знає про те, що українці часто гуглять російською та споживають контент з росії. А отже, вона буде змішувати наши контексти.

Але знову ж, подумайте, якою має бути ваша обізнаність та кваліфікація, щоб передбачити цю поведінку моделі?

Диявол в деталях. Мовні моделі дуже чутливі до них. Це дозволяє їм видавати унікальні та корисні результати. А також й ті, що лише виглядають такими. І коли ми починаємо використовувати їх в роботі, то це стає критично. LLM потребує суворої упряжі, максимально визначених вами обмежень. Це ніколи не дасть вам гарантію, але зменшить ймовірність хибних результатів.
  • ❤ 11
  • 👍 4
Post #105 480
А ось реальний випадок з моєї практики на тему сертифікатів.

Якось на проєкті ми дискутували з колегою про структуру для організації текст кейсів у тест менеджмент системі. Вічна тема, бо існує декілька підходів і я б не сказав, що є лише один правильний. Наприклад, основою структури можуть бути фічі, а можуть бути розділи в інтерфейсі. Проблема вибору у тому, що розділи є зрозумілими людині, бо вона їх бачить: домашні сторінка, каталог, профіль тощо. А фіча часто пронизує декілька розділів та ще й у різних комбінаціях. Ще один підхід: створювати папку з тест кейсами просто відповідно до кожної user story, які можуть бути дуже різними, що дасть просто список з десятків папок без структури. Але зараз не про це.

В моїй історії дійшло до відстоювання підходу кожного перед керівним менеджером. Я доводив ефективність власного підходу, колега — свого. І в якийсь момент, коли "перемогти" ніяк не вдавалося, колега дістала козир. Було сказано, мовляв, я міжнародно сертифікований фахівець (приблизно цитата), а тому я краще знаю. Йшлося про ISTQB Foundation Level.

А я цього сертифікату не мав. Хоча я знав, що ISTQB FL не покриває тему "як систематизувати структуру тест кейсів на проєкті". Бо я, звісно ж, читав матеріяли хоча б тому, що популярні у спільноті джерела важливо знати, як би ти до них не ставився.

Що ж, я відповів, що цього в FL немає. Але мої слова (без сертифіката) часто будуть важити менше, ніж слова людини, яка цей сертифікат має. Навіть якщо вона відверто бреше.

Наш менеджер нічого не знав про сертифікат, крім того, що він існує. Він опинився у складному становищі. Це призвело до зовнішнього аудиту, на що були витрачені додаткові ресурси, бо менеджер не зміг обрати щось одне. А сертифікована колега все ж отримала свою вигоду. Їй дозволити створити паралельну структуру, і ми мали дві одночасно, з усіма очікуваними наслідками — дублікатами, плутаниною тощо.

Це використання сертифіката, про яке не говорять публічно. Але яке існує. Твій менеджер вимушений(!) довіряти гучному імені та статусу "міжнародного", і це дає тобі можливість просувати рішення, які можуть навіть не узгоджуватися з тим, на що ти сертифікувався. Якщо твій керівник не має такого ж сертифікату, то це дає тобі карт бланш. Й багато хто користується цим.

Тому про це ніхто й не каже. Але це ж мій щоденник, а отже... ніхто не дізнається, правда?
  • ❤ 14
  • 😢 5
  • 🐳 1
  • 😐 1
Post #104 376
Привіт, мій щоденнику...

Читаю статтю, де, цитую, "ШІ директор в EPAM Україна", розповідає про сертифікацію від Anthropic. Ставиться до неї позитивно, і вже в назві першими словами є "Знак якості", що сертифікат є саме таким знаком.

Це експозиція. А допис лише про один нюанс, який мене зачепив.

У статті Вадим зазначає, що на іспиті є питання, де Антропік дає сувору відповідь, від якої не можна відійти, бо це вважатиметься за неправильну відповідь. Попри те, що він, людина з освітою у галузі комп'ютерних наук, розробник та архітектор, має реальний досвід створення програм, де свідомо обиралися інші рішення, бо вони кращі.

Вадим каже, що в софті для контакт-центрів вони робили декілька ітерацій чатбота перед тим, як перенаправляти розмову на реальну людину. Тоді як в Антропік є лише одна правильна відповідь: як тільки людина просить контакт з живим консультантом — миттєво переводити розмову на живу людину.

Це цікаво. Я сам часто хотів би, щоб автоматизована підтримка швидше переводила мене на живу людину. Але також я розумію, що дуже багато людей оберуть таку людину одразу ж, не розбираючися у ситуації, хоча чатбот може допомогти у цьому.

Якщо ви хочете відстоювати право людини на розмову з іншою людиною, то це дещо інша тема, бо більшість може обрати саме це. І це цікавий парадокс, коли свідомо не робимо те, що хочуть люди. Але поки залишимо цю тему.

Отже, практика реальних проєктів каже Вадиму, що можна (й треба) робити ітерації чату перед переводом на живу людину, але для сертифікації маєш обрати інший варіант.

І це те, чому часто критикують різні сертифікації. Люди з реальним досвідом мають завчати правильні відповіді. І це вже не структурує знання, але вносить хаос. Далі враховуємо, що є певний відсоток таких відповідей. Тоді що показує отриманий сертифікат, якщо я в реальності буду періодично робити не так?

Роботодавець дивиться: я маю сертифікат. В ідеальній картині це значить, що він очікує від мене відповідності системі знань, що лежить за ним. А в реальності я ігнорую частину цих знань та роблю інакше. А роботодавець навіть не знає, в яких місцях я відступаю від сертифікованих знань.

Ба більше. Сертифікати часто є базою для вимоги більшої ЗП. Аргумент тут саме в тому, що я працюватиму відомо як — за тим, що підтверджує мій сертифікат. Але я цього не роблю в частині випадків. Тоді за що мені платять більшу ЗП?

Звісно, не всі сертифікації такі. Але ситуація цікава. Особливо, враховуючи, що розробник LLM та чатбота навколо неї вказує, як розробляти софт для реального сектору, в якому вони не мають майже ніякого досвіду.
  • ❤ 11
  • 👍 1
Post #103 332
Привіт, мій щоденнику...

В топах технологічних новин традиційно — нові версії мовних моделей від гігантів ринку. Новини ж, що у певному сенсі протистоять їм — ігноруються (я певен, що часто півсвідомо, but still).

Це новини, на тлі яких багато досвідчених інженерів могли б говорити зараз: "А я казав!" про свої застереження починаючи вже з 2023 року (2022 залишимо на суцільний вау ефект).

Так ось. Ford за останні три роки(!) повторно найняла 350+ досвідчених інженерів, щоб виправити помилки "ШІ", який став активно виконувати роль контролю якості. Ford каже, що "ШІ"-системи не виправдала очікувань.

Ми помилково вважали, що достатньо просто впровадити штучний інтелект і завантажити в нього наші вимоги до проєктування, щоб отримати продукт високої якості. Але ми зрозуміли, що для вдосконалення наших систем автоматизації, машинного навчання та штучного інтелекту необхідно, щоб їх навчали саме найдосвідченіші фахівці.


Ви можете сказати, що це значить лише те, що ці інженери навчать ШІ та вже остаточно стануть непотрібними. Але зверніть увагу на те, що Ford чомусь сподівалися, що "ШІ" вже містить необхідні знання, а мізки живих людей не є чимось унікальним. Одним словом, що тоді, коли вони почали заміну інженерів, "ШІ" вже був "розумнішим" за них. Ось це важливо. Те, як ми можемо переоцінювати "ШІ" в конкретних застосуваннях.

Чи буде Ford бажати заміни цих інженерів знову, коли вони передадуть знання? Навряд, бо ситуація каже про те, що не всі знання легко переносяться, а відсутність людини може бути критичною та не мати ніяких переваг, крім недоліків.

Цікаво й те, що Ford пробували застосувати підхід, коли дефекти усуваються вже після їх появи на виробництві. О, я впізнаю те, що так активно просуваються вайбкодери. Звісно ж, бо цей підхід "узаконює" сам факт існування багів у проді. Отже, Ford перейшли до моделі запобігання помилкам ще до запуску деталей у серійне виробництво.

І це дало результати. Ford почав випереджати конкурентів у рейтингах якості.

Мораль? Скажу просто, але широко. Не недооцінюйте голову людини. Та не поспішайте вважати інтелект штучний таким, що впритул наблизився до людського.

П.С. Хто думає, що це гейтерський допис, додам. Ford не відмовилися від "ШІ" у своїх процесах, він досі допомагає їм. Вони лише припинили бездумно довіряти йому та більш свідомо ставитися до процесу роботи. І це ок.
  • 👍 9
Post #102 421
Друзі, дякую за ваші відповіді!

33% це багато чи мало, щоб робити в цьому каналі більше сповіщень про події (що я поки намагався мінімузувати тут)? Поки не знаю, особливо якщо враховувати, що йдеться про мою особисту участь, а не якусь сторонню рекламу.

То ж, буду міркувати далі, щоб тут превалював стиль щоденнику. Це, все ж, головне.
  • 🙏 5
Older posts →

About this channel

How can I read @qa_confession without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Сповідь тестувальника: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Сповідь тестувальника have?
Сповідь тестувальника (@qa_confession) has 601 subscribers on Telegram, refreshed roughly every 30 minutes.
Does Сповідь тестувальника know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →