سالای اولیه دهه ۲۰۰۰، گوگل مشغول اسکن میلیونها کتاب برای پروژه Google Books بود.نرمافزارای تشخیص کاراکتر (OCR) بسیاری از کلماتو به دلیل کیفیت پایین اسکن نمیتونسن بخونن
- تشخیص دستیشم پرهزینه و زمانبر بود
یروز اریک شمیت مدیر فنی گوگل میاد دانشگاه اینا برا سخنرانی برا دانشجو های ارشد دکترای کامپیوتر.
در همون زمان پدیده جدیدی به نام باتها در اینترنت رو به رشد بود و دهن گوگلو سرویس کرده بود. اشمیت تو سخنرانی میگه آره خلاصه الان ما بزرگترین چالش مون تشخیص ربات از آدمه که زیرش زاییدیم و سخنرانی تموم میشه. این لوییس فون کان زرنگ بعد سخنرانی میره پیش شمیت میگه من میدونم وقتی غولهای سیلیکون ولی میان یه مشکل رو تو سخنرانی هاشون میگن دنبال یکی ن که بلد باشه حلش کنه و سوسکی میخوان مفت بری کنن. شمیت میخنده میره برو بچه جان گیرم که همین باشه مثلا تو راه حل داری؟
اینم میگه عه اینجوریه؟ باشه کسکش. چند ماه بعد راهحل ساده ای اختراع میکنه: تمام کلمات کتابها که از فیلتر اولیه پردازش تصویری گوگل رد شدن ولی برای تایید نهایی نرم افزار ocr توشون گیر میکنه و دابل چک نمیشن رو میریزه تو یک دیتابیس. ازون طرف به هر کاربری که سایتها حدس میزنن بات هست، یکی ازین میلیونها عکس کلماتو نشون میدن میگن بنویس این کلمه چیه. چیزی که کاربر مینویسه رو با چیزی که تو برداشت تصویری اولیه انجام شده تطبیق میدن، هم ربات نبودن کاربر اثبات میشه هم اون کلمه بصورت دوبار تایید وارد اون کتاب در گوگل بوکس میشه. ینی ملیون ها نفر ساعت مجانی بکار گرفته میشه برا تکمیل آرشیو گوگل بوکس بدون اینکه خود آدما بدونن. میفرسته اینو برا اشمیت. پشماش میریزه، reCaptcha رو گوگل میخره از ایشون! شمیت میگه بیا تروخدا مدیر lab گوگل بشو، این میگه نوچ. وقتی داشتم تافل میگرفتم بیام آمریکا درس بخونم هیچ کلاس زبانی تو کشورم نبود. میخوام اپ آموزش زبان بزنم. درنتیجه دولینگو
😉 KeowMarte
🚀@IranCoderz 👨💻
