
Le
CAPTCHA (Completely Automated Public Turing test to tell Computers and Humans Apart) est un petit système de contrôle basé sur le test de Turing qui
permet de différencier les humains des machines sur Internet.
Il est utilisé par les sites Internet pour vérifier qu'ils ont affaire à un humain plutôt qu'un ordinateur, au moyen d'un mot visualisé dans une image et à retranscrire pour valider un formulaire de saisie par exemple.
Google vient de racheter la société
reCAPTCHA, une start-up spécialisée dans ce domaine.
reCAPTCHA a mis au point une technologie qui consiste à réutiliser de vieux journaux pour faire les images et d'utiliser un système de Reconnaissance Optique de Caractères (OCR) pour vérifier le mot écrit par l'utilisateur.
reCAPTCHA est déjà utilisé par plus de 100.000 sites Web.
Google va adapter la technologie de reCAPTCHA pour protéger ses services et ses sites (notamment les recherches pour éviter les attaques par requêtes multiples).
Mais c'est surtout la technologie OCR qui intéresse Google, qui va lui permettre de numériser plus facilement les livres et journaux
dans le cadre de Google Books.