Vue lecture

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.

ScribeOCR - Corrigez vos erreurs d'OCR directement dans le navigateur (en local)

Y’a plein d’images et de scans en PDF sur le net ou sur votre disque dur, qui sont difficilement exploitable / indexables parce que la reconnaissance de caractères n’a pas bien fonctionné. L’OCR automatique a par exemple transformé un mot-clé en charabia et c’est illisible. Du coup, ce passage est perdu dans les limbes et impossible de le retrouver avec une simple recherche textuelle. C’est moche.

Faut dire que le problème est réel car quand on numérise des millions de livres avec un OCR à 90% de précision, ça a l’air génial, sauf que les 10% d’erreurs ne sont pas aléatoires. C’est toujours les mêmes confusions qui reviennent : “A” qui devient “H”, “C” qui devient “G”, “22” qui se transforme en “55”. Et pour les documents historiques avec des polices anciennes, c’est encore pire.

Heureusement, il existe un outil gratuit et open source qui tourne dans votre navigateur et qui va vous permettre de corriger ces milliers d’erreurs OCR sans envoyer vos docs sur les serveurs de Google, Microsoft ou je ne sais quoi d’autre. Cela s’appelle ScribeOCR et vous allez l’adorer !

Pourquoi ? Hé bien parce que c’est un éditeur d’OCR open-source qui tourne à 100% dans votre navigateur, donc aucune donnée n’est envoyée sur le net et parce qu’il est capable de corriger toutes les erreurs efficacement ! L’interface affiche le texte OCRisé par-dessus l’image source, comme ça, vous voyez immédiatement où sont les problèmes et vous corrigez tout ça en série.

Et surtout ScribeOCR génère une police custom pour chaque document. Ça vous laisse garder l’apparence originale du doc, tout en ayant un texte parfaitement indexable pour des recherches par exemple. Vous obtenez ainsi un PDF qui ressemble au document d’origine mais où chaque mot est cliquable et cherchable. Bref, c’est super pratique si vous numérisez des archives ou des vieux bouquins.

L’outil supporte plusieurs moteurs OCR dont Tesseract LSTM et Legacy et vous pouvez ajuster les paramètres de reconnaissance selon le type de document : vitesse, qualité, langue…etc. Y’a même des options avancées pour le debug et l’optimisation des polices.

L’outil permet donc de créer des PDF recherchables à partir de scans (c’est le cas classique) mais également de corriger des données OCR existantes, y compris les fichiers HOCR de Tesseract. Et pour numériser complètement des documents ou livres anciens, l’interface de correction vous aidera à faire de l’excellent travail !

Le projet est open-source (licence AGPL-3.0) , ce qui veut dire que vous pouvez l’auto-héberger si vous voulez. Ainsi, pour l’installer en local, c’est très simple :

git clone --recursive https://github.com/scribeocr/scribeocr.git
cd scribeocr
npm i
npx http-server

Mais si vous voulez juste tester, y’a une démo sur scribeocr.com . Vous uploadez votre fichier, vous choisissez votre langue et votre moteur OCR, et hop c’est parti mon kiki.

Et pour les sorties, vous avez le choix : PDF, DOCX, HTML et d’autres formats. Vous pouvez même ajuster les paramètres d’export selon vos besoins. Auto-rotation, optimisation de police, tout est configurable !

Bref, au final ScribeOCR répare ces angles morts bien relou de la numérisation massive de documents sans que vous ayez à sacrifier votre vie privée !

Et ça c’est cool !

Comet - Le navigateur IA de Perplexity débarque sur Windows

Après avoir secoué Google avec leur moteur de recherche IA qui cartonne (près de 2% du trafic mondial de recherche, quand même), Perplexity débarque maintenant avec Comet, un navigateur qui pourrait bien mettre tout le monde d’accord. En plus, la beta Windows vient tout juste d’être lancée pour quelques chanceux testeurs !

Durant des années, on a tous galéré avec nos navigateurs, à jongler entre 50 onglets ouverts, à chercher ce mail important auquel on a jamais répondu, ou à comparer des prix sur 15 sites différents. Eh bien figurez-vous que les mecs de Perplexity se sont dit “et si on foutait une IA directement dans le navigateur pour que ça fasse tout ça tout seul ?”.

L'actualité résumée de Firefox des dix derniers mois d'après LinuxFr.org

Ces derniers mois l’actualité de Firefox a été traitée principalement dans les Liens : nous vous proposons ici un petit résumé des dernières évolutions du navigateur, à partir de ce qui a été publié sur le site ces dix derniers mois.

Fonctionnalités, performance et vie privée : le panda roux n’a pas été avare de nouveautés sur la période. Hélas, dans le même temps, la poursuite de la réduction de ses parts de marché est source d’inquiétudes.

La présentation de cette dépêche – non nécessairement exhaustive donc – respecte la chronologie des publications ; un commentaire adjoint précise le cas échéant l’importance de la nouveauté selon l’auteur de cette dépêche.

À noter que, dans cet intervalle, onze versions de Firefox ont été publiées (les 116 à 126). La période n’a pas vu de sortie de versions à support long terme ou ESR (la 115 étant la dernière ESR publiée tandis que l’on attend sa successeure, la 128 ESR). Via le calendrier de publication vous aurez accès aux notes de versions de chacune en deux clics (pour éviter les litiges de brevets).

Firefox Crop Circle
Firefox Crop Circle par Andrew sous licence CC BY-SA 2.0

Sommaire

Voyons cela dans le détail :

2023

Juillet (post précédente dépêche)

Août

Septembre

Octobre

Novembre

Décembre

2024

Janvier

Février

Mars

Avril

Mai

Vous pouvez voir le calendrier des prochaines versions : la 127 sortira le 11 juin. À noter également que Firefox fêtera ses 20 ans en novembre !

La suite l’année prochaine, peut-être !

Commentaires : voir le flux Atom ouvrir dans le navigateur

❌