Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierinformatique général
  • ✇Korben
  • Koharu - Le traducteur de mangas IA qui fait tout le boulot à votre place
    J’sais pas si vous lisez des mangas de temps en temps mais si vous êtes à jour, vous avez peut-être envie de lire la suite, mais malheureusement, souvent c’est pas encore traduit en français. Alors vous 3 solutions… soit vous patientez, soit vous apprenez le japonais… Soit, soit… Soit vous installez Koharu, un logiciel de traduction de mangas propulsé par IA. C’est hyper bien foutu puisque ça détecte automatiquement les bulles de dialogue, ça lit le texte japonais via OCR, ça efface proprement l

Koharu - Le traducteur de mangas IA qui fait tout le boulot à votre place

Par : Korben
8 décembre 2025 à 10:39

J’sais pas si vous lisez des mangas de temps en temps mais si vous êtes à jour, vous avez peut-être envie de lire la suite, mais malheureusement, souvent c’est pas encore traduit en français. Alors vous 3 solutions… soit vous patientez, soit vous apprenez le japonais… Soit, soit…

Soit vous installez Koharu, un logiciel de traduction de mangas propulsé par IA. C’est hyper bien foutu puisque ça détecte automatiquement les bulles de dialogue, ça lit le texte japonais via OCR, ça efface proprement le texte original avec de l’inpainting, ça traduit le tout avec un modèle de langage aux petits oignons et ça replaque le texte traduit dans la bubulle.

Tout ça en quelques clics, évidemment, sinon ce serait pas drôle !

Le projet est développé par mayocream et c’est du 100% Rust avec une interface Tauri. Pour ceux qui ne connaissent pas, Tauri c’est un peu l’équivalent d’Electron mais en plus léger et plus performant. Le moteur d’inférence utilisé, c’est Candle de HuggingFace, ce qui permet de faire tourner des modèles IA localement sans avoir besoin d’envoyer vos data dans le cloud.

Côté modèles, Koharu embarque plusieurs outils spécialisés. Pour la vision par ordinateur, on a comic-text-detector pour repérer les bulles (avec le petit modèle custom de mayocream ), manga-ocr pour la reconnaissance de caractères et AnimeMangaInpainting pour effacer proprement le texte original. Pour la traduction, c’est vntl-llama3-8b-v2 ou Sakura-GalTransl-7B-v3.7 qui s’y collent et c’est sans galère puisque ces modèles se téléchargent automatiquement au premier lancement.

Et Koharu supporte évidemment l’accélération GPU donc si vous avez une carte NVIDIA, vous pouvez profiter de CUDA et pour les fans d’Apple Silicon avec un M1 à M5, Metal est également supporté. Bref, ça dépote et le logiciel gère aussi la mise en page verticale pour les langues CJK (Chinois, Japonais, Coréen), ce qui est plutôt indispensable quand on traduit des mangas.

Les sources sont dispo sur Github et y’a des binaires pour Windows et macOS directement sur la page des releases. Pour les autres plateformes, faudra compiler vous-même avec Rust et Bun.

Voilà, si vous rêvez de traduire ce manga obscur qui dort au fond d’un forum japonais, Koharu va vous plaire. Et un grand merci à Lorenper pour l’info !

  • ✇Korben
  • ScribeOCR - Corrigez vos erreurs d'OCR directement dans le navigateur (en local)
    Y’a plein d’images et de scans en PDF sur le net ou sur votre disque dur, qui sont difficilement exploitable / indexables parce que la reconnaissance de caractères n’a pas bien fonctionné. L’OCR automatique a par exemple transformé un mot-clé en charabia et c’est illisible. Du coup, ce passage est perdu dans les limbes et impossible de le retrouver avec une simple recherche textuelle. C’est moche. Faut dire que le problème est réel car quand on numérise des millions de livres avec un OCR à 90% d

ScribeOCR - Corrigez vos erreurs d'OCR directement dans le navigateur (en local)

Par : Korben
14 novembre 2025 à 06:23

Y’a plein d’images et de scans en PDF sur le net ou sur votre disque dur, qui sont difficilement exploitable / indexables parce que la reconnaissance de caractères n’a pas bien fonctionné. L’OCR automatique a par exemple transformé un mot-clé en charabia et c’est illisible. Du coup, ce passage est perdu dans les limbes et impossible de le retrouver avec une simple recherche textuelle. C’est moche.

Faut dire que le problème est réel car quand on numérise des millions de livres avec un OCR à 90% de précision, ça a l’air génial, sauf que les 10% d’erreurs ne sont pas aléatoires. C’est toujours les mêmes confusions qui reviennent : “A” qui devient “H”, “C” qui devient “G”, “22” qui se transforme en “55”. Et pour les documents historiques avec des polices anciennes, c’est encore pire.

Heureusement, il existe un outil gratuit et open source qui tourne dans votre navigateur et qui va vous permettre de corriger ces milliers d’erreurs OCR sans envoyer vos docs sur les serveurs de Google, Microsoft ou je ne sais quoi d’autre. Cela s’appelle ScribeOCR et vous allez l’adorer !

Pourquoi ? Hé bien parce que c’est un éditeur d’OCR open-source qui tourne à 100% dans votre navigateur, donc aucune donnée n’est envoyée sur le net et parce qu’il est capable de corriger toutes les erreurs efficacement ! L’interface affiche le texte OCRisé par-dessus l’image source, comme ça, vous voyez immédiatement où sont les problèmes et vous corrigez tout ça en série.

Et surtout ScribeOCR génère une police custom pour chaque document. Ça vous laisse garder l’apparence originale du doc, tout en ayant un texte parfaitement indexable pour des recherches par exemple. Vous obtenez ainsi un PDF qui ressemble au document d’origine mais où chaque mot est cliquable et cherchable. Bref, c’est super pratique si vous numérisez des archives ou des vieux bouquins.

L’outil supporte plusieurs moteurs OCR dont Tesseract LSTM et Legacy et vous pouvez ajuster les paramètres de reconnaissance selon le type de document : vitesse, qualité, langue…etc. Y’a même des options avancées pour le debug et l’optimisation des polices.

L’outil permet donc de créer des PDF recherchables à partir de scans (c’est le cas classique) mais également de corriger des données OCR existantes, y compris les fichiers HOCR de Tesseract. Et pour numériser complètement des documents ou livres anciens, l’interface de correction vous aidera à faire de l’excellent travail !

Le projet est open-source (licence AGPL-3.0) , ce qui veut dire que vous pouvez l’auto-héberger si vous voulez. Ainsi, pour l’installer en local, c’est très simple :

git clone --recursive https://github.com/scribeocr/scribeocr.git
cd scribeocr
npm i
npx http-server

Mais si vous voulez juste tester, y’a une démo sur scribeocr.com . Vous uploadez votre fichier, vous choisissez votre langue et votre moteur OCR, et hop c’est parti mon kiki.

Et pour les sorties, vous avez le choix : PDF, DOCX, HTML et d’autres formats. Vous pouvez même ajuster les paramètres d’export selon vos besoins. Auto-rotation, optimisation de police, tout est configurable !

Bref, au final ScribeOCR répare ces angles morts bien relou de la numérisation massive de documents sans que vous ayez à sacrifier votre vie privée !

Et ça c’est cool !

  • ✇Korben
  • MakeACopy - Le scanner de documents Android qui ne raconte pas votre vie
    Hey les Androidopathes, j’ai une bonne nouvelle pour vous ! Un développeur allemand vient de sortir un scanner de documents pour Android qui fonctionne sans connexion internet. Ça s’appelle MakeACopy et ça arrive vraiment comme une bouffée d’air frais dans cet écosystème d’app de numérisation un poil toxique. Créé par Christian Kierdorf, ce scanner open source fait exactement la même chose que les mastodontes du secteur mais en mieux. L’app utilise OpenCV pour détecter automatiquement les bords

MakeACopy - Le scanner de documents Android qui ne raconte pas votre vie

Par : Korben
21 septembre 2025 à 11:28

Hey les Androidopathes, j’ai une bonne nouvelle pour vous ! Un développeur allemand vient de sortir un scanner de documents pour Android qui fonctionne sans connexion internet.

Ça s’appelle MakeACopy et ça arrive vraiment comme une bouffée d’air frais dans cet écosystème d’app de numérisation un poil toxique. Créé par Christian Kierdorf, ce scanner open source fait exactement la même chose que les mastodontes du secteur mais en mieux. L’app utilise OpenCV pour détecter automatiquement les bords du document, Tesseract pour l’OCR (reconnaissance de texte), et peut exporter en PDF avec le texte cherchable intégré. En gros, toutes les fonctionnalités premium d’ Adobe Scan , mais gratuites et privées.

Ce qui rend donc MakeACopy différent, vous l’aurez compris, c’est son approche radicale de la vie privée. Le dev compile même OpenCV depuis les sources au lieu d’utiliser des binaires précompilés, histoire de respecter les standards F-Droid et garantir qu’aucun code malveillant ne peut se glisser dans la chaîne de compilation. Bref, Kierdorf ne fait pas ça en amateur et a même implémenté une détection des coins assistée par machine learning (c’est un modèle ONNX) pour ceux qui veulent la totale.

Dans le même genre, on a aussi OpenScan qui est une autre alternative privacy-friendly qui cartonne mais MakeACopy va plus loin avec ses fonctionnalités notamment d’OCR. L’app est disponible sur Android 10 et plus, et fonctionne même sur des téléphones d’entrée de gamme. Le développeur précise que les futures versions incluront le multi-pages, l’export du texte éditable, et plus de langues pour l’OCR, tout ça en gardant le principe du 100% offline.

Bref, MakeACopy c’est le scanner de documents qu’on aurait dû avoir depuis le début. Pas besoin de compte, pas de cloud, pas de tracking, pas de pubs… juste un soft qui fait son job.

Vous pouvez télécharger MakeACopy sur le Play Store ou F-Droid , et si vous trouvez ça bien, parlez-en autour de vous, histoire d’aider votre prochain qui se galère surement encore avec Camscanner.

  • ✇Korben
  • CompilerFax ou comment compiler du code C par fax !
    Vous connaissez le principe du fax ? Vous mettez votre document dans la machine, vous composez le numéro du destinataire, et hop le document est transmis via la ligne téléphonique et imprimé à distance. C’était fou pour l’époque ! Alors si je vous dis qu’un bidouilleur a détourné cette bonne vieille technologie pour en faire un compilateur C par fax, j’suis sûr que vous n’allez pas me croire. Eh oui, grâce au projet délirant CompilerFax, vous pouvez désormais envoyer votre code C par fa

CompilerFax ou comment compiler du code C par fax !

Par : Korben
24 mai 2024 à 10:34

Vous connaissez le principe du fax ?

Vous mettez votre document dans la machine, vous composez le numéro du destinataire, et hop le document est transmis via la ligne téléphonique et imprimé à distance. C’était fou pour l’époque ! Alors si je vous dis qu’un bidouilleur a détourné cette bonne vieille technologie pour en faire un compilateur C par fax, j’suis sûr que vous n’allez pas me croire.

Eh oui, grâce au projet délirant CompilerFax, vous pouvez désormais envoyer votre code C par fax, le faire compiler et exécuter sur un Raspberry Pi distant, et recevoir le résultat… à nouveau par fax ! Un vrai délire rétro-tech, un mashup improbable entre une technologie d’un autre siècle et du logiciel moderne. J’adore ce genre de projets WTF alors j’étais obligé de vous en parler !

Vous écrivez donc votre code C sur une belle feuille de papier, en utilisant une police adaptée à la reconnaissance optique de caractères (OCR). La police Calibri semble donner de bons résultats et n’oubliez pas d’ajouter en commentaire la ligne magique //REPLY= suivie de votre numéro de fax, sinon vous ne recevrez pas la réponse !

Selon les tests, le taux d’erreur de l’OCR varie selon les polices utilisées car certains caractères comme O, i ou x sont souvent mal interprétés. Il vaut donc mieux vaut les éviter dans vos noms de variables, et pensez aussi à bien espacer votre code pour faciliter la reconnaissance.

Ensuite, direction votre fax préféré, vous composez le numéro de CompilerFax et vous envoyez votre code. De l’autre côté, un Raspberry Pi équipé d’un modem fax reçoit votre document, en extrait le code avec un outil d’OCR comme Tesseract OCR, le compile avec GCC et l’exécute dans un environnement sandboxé sous Alpine Linux (pour éviter que des petits malins exploitent des failles). Le résultat vous revient ensuite par fax illico presto ! Enfin, dans un délai raisonnable puisque la compilation est limitée à 20 secondes et l’exécution à 60 secondes. Au-delà, le programme est interrompu.

Derrière ce projet farfelu se cache de la bidouille de haut vol car le créateur de CompilerFax, Lex Bailey, a dû déployer des trésors d’ingéniosité pour faire dialoguer ces technologies que tout oppose. Et si ça vous branche, l’intégralité du code source est disponible sur Github.

Bon, je vous l’accorde, le débit de 9600 bits/s du fax, ce n’est pas idéal pour envoyer des gros programmes c’est pour cela que pour l’instant, seul l’envoi d’une page est supporté et la qualité de l’OCR n’est pas toujours au rendez-vous mais au final, CompilerFax fonctionne et permet de retourner un peu aux sources, à un rythme plus humain dans notre monde où tout est quasi-immédiat.

Belle bidouille en tout cas !

Source

❌
❌