DINUM · Albert API · openweight-ocr

Albert OCR

Albert OCR convertit des PDF scannés en texte via Albert API et le modèle openweight-ocr (LightOnOCR). Chargez un ou plusieurs PDF (ou un dossier). Exportez en Markdown, ZIP ou JSON ; la clé reste dans votre navigateur.

Résultat

sortie

0%

Comment fonctionne l’OCR de PDF

Albert OCR est un outil d’OCR (reconnaissance optique de caractères) pour documents PDF scannés. Il s’appuie sur Albert API et le modèle openweight-ocr (LightOnOCR-2-1B), destiné notamment aux agents publics.

  1. Saisissez votre clé Albert API.
  2. Ajoutez un ou plusieurs PDF, ou un dossier entier.
  3. Lancez l’OCR : chaque page est rendue localement avec PDF.js, puis analysée par le modèle.
  4. Exportez le texte en Markdown, ZIP ou JSON.

Questions fréquentes

Qu’est-ce qu’Albert OCR ?

Une interface web pour extraire le texte de PDF scannés via Albert API (openweight-ocr), sans installer de logiciel.

Qui peut utiliser Albert API ?

L’accès est destiné aux agents de l’État et organismes sous tutelle. Demander un accès.

Où est stockée ma clé API ?

Dans votre navigateur uniquement. Elle n’est pas enregistrée sur un serveur de cette interface.

Quels exports sont proposés ?

Markdown (un fichier par PDF), archive ZIP, et JSON pour un usage programmatique.