Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

noirdoc

Retour au répertoire

noirdoc

Noirdoc est une solution logicielle allemande conçue pour permettre l’utilisation sécurisée de l’intelligence artificielle générative tout en respectant strictement la confidentialité des données p...

Visiter le site →
Freemium Website 5 clics Vérifié récemment · il y a 17 h
Capture d'écran de noirdoc
💰 Tarification
Freemium
🌐 Type
Website
🚀 Lancé en
📁 Catégories
🎯 Public
🔗 Site web
noirdoc.de/en/launch
✓ Vérifié par La veille Mis à jour le 20 juil. 2026

👋 À propos de noirdoc

À propos de noirdoc

Noirdoc est une solution logicielle allemande conçue pour permettre l’utilisation sécurisée de l’intelligence artificielle générative tout en respectant strictement la confidentialité des données personnelles. Lancé sous la version v0.1.0, cet outil s’adresse principalement aux organisations soumises à des réglementations strictes comme le RGPD, notamment en Allemagne et en Europe. Le positionnement clé de noirdoc se résume à la promesse suivante : « Vos données. N’importe quelle IA. Aucun risque. »

L’approche de noirdoc repose sur la pseudonymisation — non sur l’anonymisation complète — ce qui permet de conserver la structure et la cohérence du texte tout en le rendant inutilisable pour les fournisseurs d’IA externes. Contrairement à des solutions purement centrées sur la détection de données sensibles, noirdoc offre un mécanisme réversible et traçable, essentiel pour les workflows internes nécessitant une reconstitution fidèle des informations après traitement par un modèle.

Développé avec un biais linguistique et réglementaire germanophone, noirdoc excelle dans la gestion des documents typiques du « Mittelstand » (PME allemandes) — contrats, courriels, dossiers clients, tableurs — tout en offrant une compatibilité croissante avec l’anglais. La solution est proposée sous deux formes complémentaires : une librairie Python/CLI pour le traitement local de fichiers, et un proxy API servant de passerelle sécurisée entre les applications et les grands modèles comme ceux d’OpenAI, Anthropic ou Azure.

Fonctionnalités principales

Noirdoc se décline en deux modules distincts mais interopérables : une librairie de traitement de documents et un proxy API pour les intégrations IA.

Le proxy API (accessible via noirdoc.de) agit comme une couche intermédiaire entre votre application et les fournisseurs de modèles linguistiques. Avant chaque envoi au LLM, il détecte et remplace automatiquement les données personnelles identifiables (PII) par des balises comme <<PERSON_1>>, <<ORG_2>> ou <<IBAN_1>>. Ce remplacement est cohérent durant toute la session, y compris dans les appels à des « tools » ou fonctions externes. À la réception de la réponse du modèle, le proxy restaure les données d’origine, visibles uniquement par vous. Cette architecture garantit que les données brutes ne quittent jamais votre périmètre de sécurité.

La détection repose sur une double couche : des règles structurées (inspirées de Microsoft Presidio) combinées à des modèles de langage contextuels (GLiNER, Flair), améliorant la précision sur des textes réels où les entités ne suivent pas toujours des formats standardisés. L’intégration est minimale : il suffit de rediriger vos appels vers l’endpoint de noirdoc et de fournir une clé dédiée. Aucun nouveau SDK n’est requis, ce qui facilite l’adoption dans des stacks existantes (Python, Node.js, Go, etc.).

Parallèlement, la librairie Python (disponible sur PyPI) permet de traiter localement des fichiers dans les formats courants : PDF, DOCX, XLSX, CSV, Markdown, HTML, etc. Elle offre des commandes CLI simples comme noirdoc redact (pseudonymisation) et noirdoc reveal (révélation des données originales). Le round-trip est entièrement supporté pour les formats structurés (DOCX, XLSX, texte), mais pas pour les PDF, en raison des complexités d’infrastructure liées à la restitution fidèle des polices et mises en page. La librairie inclut également des outils d’audit (noirdoc ns summary) pour analyser la distribution des entités sensibles dans un corpus.

En matière de conformité, noirdoc propose un hébergement en Allemagne ou une option self-hosted, répondant ainsi aux exigences strictes du RGPD. Toutes les opérations de pseudonymisation peuvent être exécutées localement, et chaque requête est enregistrée pour traçabilité.

Tarification

À ce jour, aucune grille tarifaire publique n’est disponible pour le service proxy de noirdoc. Le site officiel propose uniquement une option « Request access », suggérant une approche B2B sur devis, probablement orientée vers les entreprises de taille intermédiaire ou les grandes organisations. Il est vraisemblable que les prix soient basés sur des modèles comme le volume de requêtes, le nombre d’utilisateurs ou la complexité de l’infrastructure (managed vs. self-hosted).

Quant à la librairie Python, elle est publiée sous licence open source sur PyPI et gratuite à l’usage. Cependant, les coûts réels résident dans l’infrastructure nécessaire (serveurs, maintenance, intégration) et dans les compétences internes requises pour l’exploiter à grande échelle. Les entreprises envisageant un déploiement critique devront donc budgéter non pas un abonnement, mais des ressources techniques dédiées.

En l’absence de transparence sur les prix du proxy, il est difficile d’estimer un coût mensuel précis. Pour comparaison avec des outils similaires, on peut raisonnablement anticiper un tarif ≈ 27 $ CA/mois en mode minimal ou une facturation sur devis en dollars américains (ex. : facturé ~500 $ US/mois pour des volumes modérés), mais ces chiffres restent spéculatifs sans confirmation officielle.

Cas d'utilisation

Noirdoc répond à des scénarios où l’IA générative doit être utilisée sans exposer de données sensibles. Dans le cas du proxy API, il permet notamment :

  • La mise en place de chats conversationnels internes dans des cabinets juridiques, cliniques ou administrations publiques, sans risquer l’exfiltration de noms, dossiers médicaux ou numéros de sécurité sociale vers des serveurs tiers.
  • L’intégration sécurisée de LLM dans des systèmes back-office comme les CRM, ERP ou outils RH, où les descriptions de clients, contrats ou incidents contiennent fréquemment des PII.
  • L’orchestration d’agents autonomes (RAG, tool calling) dans des environnements réglementés, en garantissant que chaque étape du workflow respecte les règles de confidentialité.

La librairie CLI est quant à elle idéale pour :

  • Le prétraitement de documents avant ingestion dans une base de connaissances (RAG), en supprimant les données sensibles tout en préservant la structure sémantique.
  • La création de jeux de données pseudonymisés destinés à du fine-tuning ou à des tests internes, avec possibilité de révéler les données originales en environnement contrôlé.
  • La conformité proactive, en générant des rapports sur la présence de PII dans des corpus documentaires (ex. : audit préalable à une transmission à un sous-traitant IA).

Ces usages font de noirdoc un outil particulièrement adapté aux secteurs santé, finance, droit, assurances et services publics, où la moindre fuite de données peut entraîner des sanctions réglementaires ou une perte de confiance.

Notre avis

Noirdoc se distingue par une approche élégante, pragmatique et centrée sur la conformité. Son double mode (proxy + CLI) couvre à la fois les besoins d’intégration temps réel et ceux de traitement batch, ce qui est rare dans l’écosystème actuel des outils de protection des données pour l’IA.

Ses principaux atouts résident dans la pseudonymisation réversible (pour la plupart des formats), la compatibilité immédiate avec les bibliothèques OpenAI existantes, et une architecture « local-first » qui rassure les équipes sécurité. La double couche de détection (règles + ML) augmente la robustesse, surtout sur des documents bilingues DE/EN.

Cependant, il faut garder à l’esprit que le produit est encore en phase alpha (v0.1.x), ce qui implique des risques d’instabilité ou d’évolution rapide de l’API. La limitation sur les PDF — impossibilité de restaurer les données originales — constitue un frein pour les organisations dont les workflows dépendent fortement de ce format. De plus, le manque de transparence tarifaire complique la planification budgétaire.

Enfin, bien que noirdoc commence à bien gérer l’anglais, son ADN allemand-centrique peut poser des défis dans des contextes francophones ou multijuridictionnels (ex. : absence de détection native du numéro d’assurance sociale québécois).

En somme, noirdoc est une solution prometteuse pour les entreprises européennes exigeantes, notamment celles qui doivent concilier innovation IA et rigueur RGPD. Son adoption est justifiée si vous avez besoin d’un pont sécurisé vers les LLM tout en conservant le contrôle total sur vos données. Pour les autres, une phase de test rigoureuse — et une vérification de la couverture linguistique/réglementaire — est fortement recommandée avant tout engagement.

💡 Les prix affichés sont indicatifs et convertis approximativement en dollars canadiens ($ CA). La facturation réelle peut être effectuée dans une autre devise (souvent en $ US) par le fournisseur. Vérifiez le prix exact sur le site officiel.

✨ Fonctionnalités clés

Sauvegarde automatique de documents
Sauvegarde illimitée et chiffrée
Reconnaissance OCR et classification IA
Recherche texte intégral
Organisation intuitive par tags et dossiers

🚀 Cas d'usage

1

Gestion factures et justificatifs pro

2

Archivage familial sécurisé

3

Organisation docs pour PME

4

Recherche rapide dans archives personnelles

⚖️ Avantages et inconvénients

Les plus

Ultra-simple à utiliser
Stockage illimité sans frais cachés
Sécurité chiffrée de bout en bout
Reconnaissance IA précise et rapide
Interface intuitive

Les moins

Dépend d'internet pour accès
Peu d'options avancées pour entreprises
Langue principale allemande

❓ Questions fréquentes

C'est gratuit?
Oui, plan gratuit avec stockage illimité et toutes fonctions de base. Plans pro payants pour équipes.
Ça marche sur mobile?
Apps iOS et Android pour scanner et accéder à tes docs partout, synchronisation auto.
OCR pour tous formats?
Oui, extrait texte de PDF, images, scans. IA classe auto factures, reçus etc.
Sécurisé?
Chiffrement end-to-end, serveurs UE, conformité RGPD. Tes docs privés.

Envie d'essayer noirdoc ?

Visiter le site →
✓ Vérifié par La veille
👋

Soyez le premier à donner votre avis !

Partagez votre expérience avec cet outil pour aider la communauté.

💬

C'est calme ici...

Lancez une discussion ! Quelle est votre expérience ?

📚

Aucun tutoriel pour le moment

Connaissez-vous un bon tutoriel ? Partagez-le !

📸 Screenshots de la communauté

📷

Aucun screenshot pour le moment. Soyez le premier a en partager !

Aucune alternative pour le moment.

/
🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !