Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

WeEdit

WeEdit

WeEdit

Aussi appelé : WeEdit benchmark · WeEdit-Bench

Terme IA Intermédiaire 🤖 Intelligence artificielle

Mis à jour le

En bref

WeEdit est un banc d'essai qui mesure si un modèle sait modifier le texte présent dans une image, en notant le respect de la consigne, la lisibilité des caractères et la préservation de l'arrière-plan.

📖 Définition

WeEdit est un banc d'essai consacré à un problème précis et notoirement coriace : modifier le texte qui se trouve DÉJÀ dans une image. Une affiche, une enseigne, un emballage, une capture d'écran. Il ne s'agit pas de retoucher une photo en général, mais d'y réécrire des mots sans abîmer ce qu'il y a autour.

La difficulté est réelle. Les modèles de génération d'images produisent volontiers des caractères tordus, approximatifs ou carrément inventés, et l'ennui s'aggrave dès qu'on sort de l'alphabet latin. WeEdit pousse justement dans cette direction, avec deux jeux de 2 000 cas : l'un bilingue, en chinois et en anglais, l'autre couvrant quinze langues.

Huit gestes sont évalués : ajouter du texte, en remplacer, en supprimer, le réorganiser, le traduire, en changer le style, combiner plusieurs de ces gestes, et une catégorie de raisonnement où il faut comprendre le contexte pour savoir quoi écrire.

💬 En termes simples

Un restaurateur qui repeint une lettre effacée sur une vieille enseigne, sans laisser de trace sur le bois autour.

🎯 Exemple concret

Une épreuve peut demander de traduire en chinois le texte anglais d'une capture d'écran : le juge note alors séparément la fidélité à la consigne, la netteté des caractères et l'état de l'arrière-plan.

💡 Le saviez-vous ?

Écrire du texte lisible dans une image reste l'une des faiblesses connues des modèles de génération : ils inventent des caractères. C'est exactement ce que mesure l'axe TC.

❓ Questions fréquentes

Que veulent dire les sigles IA, TC et BP dans les tableaux de résultats ?
Ce sont les trois axes de notation, chacun sur une échelle de 0 à 9. IA (Instruction Adherence) : le respect de la consigne, soit le bon texte, au bon endroit, dans la bonne langue. TC (Text Clarity) : la lisibilité du texte produit, des caractères nets et corrects, sans lettres inventées. BP (Background Preservation) : tout ce qui ne devait pas changer autour du texte est-il resté intact.
Qui attribue les notes ?
Un modèle vision-langage, Gemini-3-Pro, qui reçoit la consigne, l'image d'origine et le résultat, puis note chaque axe. Ce n'est donc pas une correction humaine.
Pourquoi un banc d'essai réservé au texte dans les images ?
Parce qu'un modèle peut très bien réussir une retouche d'image ordinaire et échouer dès qu'il faut écrire des mots lisibles. Séparer cette épreuve évite qu'une bonne moyenne générale masque cette faiblesse précise.
🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !