Technologie
Reconnaître une matière sur photo : ce que l’IA réussit, et ce qu’elle rate
La reconnaissance de matière sur photographie appartient à cette catégorie de problèmes qui paraissent triviaux jusqu’au moment où l’on s’y essaie. Un professionnel identifie une matière en une seconde, par un geste et un regard. Reproduire ce jugement à partir d’une seule image fixe est nettement plus difficile.
Ce qui fonctionne bien
Les modèles de vision multimodaux actuels sont fiables sur ce qui présente une signature visuelle marquée :
- Le type de vêtement — chemise, veste, manteau, robe, pantalon : identification quasi systématique.
- Les matières à texture caractéristique — denim, cuir, maille épaisse, velours, fourrure : la trame se lit à l’image.
- Les taches visibles — leur présence et leur localisation sont détectées avec constance.
- Les accessoires à risque — boutons de nacre, sequins, cuir rapporté, ornements collés : bien repérés dès que la résolution suffit.
Sur ces catégories, la performance dépasse celle d’un opérateur pressé — non parce que le modèle « voit » mieux, mais parce qu’il ne se lasse jamais et applique le même critère à la millième pièce qu’à la première.
Ce qui reste difficile
Les confusions ne sont pas aléatoires : elles suivent des familles précises.
Les imitations réussies
Une viscose bien tissée imite la soie à s’y méprendre, y compris pour un œil humain sur photo. Le drapé, seul indice discriminant, ne se lit pas de façon fiable sur une pièce posée à plat. Même difficulté entre certains mélanges laine-polyester et une laine pure.
Les mélanges
Un tissu composé à 60 % de coton et 40 % de polyester n’a pas d’apparence propre : il ressemble à celui des deux qui domine visuellement, ce qui n’est pas nécessairement celui qui domine en proportion. Or c’est la présence du polyester qui contraint la température de traitement.
Les conditions de prise de vue
Un éclairage jaune de comptoir décale les teintes ; un flash écrase la texture ; une pièce froissée modifie la lecture de la trame. Une part significative des erreurs vient de l’image, pas du modèle.
Pourquoi la confiance importe plus que la prédiction
Un modèle qui se trompe sans le savoir est dangereux. Un modèle qui se trompe en signalant son incertitude est exploitable. Toute la valeur pratique tient dans cette différence.
Nous exposons donc systématiquement un score de confiance, et nous le calibrons pour qu’il soit honnête : sur l’ensemble des prédictions annoncées à 80 %, environ 80 % doivent être correctes. Un modèle trop sûr de lui est pire qu’un modèle prudent, car il désapprend à l’opérateur de vérifier.
La bonne question n’est pas « le modèle a-t-il raison ? » mais « sait-il quand il risque d’avoir tort ? »
Prédire ce qui sert, pas ce qui impressionne
Un choix a beaucoup fait pour la fiabilité de nos résultats : nous ne cherchons pas à prédire une composition exacte. Nous prédisons un rail de traitement.
Distinguer une viscose d’une soie est difficile. Déterminer que la pièce appartient à la famille « fibres délicates, lavage doux, pas de température » est bien plus robuste — et c’est cette information-là que l’atelier utilise réellement. Nous avons donc regroupé les matières par contrainte de traitement plutôt que par nomenclature textile.
Le gain est double : les erreurs résiduelles se produisent à l’intérieur d’une même famille, donc sans conséquence sur le traitement appliqué. Et l’opérateur reçoit une consigne actionnable plutôt qu’une étiquette à interpréter.
Ce que nous corrigeons en continu
Chaque correction d’opérateur est enregistrée avec la photo et le contexte. Ces écarts sont revus périodiquement : ils indiquent où les consignes du modèle sont insuffisantes, quels seuils sont mal placés, et quelles familles de matières demandent un traitement particulier.
C’est un travail lent, sans effet spectaculaire. C’est aussi le seul qui fasse progresser durablement un système déployé sur le terrain.