Identificateur de chiffre

Vous avez trouvé une chaîne suspecte dans une énigme CTF, un fichier journal ou un ancien document et vous ne pouvez pas dire si c’est du Base64, hex, binaire, Morse ou autre ? Collez le texte et l’identificateur vérifie l’ensemble de caractères et la structure pour classer les encodages et chiffres les plus probables. Bon premier pas avant de se tourner vers des décodeurs dédiés.

Comment fonctionne l'identificateur de chiffre

  1. 1

    Collez le texte chiffré

    De n'importe quelle longueur. Les chaînes très courtes (< 20 caractères) donnent des signaux plus faibles ; un texte plus long permet une classification plus forte.

  2. 2

    Analyse de l'ensemble de caractères

    La distribution des lettres, chiffres et symboles réduit les candidats (tout hex, tout alphabet base64, toutes les lettres latines majuscules, etc.).

  3. 3

    Correspondance de signatures

    b$) sont comparés à des signatures connues.

  4. 4

    Estimations classées

    Tous les candidats correspondants sont classés par confiance et affichés en pourcentages, pour que vous sachiez quel décodeur essayer en premier.

Heuristiques de détection

Indice Chiffre / encodage probable
Seulement A-Z a-z 0-9 + / =, longueur multiple de 4 Base64
Seulement 0-9 a-f, longueur paire Hex
Seulement 0-1, 8 chiffres ou plus Binaire
Seulement points, traits, barres obliques et espaces Code Morse
Seulement des lettres latines majuscules, 5+ lettres Chiffre de César ou par substitution
20+ lettres latines, sans espaces Chiffre monoalphabétique
Lettres latines en majuscules et minuscules Texte en clair, probablement pas un chiffre
Trois segments séparés par des points, commence par eyJ Jeton JWT
Commence par $2a$, $2b$ ou $2y$ Hachage bcrypt
Exactement 32 caractères hex Hachage MD5
Exactement 40 caractères hex Hachage SHA-1
Exactement 64 caractères hex Hachage SHA-256

Indices au-delà des caractères

  • Base64 : blocs de 4, remplissage = à la fin, inclut + et /.
  • César ou substitution : lettres latines majuscules, sans chiffres. Les fréquences sont celles du texte en clair, simplement décalées.
  • Morse : uniquement des points, des traits, des barres obliques, des espaces.
  • JWT : trois segments séparés par des points, commence généralement par eyJ.
  • Hachages (MD5/SHA) : hex de longueur fixe (32 caractères pour MD5, 40 pour SHA-1, 64 pour SHA-256). Non réversibles, l’identificateur le signale pour que vous ne tentiez pas de “décoder”.
  • Binaire : longues suites de 0 et de 1, souvent groupées par huit.

Limites de l’identification automatisée

  • Entrées courtes (<10 caractères) : la confiance est faible dans l’ensemble. Cela pourrait être n’importe quoi.
  • XOR personnalisé avec un masque jetable (one-time pad) : indiscernable du hasard sans la clé. L’identificateur ne renverra aucune correspondance.
  • Couches multiples : un truc courant en CTF est Base64 → inverse → César → hex. Épluchez une couche à la fois.
  • Langue source non anglaise : les vérifications de lettres latines restent valables, mais “texte en clair” n’est qu’une supposition ; l’identificateur ne fait pas de détection de langue.

Score de confiance

Chaque candidat porte une confiance fixe selon la spécificité de sa signature. Au-dessus de 80 % : probable. 50-80 % : plausible. En dessous de 50 % : faible chance. Plusieurs correspondances signifient généralement soit une entrée courte, soit un chiffre hybride.

Questions fréquentes

Chaque technique d’identification de chiffre repose sur des régularités statistiques, et les statistiques ont besoin de suffisamment de données pour être fiables. En dessous de 20 caractères, de nombreux chiffres se ressemblent ; 50+ caractères donnent des signaux solides.

Il ne fait que suggérer le schéma le plus probable. Le décodage se fait dans les outils de décodage dédiés, et certains décodages nécessitent une clé que vous devez fournir.

Vérifiez d’abord l’ensemble de caractères (quelles lettres/symboles apparaissent), puis la longueur et la structure. Si c’est encore flou, essayez les décodeurs suspects courants (Base64, hex, César) un par un, sur un CTF, la fréquence + la supposition le craque généralement en quelques tentatives.

Probablement pas en tant que correspondance nommée : il ne renvoie aucun candidat ou une supposition de faible confiance. Comparez l’alphabet et la structure de votre texte chiffré au tableau d’heuristiques ci-dessus pour rétroconcevoir des schémas faits maison simples.

Outils similaires