Documentation Technique

L'architecture MultiLipi

Une plongée technique approfondie dans notre infrastructure à double couche

Aperçu

Les plugins de traduction traditionnels fonctionnent sur la "Couche Visuelle" – échangeant des chaînes de texte dans le navigateur. Bien que cela satisfasse les lecteurs humains, cela crée un environnement chaotique pour les robots d'exploration et les agents d'IA.

MultiLipi est la première plateforme à concevoir un Architecture à Double Couche:

La Couche HTML

Pages entièrement rendues et localisées pour les humains et Googlebot.

La couche de données

Une infrastructure parallèle et structurée (Markdown + JSON-LD) optimisée spécifiquement pour les grands modèles linguistiques (LLM).

Vous trouverez ci-dessous la documentation étape par étape de notre Pipeline en 10 Étapes transforme une URL statique en une entité globale prête pour l'IA.

PHASE 1

Configuration de l'infrastructure

La Fondation

Nous établissons la couche de routage physique et de sécurité avant de toucher un seul mot de contenu.

Étape 1 : Approvisionnement intelligent et SSL

Lors de la connexion, notre système identifie votre CMS d'origine (Shopify, Webflow, WordPress ou pile personnalisée) pour déterminer la méthode d'injection optimale.

  • Action : Nous provisionnons instantanément des certificats SSL dédiés pour vos points de terminaison localisés.
  • Mécanisme : Le protocole d'établissement de liaison sécurisé (TLS 1.3) garantit que les données transitant entre votre serveur d'origine et nos nœuds périphériques sont cryptées, sans latence ajoutée au temps de premier octet (TTFB).

Étape 2 : Cartographie de l'Architecture des URL

Nous prenons en charge trois architectures de routage distinctes pour correspondre à votre stratégie de référencement.

Option A : Sous-domaines (Déploiement le plus rapide)

Structure : es.example.com, fr.example.com

Idéal pour : Grands sites d'entreprise nécessitant une séparation des préoccupations.

Option B : Sous-répertoires (Autorité SEO maximale)

Structure : example.com/es/, example.com/fr/

Mécanisme : Nous fournissons un script léger de proxy inverse (Cloudflare Worker ou configuration Nginx) qui achemine /es/ le trafic vers nos serveurs de périphérie tout en conservant l'autorité du domaine unifiée.

Option C : ccTLD (Domination locale)

Structure : example.es, example.fr

Mécanisme : La cartographie CNAME avancée vous permet de pointer des domaines nationaux personnalisés vers notre moteur de localisation.

PHASE 2

Traitement du contenu

La couche neuronale

Nous séparons le "Contenu" du "Code" pour assurer une localisation parfaite sans casser la fonctionnalité de l'interface utilisateur.

Étape 3 : Ingestion approfondie et localisation des slugs

Notre crawler ingère votre HTML d'origine et construit une carte de contenu dynamique.

  • La Séparation du Code : Nous analysons le DOM pour identifier les nœuds de texte traduisibles tout en "verrouillant" les attributs HTML, les scripts et les classes. Cela garantit que la mise en page de votre site ne se casse jamais, même dans les langues de droite à gauche (RTL).
  • Traduction des slugs : Contrairement aux proxys standards, nous traduisons le chemin de l'URL lui-même.

    Original :example.com/produits/chaussures-de-course-rouges
    Localisé :es.example.com/productos/zapatillas-rojas
    Impact :

    Augmente le taux de clics (CTR) dans les résultats de recherche locaux en faisant correspondre l'intention de l'utilisateur.

Étape 4 : Le Maillage Interne "Toile d'Araignée"

Pour éviter les "pages orphelines" (un problème courant où les pages localisées existent mais ne sont pas liées), nous injectons un bloc de routage dynamique.

  • Action : Un
    ou un bloc de navigation masqué est ajouté au DOM.
  • Contenu :

    1. Sélecteurs de langue : Liens directs vers les versions EN, FR, DE de la courant page.
    2. Liens croisés : Liens vers d'autres pages pertinentes au sein du même groupe linguistique.
  • Pourquoi : Cela garantit que les robots peuvent parcourir en continu l'ensemble de votre réseau localisé sans rencontrer de points morts.
PHASE 3

La Couche SEO

Conformité Google

Adhésion stricte aux directives d'ingénierie de Google pour éviter les pénalités de contenu dupliqué.

Étape 5 : Injection de balises (Hreflang et canonique)

Nous modifions automatiquement le de chaque page servie pour définir strictement sa relation avec le réseau.

Cartes Hreflang : Nous injectons un système complet x-défaut et une carte localisée pour chaque variation de page.

<lien rel="alternate" hreflang="en" href="https://example.com/page" />
<lien rel="alternate" hreflang="es" href="https://es.example.com/pagina" />

Canoniques auto-référentiels : La page espagnole se pointe elle-même comme source canonique, garantissant que Google l'indexe comme un actif unique, et non comme un doublon de la page anglaise.

PHASE 4

La Couche GEO

Infrastructure IA - La Sauce Secrète

Le "Secret Sauce". Cette phase construit le web parallèle pour les agents d'IA (ChatGPT, Claude, Gemini).

Étape 6 : Injection d'identité et de schéma

Nous transformons votre site de "chaînes" (texte) en "choses" (entités).

  • Action : Le système génère un script JSON-LD basé sur votre graphe d'identité.
  • Logique contextuelle :

    • Global : Injecte le schéma d'organisation (logo, réseaux sociaux, fondateur) sur toutes les pages.
    • Niveau de page : Détecte automatiquement les types de contenu (par exemple, /blog/ déclenche le schéma d'article ; /produit/ déclenche le schéma Produit avec le prix et le stock).
  • Résultat : Les robots reconnaissent votre marque comme une entité vérifiée, essentielle pour apparaître dans les panneaux de connaissances.

Étape 7 : La Création du "Jumeau IA" (Génération Markdown)

Pour chaque page HTML servie aux humains, nous générons un fichier Markdown caché et parallèle (".md) optimisé pour les limites de jetons LLM.

Le processus d'optimisation :

  1. En-tête de contexte : Nous injectons un résumé "anti-sèche" tout en haut du fichier, donnant aux modèles d'IA les faits clés (Qui, Quoi, Prix) dans les 500 premiers jetons.
  2. Extraction de tableaux : Les tableaux HTML sont convertis en tuyaux Markdown propres | Colonne | Colonne | pour une extraction de données parfaite.
  3. Suppression du bruit : Tous les CSS, JavaScript et décoratifs divisions sont supprimés, ne laissant que le signal sémantique pur.

Étape 8 : La carte du robot (llms.txt)

Nous générons et hébergeons automatiquement un niveau racine llms.txt fichier (par exemple, es.example.com/llms.txt).

  • Objectif : Ceci est le « Sitemap pour Robots » standard. Il indique aux agents IA exactement où trouver les fichiers Markdown propres (.mdau lieu de les forcer à extraire du HTML désordonné.
  • Contenu :

    • Description globale du site (Invite système).
    • Liste des URL prioritaires pointant vers leurs versions "Jumeau IA".
PHASE 5

Sécurité et Maintenance

La boucle

Assurant stabilité, sécurité et analyses précises.

Étape 9 : Protocole de prévention des conflits

Nous séparons strictement le "Web Humain" du "Web IA" pour éviter les conflits de référencement.

  • La règle : Tout le Markdown généré (.md) sont servis avec un X-Robots-Tag: noindex En-tête HTTP.
  • Le Pourquoi : Cela indique à Googlebot d'ignorer les fichiers Markdown (évitant ainsi les pénalités pour contenu dupliqué) tout en permettant aux agents IA (comme GPTBotpour les consommer librement via le llms.txt carte.

Étape 10 : Analyse Sentiente

Nous suivons les performances de votre infrastructure mondiale en temps réel.

  • Surveillance des robots : Nos journaux de périphérie identifient les requêtes spécifiques des robots IA (GPTBot, ClaudeBot, Perplexity), vous donnant une visibilité sur votre "Part du modèle".
  • Géo-Vérification : Nous suivons le "Taux de Correspondance" – le pourcentage d'utilisateurs d'une région spécifique (par exemple, l'Espagne) ayant accédé avec succès à la version localisée correcte (par exemple, es.example.com).

Prêt à découvrir l'architecture ?

Découvrez comment notre pipeline en 10 étapes peut transformer votre site Web en une plateforme mondiale prête pour l'IA.