Documentazione Tecnica

L'architettura di MultiLipi

Un'analisi tecnica approfondita della nostra infrastruttura a doppio strato

Panoramica

I plugin di traduzione tradizionali operano sul "Livello visivo", sostituendo le stringhe di testo nel browser. Sebbene ciò soddisfi i lettori umani, crea un ambiente caotico per i crawler di ricerca e gli agenti di intelligenza artificiale.

MultiLipi è la prima piattaforma a progettare un Architettura a doppio strato:

Il livello HTML

Pagine localizzate e completamente eseguite per gli esseri umani e Googlebot.

Il Livello Dati

Un'infrastruttura parallela e strutturata (Markdown + JSON-LD) ottimizzata specificamente per i modelli linguistici di grandi dimensioni (LLM).

Di seguito è riportata la documentazione dettagliata di come la nostra Pipeline in 10 passaggi trasforma un URL statico in un'entità globale pronta per l'IA.

FASE 1

Configurazione Infrastruttura

Le Fondamenta

Definiamo il livello di routing fisico e di sicurezza prima di toccare una sola parola di contenuto.

Passaggio 1: Provisioning Intelligente e SSL

Al momento della connessione, il nostro sistema rileva le impronte digitali del tuo CMS di origine (Shopify, Webflow, WordPress o Custom Stack) per determinare il metodo di iniezione ottimale.

  • Azione: Forniamo istantaneamente certificati SSL dedicati per i tuoi endpoint localizzati.
  • Meccanismo: Il protocollo Secure Handshake (TLS 1.3) garantisce che i dati trasmessi tra il tuo server di origine e i nostri nodi di edge siano crittografati, senza aggiungere alcuna latenza al Time to First Byte (TTFB).

Passaggio 2: Mappatura dell'architettura degli URL

Supportiamo tre distinte architetture di routing per adattarci alla tua strategia SEO.

Opzione A: Sottodomini (Distribuzione più rapida)

Struttura: es.example.com, fr.example.com

Ideale per: Grandi siti aziendali che necessitano della separazione delle competenze.

Opzione B: Sottodirectory (Massima autorità SEO)

Struttura: example.com/es/, example.com/fr/

Meccanismo: Forniamo uno script Reverse Proxy leggero (Cloudflare Worker o configurazione Nginx) che instrada /es/ il traffico verso i nostri server edge mantenendo unificata l'autorità di dominio.

Opzione C: ccTLD (Dominio locale)

Struttura: example.es, example.fr

Meccanismo: L'avanzata mappatura CNAME consente di puntare domini nazionali personalizzati verso il nostro motore di localizzazione.

FASE 2

Elaborazione dei Contenuti

Il Livello Neurale

Separiamo il "Contenuto" dal "Codice" per garantire una localizzazione perfetta senza compromettere la funzionalità dell'interfaccia utente.

Passaggio 3: Ingestione Profonda e Localizzazione degli Slug

Il nostro crawler acquisisce il tuo HTML originale e costruisce una mappa di contenuti dinamica.

  • La Separazione del Codice: Analizziamo il DOM per identificare i nodi di testo traducibili "bloccando" al contempo attributi HTML, script e classi. Ciò garantisce che il layout del tuo sito non si rompa mai, nemmeno nelle lingue da destra a sinistra (RTL).
  • Traduzione degli Slug: A differenza dei proxy standard, traduciamo il percorso dell'URL stesso.

    Originale:example.com/products/red-running-shoes
    Localizzato:es.example.com/productos/zapatillas-rojas
    Impatto:

    Aumenta la percentuale di clic (CTR) nei risultati di ricerca locali allineandosi all'intento dell'utente.

Passaggio 4: Collegamento Interno "Spiderweb"

Per prevenire "pagine orfane" (un problema comune in cui le pagine localizzate esistono ma non sono collegate), iniettiamo un blocco di routing dinamico.

  • Azione: A
    o un blocco di navigazione nascosto viene aggiunto al DOM.
  • Contenuto:

    1. Commutatori di lingua: Collegamenti diretti alle versioni EN, FR, DE della corrente pagina.
    2. Collegamenti incrociati: Link ad altre pagine pertinenti all'interno dello stesso gruppo linguistico.
  • Perché: Ciò garantisce che i bot possano eseguire la scansione continuamente attraverso l'intera rete localizzata senza incontrare vicoli ciechi.
FASE 3

Il Livello SEO

Conformità Google

Rigorosa aderenza alle linee guida ingegneristiche di Google per prevenire penalizzazioni per contenuti duplicati.

Passaggio 5: Iniezione di tag (Hreflang e Canonici)

Modifichiamo automaticamente il di ogni pagina servita per definirne rigorosamente la relazione con la rete.

Mappe Hreflang: Iniettiamo una mappa completa x-default e localizzata per ogni variazione di pagina.

<collegamento rel="alternativo" hreflang="en" href="https://example.com/page" />
<collegamento rel="alternativo" hreflang="es" href="https://es.example.com/pagina" />

Canonici autoreferenziali: La pagina spagnola punta a se stessa come fonte canonica, assicurando che Google la indicizzi come risorsa unica e non come duplicato della pagina inglese.

FASE 4

Il Livello GEO

Infrastruttura IA - La Formula Segreta

La "Formula Segreta." Questa fase costruisce il Web parallelo per gli agenti IA (ChatGPT, Claude, Gemini).

Passaggio 6: Iniezione di Identità e Schema

Trasformiamo il tuo sito da "Stringhe" (testo) a "Cose" (Entità).

  • Azione: Il sistema genera uno script JSON-LD basato sul tuo Grafico delle Identità.
  • Logica Contestuale:

    • Globale: Inserisce lo Schema Organization (Logo, Social, Fondatore) su tutte le pagine.
    • A Livello di Pagina: Rileva automaticamente i tipi di contenuto (es., /blog/ attiva lo schema Article; /product/ attiva lo schema Product con prezzo e disponibilità).
  • Risultato: I robot riconoscono il tuo marchio come un'entità verificata, fondamentale per apparire nei Knowledge Panel.

Passaggio 7: La Creazione del "Gemello AI" (Generazione Markdown)

Per ogni pagina HTML servita agli utenti, generiamo un file Markdown parallelo e nascosto (.md) ottimizzato per i limiti di token degli LLM.

Il Processo di Ottimizzazione:

  1. Intestazione di Contesto: Inseriamo un riepilogo "Cheat Sheet" nella parte superiore del file, fornendo ai modelli di IA i fatti chiave (Chi, Cosa, Prezzo) nei primi 500 token.
  2. Estrazione di Tabelle: Le tabelle HTML vengono convertite in barre Markdown pulite | Colonna | Colonna | per un'estrazione perfetta dei dati.
  3. Rimozione del Rumore: Tutti i CSS, JavaScript e div vengono rimossi, lasciando solo il puro segnale semantico.

Passaggio 8: La Mappa dei Robot (llms.txt)

Generiamo automaticamente e ospitiamo un file a livello di root llms.txt file (ad es., es.example.com/llms.txt).

  • Scopo: Questa è la "Sitemap per Robot" standard. Indica agli agenti IA esattamente dove trovare i file Markdown puliti (.md) invece di costringerli a effettuare il parsing di HTML disordinati.
  • Contenuto:

    • Descrizione Globale del Sito (Prompt di Sistema).
    • Elenco di URL prioritari che puntano alle rispettive versioni "AI Twin".
FASE 5

Sicurezza e Manutenzione

Il Ciclo

Garantire stabilità, sicurezza e analisi accurate.

Passaggio 9: Protocollo di Prevenzione dei Conflitti

Separiamo rigorosamente il "Web Umano" dal "Web IA" per prevenire conflitti SEO.

  • La Regola: Tutti i file Markdown generati (.md) vengono serviti con un X-Robots-Tag: noindex intestazione HTTP.
  • Il Motivo: Ciò ordina a Googlebot di ignorare i file Markdown (prevenendo penalizzazioni per contenuti duplicati) consentendo al contempo agli agenti IA (come GPTBot) di consumarli liberamente tramite la llms.txt mappa.

Passaggio 10: Analisi Coscienti

Tracciamo le prestazioni della tua infrastruttura globale in tempo reale.

  • Controllo Bot: I nostri log di edge identificano richieste specifiche dai crawler IA (GPTBot, ClaudeBot, Perplexity), offrendoti visibilità sulla tua "Quota di Modello".
  • Geoverifica: Tracciamo il "Tasso di Corrispondenza"—la percentuale di utenti da una specifica regione (es. Spagna) che sono arrivati con successo sulla corretta versione localizzata (es. es.example.com).

Pronto a Sperimentare l'Architettura?

Scopri come la nostra pipeline in 10 passaggi può trasformare il tuo sito web in una piattaforma globale pronta per l'IA.