Tool gratuito Tuurbo

Website Markdown Checker per Agenti AI

Inserisci una URL. Tuurbo verifica se esiste una versione Markdown, come viene servita, quanto è fedele alla pagina HTML e genera una versione pulita quando manca.

Gratis · Nessuna registrazione · Nulla viene salvato

Verifica se una pagina web supporta il Markdown per agenti AI

Gli agenti AI non sempre hanno bisogno della versione HTML completa di una pagina web. Alcuni siti restituiscono una rappresentazione Markdown più pulita quando il client richiede text/markdown, altri pubblicano una versione .md o segnalano una URL Markdown alternativa. Tuurbo verifica automaticamente questi meccanismi e mostra esattamente cosa restituisce il server.

Cosa verifica il checker Markdown?

Accept: text/markdown

Richiediamo la URL originale con l'header HTTP Accept: text/markdown e verifichiamo se il server restituisce una vera rappresentazione Markdown.

URL Markdown alternative

Controlliamo le varianti .md, i link HTML rel="alternate" e gli header HTTP Link che possono puntare a una versione Markdown.

llms.txt

Verifichiamo se il sito pubblica un file llms.txt e se questo fa riferimento alla pagina o a una risorsa Markdown equivalente. llms.txt e la distribuzione del Markdown sono meccanismi collegati ma distinti.

Blocchi di scraping e crawler

Se il sito restituisce un CAPTCHA, una challenge WAF, una risposta 403, un rate limit o un login, il checker segnala la restrizione di accesso invece di dire erroneamente che il Markdown manca.

Il Markdown contiene davvero il contenuto della pagina?

Trovare una risposta Markdown non basta. Un server può restituire text/markdown e fornire comunque una rappresentazione incompleta, rumorosa o non aggiornata della pagina. Tuurbo confronta il contenuto significativo dell'HTML con la versione Markdown e verifica cosa è stato preservato, perso o incluso inutilmente.

Markdown Content Fidelity

La Markdown Content Fidelity misura quanta informazione significativa della pagina HTML originale viene preservata nella rappresentazione Markdown: testo principale, titoli, link contestuali, immagini, elenchi, tabelle e metadati.

Contenuti mancanti

Il checker individua le sezioni importanti presenti nella pagina ma assenti nella versione Markdown, come tabelle prezzi, FAQ, dettagli prodotto o sezioni di articoli.

Rumore inutile

Una buona rappresentazione Markdown dovrebbe privilegiare il contenuto della pagina rispetto a menu, footer, banner cookie, navigazione ripetuta o elementi d'interfaccia.

Confronta i token di HTML e Markdown

L'HTML contiene spesso markup di layout, script, stili, navigazione ed elementi d'interfaccia irrilevanti per un agente AI. Il checker stima i token necessari per l'HTML originale e per la versione Markdown, così puoi confrontare direttamente la differenza.

HTML

18.420 token stimati

Markdown

4.210 token stimati

77% di token stimati in meno

Valori di esempio

Nessuna versione Markdown? Converti la pagina web in Markdown

Se il sito non fornisce una versione Markdown, Tuurbo può creare una versione pulita direttamente dalla pagina pubblica. La conversione deterministica rimuove script, stili ed elementi d'interfaccia superflui, preservando struttura, link, elenchi, tabelle e immagini.

Genera Markdown

Conversione deterministica · Nessuna riscrittura con AI

Perché servire Markdown agli agenti AI?

Contenuto più pulito

Il Markdown può eliminare il markup pensato per il browser, che ai sistemi automatici non serve.

Meno elaborazione

Una rappresentazione più piccola può ridurre la quantità di testo e markup che un agente deve scaricare e analizzare.

Struttura esplicita

Titoli, elenchi, link, blocchi di codice e tabelle restano facili da riconoscere.

Cos'è Accept: text/markdown?

Accept: text/markdown è una richiesta di content negotiation HTTP: il client chiede se la stessa risorsa può essere restituita in Markdown invece che in HTML.

curl -H "Accept: text/markdown" https://example.com/article

Risposta attesa

HTTP/2 200
Content-Type: text/markdown; charset=utf-8
Vary: Accept

Markdown for Agents vs llms.txt

AspettoMarkdown for Agentsllms.txt
Scopo principaleFornire il contenuto della paginaSegnalare/selezionare risorse del sito
AmbitoSingola risorsaSito / elenco di risorse
Formato tipicoMarkdownMarkdown / testo semplice
Posizione abitualeURL della pagina o alternativa/llms.txt
Cambia la rappresentazioneSìNo
Sostituisce robots.txtNoNo

llms.txt aiuta a segnalare i contenuti importanti, mentre la distribuzione del Markdown determina quale rappresentazione riceve un agente quando accede a una risorsa.

Cosa succede se il sito blocca il checker?

Alcuni siti limitano le richieste automatiche con WAF, CAPTCHA, login, challenge JavaScript anti-bot o rate limit.

In questi casi Tuurbo non presume che il Markdown non sia disponibile. Il risultato viene segnato come bloccato, limitato o con autenticazione richiesta, mostrando le evidenze tecniche disponibili.

  • HTTP 401
  • HTTP 403
  • HTTP 429
  • Retry-After
  • CAPTCHA
  • Cloudflare challenge
  • WAF challenge
  • JavaScript bot check
  • robots.txt
  • login

Come far servire Markdown a un sito web

Content negotiation HTTP

Restituisci HTML alle normali richieste del browser e Markdown quando un client richiede text/markdown, con Vary: Accept.

Pubblica una versione .md

Rendi disponibile una versione Markdown accanto alla pagina, ad esempio /article e /article.md.

Segnala la versione Markdown

Aggiungi un link alternate nell'HTML della pagina:

<link
  rel="alternate"
  type="text/markdown"
  href="/article.md"
/>

Genera il Markdown all'edge

Una CDN o un livello edge può creare la rappresentazione Markdown senza modificare il CMS.

Rendi l'intero sito leggibile dagli agenti AI

Verificare una singola URL ti dice se c'è un problema su quella pagina. Tuurbo lavora sull'intero sito, aiutandoti a gestire accessibilità per i crawler, contenuti leggibili dalle macchine, dati strutturati, llms.txt e gli altri segnali usati dai sistemi di retrieval basati su AI.

Scopri SEO & GEO/AEO

Domande frequenti

Cos'è un checker Markdown for Agents?

Un checker Markdown for Agents verifica se una pagina web fornisce una rappresentazione Markdown ai client automatici, come viene scoperta e se contiene le stesse informazioni significative della pagina originale.

Come verifico se una pagina supporta text/markdown?

Inserisci la URL nel checker qui sopra, oppure esegui curl -H "Accept: text/markdown" https://example.com/page. Se il server risponde con Content-Type: text/markdown e un contenuto Markdown, la pagina supporta la negoziazione del Markdown.

Cos'è Accept: text/markdown?

Accept: text/markdown è una richiesta di content negotiation HTTP: il client chiede se la stessa risorsa può essere restituita in Markdown invece che in HTML. I server che la supportano dovrebbero inviare anche Vary: Accept.

Markdown for Agents e llms.txt sono la stessa cosa?

No. llms.txt è un file a livello di sito che segnala le risorse importanti. Markdown for Agents riguarda la rappresentazione di ogni singola pagina. Sono complementari: llms.txt può puntare alle versioni Markdown delle pagine.

Tuurbo può convertire una pagina web in Markdown?

Sì. Se non trova un Markdown fornito dal sito, Tuurbo genera una versione pulita dalla pagina pubblica con una conversione deterministica, senza riscrittura con AI. Puoi copiarla o scaricarla.

Il Markdown migliora il posizionamento su Google?

La disponibilità del Markdown non va considerata un fattore di ranking diretto su Google. Il suo valore principale è offrire una rappresentazione più pulita ai client che la supportano.

Perché il checker dice che il sito ha bloccato l'accesso?

Il sito ha restituito una challenge WAF o CAPTCHA, una risposta 401/403, un rate limit 429 o una pagina di login. La pagina non era leggibile, quindi il checker segnala la restrizione invece di dire che il Markdown manca.

Cos'è la Markdown Content Fidelity?

La Markdown Content Fidelity misura quanta informazione significativa della pagina HTML originale è preservata nella rappresentazione Markdown. Una pagina può servire Markdown tecnicamente valido che omette gran parte del contenuto reale.

Limiti: solo pagine pubbliche · le pagine generate con JavaScript possono essere analizzate solo in parte · la fedeltà è una stima · il supporto Markdown non garantisce il posizionamento.