JavaScript e crawler: come controllare il contenuto accessibile
La pagina che leggi nel browser può essere stata riempita da JavaScript dopo il caricamento di un HTML quasi vuoto. Questo non significa che sia invisibile a tutti i motori: Google può eseguire JavaScript, mentre altri crawler hanno capacità diverse. Verifica il servizio che ti interessa prima di scegliere la modifica.
Confronta le due versioni
Individua il contenuto essenziale della pagina: titolo, servizio, condizioni di prezzo, territorio e link. Poi esamina l’HTML restituito dal server. Puoi salvarlo così:
curl -L https://example.com/service/ -o page.html
Cerca nell’HTML il testo del servizio e le condizioni, non solo il richiamo a uno script. Controlla anche la risposta del server: 403 indica un accesso negato, 429 un limite alle richieste. Questi casi, come una schermata di login, richiedono un controllo diverso dal testo caricato tramite JavaScript. Cambiare lo User-Agent modifica il nome dichiarato dalla richiesta, senza renderla una visita autentica del crawler.
Valuta se il server può fornire direttamente il testo
Chiedi allo sviluppatore se le pagine importanti possono essere preparate in anticipo o generate sul server con il testo già presente. Sono le opzioni chiamate generazione statica e rendering lato server. Moduli e calcolatori possono continuare a usare JavaScript; spesso non serve rifare tutto il sito.
Dopo l’intervento, confronta di nuovo HTML e pagina visibile. Verifica link interni, URL canonici e coerenza dei dati. Usa gli strumenti di ispezione del motore interessato e i log del server quando disponibili. Una risposta leggibile dimostra accessibilità nelle condizioni testate, non che un servizio IA citerà quella pagina.
Fonti e approfondimenti
Guide correlate
- GPTBot, OAI-SearchBot e ChatGPT-User: cosa controllare
- Come l’IA sceglie le fonti e cosa controllare quando cita un concorrente
Guide correlate
Pubblicato: · Verificato dalla redazione di geo-rank.ai · Come verifichiamo