URL: cos’è, cosa significa e come funziona

URL: cos’è, cosa significa e come funziona

Una delle prime decisioni da prendere dopo l’attivazione di un hosting come Vhosting, riguarda raramente la grafica o i testi. Riguarda il modo in cui le pagine verranno organizzate sul server e, di conseguenza, la forma che assumeranno i loro indirizzi. Una scelta apparentemente marginale, con conseguenze destinate a durare per anni: modificare un indirizzo già pubblicato significa gestire reindirizzamenti, verificare collegamenti interni e rischiare la perdita di posizioni conquistate.

Alla base di quella scelta si colloca un elemento familiare a tutti e conosciuto nel dettaglio da pochi: l’URL.

Cos’è un URL

Un URL è l’indirizzo che identifica in modo univoco una risorsa su internet e indica al browser il modo in cui raggiungerla. La risorsa può essere una pagina HTML, un’immagine, un video, un documento PDF, un foglio di stile o un archivio compresso: qualsiasi contenuto ospitato su un server accessibile in rete possiede un proprio indirizzo.

Il paragone più immediato è quello con un recapito postale. Un indirizzo di casa contiene la via, il numero civico, la città e il paese, informazioni che permettono al postino di individuare una singola abitazione tra milioni. L’URL segue la stessa logica, con un’aggiunta significativa: oltre a indicare dove si trova il contenuto, specifica anche con quale modalità di trasporto deve essere recuperato.

Questa doppia natura spiega perché l’URL rappresenti un elemento centrale dell’architettura del web. Le macchine comunicano tra loro attraverso indirizzi IP, sequenze numeriche difficili da memorizzare e prive di significato per una persona. L’URL introduce uno strato leggibile che sostituisce quei numeri con parole comprensibili, lasciando al sistema DNS il compito di effettuare la traduzione dietro le quinte.

Cosa significa la sigla URL

URL è l’acronimo di Uniform Resource Locator, traducibile in italiano come “localizzatore uniforme di risorse“. Ognuno dei tre termini contribuisce a definire il concetto:

  • uniforme, perché la sintassi rispetta uno standard condiviso che tutti i browser e tutti i server interpretano allo stesso modo;
  • risorsa, perché l’oggetto identificato può appartenere a qualsiasi categoria di contenuto digitale, dalla pagina web al file scaricabile;
  • localizzatore, perché la stringa comunica la posizione esatta della risorsa e il protocollo necessario per ottenerla.

La formalizzazione dello standard risale al 1994, quando Tim Berners-Lee, insieme ad altri ricercatori, pubblicò il documento tecnico che ne descriveva la sintassi. Quella specifica, aggiornata più volte nel corso degli anni, regola tuttora il modo in cui gli indirizzi vengono scritti e interpretati.

Nel linguaggio quotidiano circolano diverse espressioni per indicare lo stesso oggetto: “indirizzo web”, “link”, “collegamento” o semplicemente “sito”. Si tratta di sinonimi accettabili nella conversazione informale, mentre in ambito tecnico conviene mantenere il termine corretto, soprattutto quando si discute di configurazioni server o di ottimizzazione per i motori di ricerca.

Come funziona un URL

L’inserimento di un indirizzo nella barra del browser avvia una sequenza di operazioni che si conclude in pochi decimi di secondo. Il processo si articola in alcuni passaggi fondamentali:

  • il browser analizza la stringa ricevuta e ne separa le componenti, individuando protocollo, nome host, percorso ed eventuali parametri;
  • il nome di dominio viene trasmesso a un resolver DNS, che restituisce l’indirizzo IP del server sul quale risiede la risorsa;
  • il browser apre una connessione verso quel server sulla porta prevista dal protocollo, negoziando il certificato di sicurezza quando l’indirizzo utilizza HTTPS;
  • viene inviata una richiesta contenente il percorso della risorsa desiderata insieme ad alcune informazioni di servizio, come la lingua preferita e il tipo di dispositivo;
  • il server individua il file richiesto all’interno del proprio spazio disco oppure genera il contenuto in modo dinamico, quindi lo restituisce accompagnato da un codice di stato;
  • il browser interpreta la risposta e visualizza la pagina, ripetendo il procedimento per ogni risorsa collegata, dai fogli di stile alle immagini.

Sul lato server, la configurazione stabilisce quale sito rispondere quando arriva una richiesta. Un singolo server può ospitare centinaia di progetti diversi attraverso i cosiddetti host virtuali: il nome di dominio contenuto nell’URL permette al software di capire a quale spazio web indirizzare la richiesta. Il percorso, invece, viene messo in corrispondenza con la struttura di cartelle presente sull’hosting oppure interpretato da un’applicazione che decide quale contenuto restituire.

L’anatomia di un URL: le parti che lo compongono

Un indirizzo completo può contenere fino a sei elementi distinti. L’esempio seguente li mostra tutti insieme:

https://www.esempio.it/hosting/linux/piani-condivisi.html?ref=newsletter#prezzi

Il protocollo

Occupa la posizione iniziale e termina con i due punti seguiti da una doppia barra. Indica le regole di comunicazione da adottare per lo scambio di dati. Lo standard del web è HTTP, affiancato ormai quasi ovunque dalla sua versione cifrata HTTPS, dove la “s” segnala la presenza di un certificato SSL che protegge il traffico. Esistono altri protocolli con finalità specifiche, come FTP per il trasferimento di file oppure mailto: per l’apertura del client di posta.

Il nome di dominio

Il nome dominio segue il protocollo e identifica il server che ospita la risorsa. Si compone di più livelli letti da destra verso sinistra: il dominio di primo livello, o TLD, corrisponde all’estensione finale (.it, .com, .org, .net); il dominio di secondo livello è il nome scelto dal titolare del sito; l’eventuale terzo livello costituisce il sottodominio, spesso impiegato per separare sezioni autonome del progetto, come blog. o shop.. Il prefisso www rientra a tutti gli effetti in questa categoria.

Il percorso

Rappresenta la parte che segue il dominio e descrive la posizione del contenuto all’interno del sito. Riproduce spesso l’organizzazione in cartelle e sottocartelle presente sullo spazio hosting, terminando con il nome del file oppure con un identificativo generato dal CMS. Un percorso ben progettato comunica a colpo d’occhio la gerarchia delle informazioni.

La porta

Compare raramente perché i browser utilizzano valori predefiniti: la 80 per HTTP e la 443 per HTTPS. Diventa visibile negli ambienti di sviluppo o nei servizi che operano su porte differenti, indicata dopo il dominio e preceduta dai due punti.

I parametri

Si trovano dopo il punto interrogativo e trasmettono informazioni aggiuntive al server sotto forma di coppie composte da nome e valore, separate dal simbolo &. Vengono impiegati per filtrare i risultati di una ricerca, ordinare un catalogo, gestire sessioni utente oppure tracciare la provenienza del traffico attraverso i codici UTM.

L’ancora

Introdotta dal cancelletto, punta a una sezione specifica all’interno della pagina già caricata. Il browser gestisce questo elemento in autonomia, senza inviarlo al server, e posiziona la visualizzazione in corrispondenza del paragrafo indicato. Risulta particolarmente utile nei contenuti lunghi dotati di indice interno.

URL: cos'è, cosa significa e come funziona

Differenza tra URL e URI

I due termini vengono spesso scambiati, sebbene descrivano concetti collocati su piani differenti. URI è l’acronimo di Uniform Resource Identifier e rappresenta la categoria generale: qualsiasi stringa che identifichi una risorsa in modo univoco rientra in questa definizione.

All’interno di tale categoria si collocano due sottoinsiemi. Il primo comprende gli URL, che identificano la risorsa e specificano al contempo come raggiungerla. Il secondo comprende gli URN, acronimo di Uniform Resource Name, che attribuiscono un nome permanente senza fornire indicazioni sulla posizione: il codice ISBN di un libro, espresso nella forma urn:isbn:9788817012345, identifica un volume preciso lasciando aperta la questione di dove reperirlo.

I principali tipi di URL

Gli indirizzi si presentano in forme diverse a seconda della funzione che devono svolgere. Le tipologie più ricorrenti sono le seguenti:

  • assoluti, che contengono tutte le componenti necessarie a individuare la risorsa, protocollo e dominio compresi, e vengono impiegati per collegare pagine ospitate su siti differenti;
  • relativi, che omettono le parti iniziali e indicano soltanto il percorso a partire dalla posizione corrente, risultando più compatti nei collegamenti interni a uno stesso sito;
  • canonici, che segnalano ai motori di ricerca quale versione considerare come principale quando lo stesso contenuto risulta raggiungibile attraverso indirizzi multipli, prevenendo così i problemi di contenuti duplicati;
  • di callback, che riportano l’utente su una pagina prestabilita al termine di un’operazione svolta su un servizio esterno, come un’autenticazione o un pagamento;
  • vanity, ovvero indirizzi brevi e memorabili creati per finalità promozionali, spesso stampati su materiale cartaceo o citati durante eventi e campagne pubblicitarie.

A queste categorie si affiancano gli URL accorciati, generati da servizi dedicati che sostituiscono l’indirizzo originale con una stringa minima. Offrono vantaggi evidenti sui canali con limiti di caratteri, sebbene comportino la perdita di leggibilità e una dipendenza dal servizio esterno che gestisce il reindirizzamento.

Perché gli URL sono importanti per la SEO

L’indirizzo di una pagina incide sul posizionamento in modo indiretto, attraverso tre canali distinti.

Il primo riguarda l’esperienza di navigazione. Un indirizzo descrittivo anticipa il contenuto della destinazione ancora prima del clic e aiuta l’utente a orientarsi all’interno di un sito articolato. La struttura del percorso funziona come una mappa: chi legge esempio.it/hosting/linux/piani-condivisi intuisce immediatamente in quale sezione si trova e quale argomento troverà.

Il secondo riguarda i motori di ricerca, che considerano le parole contenute nell’indirizzo tra i segnali utili a valutare la pertinenza di una pagina rispetto a una query. Il peso di questo fattore rimane contenuto rispetto ad altri elementi, quindi risulta controproducente costruire indirizzi artificiosi con il solo scopo di inserire una parola chiave. Vale la pena ricordare che nelle pagine dei risultati Google mostra ormai spesso il nome del sito accompagnato dal percorso a breadcrumbs al posto dell’indirizzo completo, soprattutto nelle ricerche da dispositivo mobile.

Il terzo riguarda la condivisione. Quando un collegamento viene incollato all’interno di un forum, di un messaggio o di un social network, alcune piattaforme lo mostrano nella sua forma testuale senza alcuna formattazione. Un indirizzo lungo, pieno di codici e parametri, comunica poco e scoraggia il clic. Un indirizzo pulito, al contrario, funziona come una breve descrizione del contenuto e invoglia ad aprirlo.

Best practice per creare URL efficaci e leggibili

Alcune regole condivise consentono di ottenere indirizzi comprensibili sia per le persone sia per i motori di ricerca:

  • privilegiare parole reali al posto di codici numerici e identificativi generati automaticamente;
  • mantenere la lunghezza contenuta, includendo soltanto i livelli di cartella realmente necessari alla comprensione della gerarchia;
  • separare le parole con il trattino, evitando trattini bassi, spazi e altri caratteri che i motori di ricerca interpretano in modo differente;
  • utilizzare esclusivamente lettere minuscole, poiché alcuni server distinguono tra maiuscole e minuscole e generano così due indirizzi differenti per lo stesso contenuto;
  • eliminare le parole prive di valore informativo, come articoli e congiunzioni, quando la loro assenza non compromette la leggibilità;
  • limitare l’uso dei parametri e ricorrervi soltanto quando svolgono una funzione tecnica indispensabile;
  • rinunciare a caratteri accentati, simboli e spazi, che il browser converte in sequenze di codice difficili da leggere;
  • impostare un reindirizzamento permanente 301 ogni volta che un indirizzo viene modificato, così da preservare il traffico e l’autorevolezza accumulata.

Un ultimo suggerimento riguarda la fase di progettazione: definire la struttura degli indirizzi prima della pubblicazione evita interventi correttivi in seguito, quando ogni modifica comporta la gestione di reindirizzamenti e il rischio di errori.

Limiti tecnici e formato ottimale di un URL

Sul piano tecnico esistono alcuni vincoli da rispettare. Il più noto riguarda la lunghezza complessiva: per garantire la corretta visualizzazione su tutti i browser conviene rimanere al di sotto dei 2.083 caratteri, soglia storicamente imposta dalle versioni datate di Internet Explorer e tuttora adottata come riferimento prudenziale. Nella pratica quotidiana si tratta di un limite ampiamente sufficiente, dato che un indirizzo ben costruito raramente supera i cento caratteri.

I caratteri ammessi si limitano a lettere non accentate, cifre e a un ristretto insieme di simboli. Tutto il resto viene convertito attraverso una codifica che sostituisce ogni carattere non consentito con il simbolo di percentuale seguito da due cifre esadecimali: uno spazio diventa una lettera accentata si trasforma in %20 una sequenza ancora più lunga. Il risultato rimane funzionante e perde però ogni leggibilità.

Merita attenzione anche la barra finale. Le due versioni con e senza barra vengono considerate indirizzi distinti, quindi conviene sceglierne una e mantenerla su tutto il sito, gestendo la variante alternativa con un reindirizzamento. Lo stesso principio vale per la scelta tra il dominio con e senza prefisso www e per l’adozione integrale di HTTPS.

Un formato ottimale, che riassume tutte le indicazioni esposte finora, assume una forma simile alla seguente:

https://www.esempio.it/categoria/sottocategoria/parola-chiave-principale

Un indirizzo costruito in questo modo comunica il contenuto della pagina, rispetta la gerarchia del sito, risulta facile da ricordare e da condividere, agevola il lavoro dei motori di ricerca e resta stabile nel tempo. Curare gli URL fin dall’impostazione iniziale di un progetto rappresenta uno degli interventi meno onerosi e più duraturi tra quelli disponibili per migliorare la qualità di un sito web.