Refinea logoRefinea
Website builder: quanto divergono le shortlist AI

Website builder: quanto divergono le shortlist AI

Vito Guglielmino
Vito Guglielmino
Co-Founder & CEO, Refinea·

Website builder: come cambia la shortlist AI secondo chi deve usarli · Refinea

Wix compare nel 62% delle risposte sui website builder, con un intervallo dal 54% al 69%. Questa forbice esprime l’incertezza della quota misurata da Refinea nelle risposte italiane, mentre le differenze osservate per Webflow mostrano quanto le raccomandazioni differiscano fra i motori consultati.

La rilevazione Refinea comprende 150 risposte raccolte il 22 settembre 2026, distribuite fra Gemini, ChatGPT e Perplexity, con 50 risposte per motore e domande formulate esclusivamente in italiano.

Come abbiamo misurato

Refinea ha interrogato Gemini, ChatGPT e Perplexity utilizzando 25 domande distinte, nate da keyword reali con volume di ricerca misurato. Le domande non contenevano nomi di brand né personaggi simulati, così da osservare le raccomandazioni associate alle richieste formulate.

Ogni domanda è stata sottoposta a ciascun motore con 2 ripetizioni, ottenendo 50 risposte per motore nella medesima giornata. La raccolta si è svolta il 22 settembre 2026 e tutte le domande erano in italiano.

Abbiamo contato le risposte che raccomandavano ciascun brand, escludendo le menzioni nelle quali il nome compariva in forma negata. La quota indica quindi quanto spesso un nome entra nelle risposte raccolte, usando come totale tutte le risposte pertinenti al confronto.

Per la quota complessiva di Wix, il totale comprende 150 risposte; per i confronti fra motori, comprende 50 risposte per ciascuno. Una risposta può raccomandare più fornitori, quindi le quote dei diversi brand non rappresentano parti esclusive dello stesso totale.

Gli intervalli di confidenza al 95% esprimono l’incertezza delle quote con una procedura che, ripetuta su campioni equivalenti, copre il valore sottostante nel 95% dei casi. Abbiamo utilizzato il metodo di Wilson, una procedura per calcolare questi intervalli a partire dalle presenze osservate e dal totale delle risposte.

La procedura di confronto richiede di mantenere identiche le domande fra motori e ripetizioni, separando poi i risultati per servizio interrogato. Per una replica esatta servono anche i testi integrali delle domande e le impostazioni utilizzate durante ciascuna interrogazione.

I risultati

La tabella riporta la quota complessiva di Wix insieme alla relativa forbice d’incertezza, riferita all’intera raccolta Refinea.

Brand Quota delle risposte Intervallo di confidenza al 95% Totale delle risposte
Wix 62% 54%–69% 150

Questo dato descrive la frequenza di Wix nella raccolta, senza stabilire una graduatoria affidabile rispetto agli altri fornitori. Per ordinare i brand occorre confrontare anche i rispettivi intervalli, evitando posizioni nette quando le forbici si sovrappongono.

Il confronto fra motori mostra differenze marcate per Webflow, presente nel 60% delle risposte Gemini e nel 10% delle risposte Perplexity. Le quote hanno entrambe come base 50 risposte e presentano una distanza osservata di 50 punti percentuali.

Anche Wix presenta frequenze diverse, comparendo nell’80% delle risposte ChatGPT e nel 38% delle risposte Perplexity, sempre su 50 risposte per motore. Per Framer, la quota osservata raggiunge il 32% su Gemini, mentre su Perplexity resta allo 0% nella raccolta.

Queste distanze descrivono le risposte ottenute nella giornata e non dimostrano una preferenza stabile dei motori nel tempo. L’assenza di Framer dalle risposte Perplexity raccolte non equivale inoltre a un’esclusione generale dalle raccomandazioni del servizio.

Considerando i nomi nelle prime cinque posizioni per frequenza, la sovrapposizione media fra motori raggiunge il 59%. Il dato descrive una condivisione parziale delle liste, senza garantire che una specifica domanda produca raccomandazioni uguali.

La frequenza complessiva e il confronto fra servizi rispondono quindi a domande diverse, entrambe utili nella valutazione iniziale. La distinzione fra misure è approfondita nella guida Misurare la AI Visibility, dedicata alla lettura delle metriche di presenza nelle risposte AI.

Cosa cambia per chi sceglie

Per piccoli imprenditori, team marketing e agenzie, questi risultati suggeriscono una procedura di selezione che mantenga visibili le differenze fra motori. La raccolta non assegna un vincitore a ciascun utilizzatore, perché le domande non includevano profili personali simulati.

  • Confrontate le risposte di Gemini, ChatGPT e Perplexity usando la stessa descrizione del progetto, mantenendo invariati requisiti e vincoli. Registrate quali builder ricorrono e quali compaiono soltanto in alcune risposte, senza eliminare automaticamente questi ultimi dalla valutazione. La distanza osservata per Webflow rende concreto il rischio di costruire una lista iniziale dipendente dal solo servizio consultato.
  • Traducete ogni raccomandazione in verifiche sul lavoro che il fornitore deve sostenere, distinguendo pubblicazione, aggiornamento e gestione dei contenuti. Un team marketing può verificare direttamente il processo di modifica delle pagine, mentre un’agenzia può esaminare il passaggio del progetto al cliente. Questi controlli riguardano l’utilizzo previsto e richiedono riscontri sul prodotto, oltre alla presenza del nome nelle risposte AI.
  • Conservate separatamente il nome raccomandato, la motivazione fornita dal motore e le fonti effettivamente consultabili nella risposta. Controllate che ciascuna fonte sostenga la specifica caratteristica attribuita al builder, aprendo la documentazione pertinente prima di inserirla nella valutazione. Una citazione rende disponibile un riferimento da esaminare, ma non certifica automaticamente tutte le affermazioni che accompagnano la raccomandazione.

Per chi vende un website builder, la stessa separazione aiuta a distinguere presenza del brand, motivazioni della raccomandazione e documenti citati. Il passaggio dalla rilevazione alle attività operative è descritto anche in L’ottimizzazione agentica passa dalla misura al lavoro, mantenendo distinti osservazioni e interventi.

Limiti

La misura riguarda 25 domande italiane e una raccolta effettuata esclusivamente il 22 settembre 2026, con 2 ripetizioni per domanda e motore. Il campione fotografa quelle richieste nella giornata indicata e non descrive l’intera domanda italiana di website builder.

Le 25 domande coprono tre situazioni d’acquisto diverse: chi gestisce il sito da solo, chi lo gestisce dentro un team marketing, chi lo realizza per clienti. I risultati descrivono quella varietà di esigenze, non tutte le domande possibili sui website builder.

Le ripetizioni della stessa domanda consentono di osservare variazioni nelle risposte, ma non ampliano la varietà delle esigenze rappresentate. Inoltre, gli intervalli riportati esprimono l’incertezza delle quote e non correggono automaticamente i limiti nella selezione delle domande.

Il 68% delle 150 risposte cita almeno una fonte, una copertura che lascia parte delle raccomandazioni senza riferimenti esterni espliciti. Questo dato riguarda la presenza delle citazioni e non misura la completezza o l’accuratezza delle pagine richiamate.

Le query di fan-out, cioè le ricerche intermedie formulate dal motore per preparare una risposta, sono disponibili per 52 risposte. In questo sottoinsieme, il 60% presenta una ricerca contenente il nome di un fornitore poi raccomandato, con intervallo dal 46% al 72%.

L’osservazione riguarda soltanto le risposte con ricerche visibili e non ricostruisce il processo seguito nelle altre risposte raccolte. La presenza del nome nella ricerca e nella raccomandazione documenta una compresenza, senza stabilire quale passaggio determini l’altro.

Misuriamo quanto spesso le AI raccomandano un nome; quota di mercato e qualità del prodotto restano fuori dal perimetro della rilevazione. Le differenze per piccoli imprenditori, team marketing e agenzie richiedono confronti dedicati, con esigenze definite esplicitamente nelle domande.

Domande frequenti

Perché avete scelto queste domande?

Le domande derivano da keyword reali con volume misurato e rappresentano richieste espresse in italiano sui website builder. L’assenza di nomi di brand e personaggi simulati mantiene l’osservazione sulle richieste selezionate, senza indicare preventivamente fornitori o profili.

Perché avete confrontato questi motori?

Il disegno della misura confronta Gemini, ChatGPT e Perplexity per osservare come cambiano le raccomandazioni davanti alle medesime domande. I risultati descrivono questi servizi nella giornata di raccolta e non vengono estesi automaticamente ad altri assistenti.

Come si legge un intervallo?

Per Wix, il 62% è la quota osservata, mentre il 54%–69% indica la forbice d’incertezza associata alla stima. Quando gli intervalli di fornitori diversi si sovrappongono, il confronto richiede cautela e non sostiene una graduatoria netta.

Se state scegliendo un builder, provate a confrontare la vostra lista iniziale con risposte raccolte mantenendo identici i requisiti.

Continue reading

Scopri come l'AI raccomanda i brand nel tuo mercato

Inizia una prova gratuita di 14 giorni sul piano Pro e ottieni i tuoi primi insight sulla visibilità AI in 10 minuti.

Inizia la Prova Gratuita