Il 24 settembre 2026 Perplexity ha presentato Photon, il motore interno che recupera e classifica le pagine candidate nella propria ricerca. L’azienda dichiara che il p99 delle fasi di Photon è sceso da circa 800 ms nel sistema precedente a circa 65 ms; Fast Search, invece, è una modalità dell’API con metriche riferite alla singola chiamata.

Il ruolo di Photon nella ricerca di Perplexity

Photon non è un motore di ricerca destinato all’uso diretto da parte dei consumatori: è un componente dell’infrastruttura di Perplexity. Recupera pagine candidate dal web e le ordina; il servizio di ricerca di livello superiore utilizza poi i contenuti delle pagine per generare una risposta.

Perplexity ha presentato Photon come la sostituzione del motore open source adattato che usava in precedenza. L’azienda lo colloca inoltre nel passaggio della propria infrastruttura di ricerca verso sistemi sviluppati internamente con Rust.

Il percorso di una query in Photon

Perplexity presenta Photon, il motore interno della ricerca

Una richiesta passa dal bilanciatore di carico a un broker, che seleziona un gruppo di shard. Gli shard recuperano e classificano i candidati; il broker riunisce i risultati e richiede i campi dei documenti selezionati.

Costruzione dell’indice e gestione delle query

La costruzione dell’indice e la gestione delle richieste avvengono su infrastrutture separate. Pillar prepara i dati in tabelle YTsaurus; gli indicizzatori generano le strutture per gli shard e un controller distribuisce le nuove versioni dell’indice ai gruppi che servono le query.

Perplexity afferma che Photon usa circa il 20% in meno di macchine equivalenti per il servizio rispetto al sistema precedente e memorizza circa 2,5 volte più dati per documento. Sono miglioramenti che riguardano l’efficienza dell’infrastruttura e la gestione dell’indice, oltre alla latenza dichiarata.

Che cosa misura il p99 dichiarato

Il p99 indica il valore entro cui ricade il 99% delle misurazioni considerate. Perplexity riporta un confronto in produzione tra il sistema precedente e Photon per le fasi di recupero e ranking:

SistemaLatenza p99 dichiarataAmbito
Sistema precedenteCirca 800 msRecupero e ranking nella ricerca di Perplexity
PhotonCirca 65 msFasi interne di Photon; non include le fasi successive della ricerca di livello superiore

Il valore di 65 ms non descrive quindi il tempo necessario per ottenere una risposta completa dalla ricerca di Perplexity: riguarda le fasi interne del motore.

Fast Search: benchmark e accesso API

Fast Search combina Photon con una configurazione di ranking più leggera, pensata per i flussi di lavoro con agenti. Perplexity dichiara una latenza di 160 ms al p50 e 230 ms al p95 per una singola chiamata API.

Nei sei benchmark WideSearch, BrowseComp, DSQA, FRAMES, SEAL-0 e SEAL-Hard, l’azienda riporta risultati su 3.554 attività selezionate. I costi indicati sono stime complessive per modello e ricerca nel test, non tariffe per singola richiesta.

MetricaFast SearchPreset predefinitoContesto
Punteggio ponderato per attività64,3%64,0%Sei benchmark, 3.554 attività selezionate
Costo stimato di modello e ricerca59,73 dollari187,60 dollariStesso insieme di attività
Rilevanza DCG2,212,45Test interni separati su query di coda lunga
Disponibilità di una risposta0,5670,596Test interni separati su query di coda lunga

Per le query di coda lunga, i due indicatori interni riportati da Perplexity sono più bassi per Fast Search che per il preset predefinito. L’azienda descrive quest’ultimo come adatto a domande difficili o ambigue, mentre orienta Fast Search verso i cicli operativi degli agenti e i casi in cui conta ridurre la latenza.

La documentazione dell’API fissa il prezzo di Fast Search a 1 dollaro ogni 1.000 richieste riuscite. Per attivare la modalità, la richiesta POST /search deve includere search_type: "fast"; il parametro max_results consente di chiedere da 1 a 20 risultati.