Il 24 settembre 2026 Perplexity ha presentato Photon, il motore interno che recupera e classifica le pagine candidate nella propria ricerca. L’azienda dichiara che il p99 delle fasi di Photon è sceso da circa 800 ms nel sistema precedente a circa 65 ms; Fast Search, invece, è una modalità dell’API con metriche riferite alla singola chiamata.
Il ruolo di Photon nella ricerca di Perplexity
Photon non è un motore di ricerca destinato all’uso diretto da parte dei consumatori: è un componente dell’infrastruttura di Perplexity. Recupera pagine candidate dal web e le ordina; il servizio di ricerca di livello superiore utilizza poi i contenuti delle pagine per generare una risposta.
Perplexity ha presentato Photon come la sostituzione del motore open source adattato che usava in precedenza. L’azienda lo colloca inoltre nel passaggio della propria infrastruttura di ricerca verso sistemi sviluppati internamente con Rust.
Il percorso di una query in Photon
Una richiesta passa dal bilanciatore di carico a un broker, che seleziona un gruppo di shard. Gli shard recuperano e classificano i candidati; il broker riunisce i risultati e richiede i campi dei documenti selezionati.
Costruzione dell’indice e gestione delle query
La costruzione dell’indice e la gestione delle richieste avvengono su infrastrutture separate. Pillar prepara i dati in tabelle YTsaurus; gli indicizzatori generano le strutture per gli shard e un controller distribuisce le nuove versioni dell’indice ai gruppi che servono le query.
Perplexity afferma che Photon usa circa il 20% in meno di macchine equivalenti per il servizio rispetto al sistema precedente e memorizza circa 2,5 volte più dati per documento. Sono miglioramenti che riguardano l’efficienza dell’infrastruttura e la gestione dell’indice, oltre alla latenza dichiarata.
Che cosa misura il p99 dichiarato
Il p99 indica il valore entro cui ricade il 99% delle misurazioni considerate. Perplexity riporta un confronto in produzione tra il sistema precedente e Photon per le fasi di recupero e ranking:
| Sistema | Latenza p99 dichiarata | Ambito |
| Sistema precedente | Circa 800 ms | Recupero e ranking nella ricerca di Perplexity |
| Photon | Circa 65 ms | Fasi interne di Photon; non include le fasi successive della ricerca di livello superiore |
Il valore di 65 ms non descrive quindi il tempo necessario per ottenere una risposta completa dalla ricerca di Perplexity: riguarda le fasi interne del motore.
Fast Search: benchmark e accesso API
Fast Search combina Photon con una configurazione di ranking più leggera, pensata per i flussi di lavoro con agenti. Perplexity dichiara una latenza di 160 ms al p50 e 230 ms al p95 per una singola chiamata API.
Nei sei benchmark WideSearch, BrowseComp, DSQA, FRAMES, SEAL-0 e SEAL-Hard, l’azienda riporta risultati su 3.554 attività selezionate. I costi indicati sono stime complessive per modello e ricerca nel test, non tariffe per singola richiesta.
| Metrica | Fast Search | Preset predefinito | Contesto |
| Punteggio ponderato per attività | 64,3% | 64,0% | Sei benchmark, 3.554 attività selezionate |
| Costo stimato di modello e ricerca | 59,73 dollari | 187,60 dollari | Stesso insieme di attività |
| Rilevanza DCG | 2,21 | 2,45 | Test interni separati su query di coda lunga |
| Disponibilità di una risposta | 0,567 | 0,596 | Test interni separati su query di coda lunga |
Per le query di coda lunga, i due indicatori interni riportati da Perplexity sono più bassi per Fast Search che per il preset predefinito. L’azienda descrive quest’ultimo come adatto a domande difficili o ambigue, mentre orienta Fast Search verso i cicli operativi degli agenti e i casi in cui conta ridurre la latenza.
La documentazione dell’API fissa il prezzo di Fast Search a 1 dollaro ogni 1.000 richieste riuscite. Per attivare la modalità, la richiesta POST /search deve includere search_type: "fast"; il parametro max_results consente di chiedere da 1 a 20 risultati.