Modos
Cuatro niveles de profundidad. Elige el más barato que responda tu pregunta.
Cada endpoint de búsqueda acepta un mode. Define cuántas candidatas se juzgan y si las mejores se abren y
se leen antes de ordenarlas.
ultra | fast | normal | deep | |
|---|---|---|---|---|
| Sobre qué se juzga cada titular | titular | titular y bajada | titular y bajada | titular y bajada |
| Titulares nuevos juzgados por búsqueda | hasta 160 | hasta 160 | hasta 400 | todos |
| Notas que se abren y se leen | — | — | hasta 4 | hasta 8 |
highlights | no disponible | no disponible | opcional | activado por defecto |
essential | opcional | opcional | opcional | activado por defecto |
| Latencia típica | cerca de 1 s | cerca de 1 s | 2–5 s | 10–15 s |
| Precio | Búsqueda | Búsqueda | Búsqueda | Búsqueda profunda |
normal es el modo por defecto.
Cómo elegir
ultraes el más barato. Úsalo para clasificar en volumen, alertas y todo lo que el titular ya dice.fastes el mejor punto de partida para agentes que buscan en bucle: rápido, barato y con buena cobertura cuando el titular nombra el tema.normallee los mejores resultados antes de ordenarlos. Úsalo cuando un resultado equivocado sale caro: un titular que promete más que su nota se detecta y pasa arejected.deepjuzga todo el índice y lee más. Úsalo para investigar, armar informes y preguntas donde necesitas todo, con fragmentos y lo esencial incluidos.
Los resultados llegan en dos tiempos
En cualquier modo, lo juzgado por titular llega primero —a más o menos un segundo— y cada resultado se
confirma en su lugar a medida que se lee su nota. Con streaming recibes esos
resultados parciales como eventos partial; sin él, recibes el resultado final.
Lo que no se paga dos veces
- Memoria de juicios. Lo que el modelo ya dijo de un titular para una consulta se reusa durante una semana: una búsqueda repetida o parecida sólo paga lo nuevo.
- Caché de resultados. Un pedido idéntico dentro de los 10 minutos sale de la caché:
usage.tokenses0y no se cobra.
Mira Costos y caché para poner topes por pedido.