Modos

Cuatro niveles de profundidad. Elige el más barato que responda tu pregunta.

Cada endpoint de búsqueda acepta un mode. Define cuántas candidatas se juzgan y si las mejores se abren y se leen antes de ordenarlas.

ultrafastnormaldeep
Sobre qué se juzga cada titulartitulartitular y bajadatitular y bajadatitular y bajada
Titulares nuevos juzgados por búsquedahasta 160hasta 160hasta 400todos
Notas que se abren y se leenhasta 4hasta 8
highlightsno disponibleno disponibleopcionalactivado por defecto
essentialopcionalopcionalopcionalactivado por defecto
Latencia típicacerca de 1 scerca de 1 s2–5 s10–15 s
PrecioBúsquedaBúsquedaBúsquedaBúsqueda profunda

normal es el modo por defecto.

Cómo elegir

  • ultra es el más barato. Úsalo para clasificar en volumen, alertas y todo lo que el titular ya dice.
  • fast es el mejor punto de partida para agentes que buscan en bucle: rápido, barato y con buena cobertura cuando el titular nombra el tema.
  • normal lee los mejores resultados antes de ordenarlos. Úsalo cuando un resultado equivocado sale caro: un titular que promete más que su nota se detecta y pasa a rejected.
  • deep juzga todo el índice y lee más. Úsalo para investigar, armar informes y preguntas donde necesitas todo, con fragmentos y lo esencial incluidos.

Los resultados llegan en dos tiempos

En cualquier modo, lo juzgado por titular llega primero —a más o menos un segundo— y cada resultado se confirma en su lugar a medida que se lee su nota. Con streaming recibes esos resultados parciales como eventos partial; sin él, recibes el resultado final.

Lo que no se paga dos veces

  • Memoria de juicios. Lo que el modelo ya dijo de un titular para una consulta se reusa durante una semana: una búsqueda repetida o parecida sólo paga lo nuevo.
  • Caché de resultados. Un pedido idéntico dentro de los 10 minutos sale de la caché: usage.tokens es 0 y no se cobra.

Mira Costos y caché para poner topes por pedido.

En esta página