Benchmark de Contexto con Google Gemini
Explora de forma interactiva las comparativas de costos, consumo de tokens y velocidad resultantes de alimentar prompts con el documento completo (Naive) versus la inyección optimizada de fragmentos relevantes mediante embeddings (RAG).
Panel de Control & Filtros
Selecciona una combinación de documento, pregunta y modelo para inspeccionar las métricas obtenidas con la API de Gemini, o visualiza el consolidado general.
Métricas de la Configuración Seleccionada
VISTA COMPARATIVANaive Context
Envía el documento completo directamente en el prompt. Consume muchos tokens de entrada y aumenta el costo exponencialmente.
Semantic Embedding
Divide el documento en chunks, genera embeddings y envía únicamente los fragmentos semánticamente más cercanos.
Base Vectorial: Mapa de Similitud Semántica
Los bloques representan los fragmentos del documento. El color púrpura representa la similitud con la pregunta. Haz clic sobre un bloque para inspeccionarlo.
Simulación de Escala a Nivel Mensual
Ajusta el volumen estimado de consultas para proyectar el impacto económico acumulado en base a la configuración actual.