Nadie nace sabiendo qué es un embedding. Aquí están, en cristiano.
- Agente
- Un modelo con herramientas y permiso para usarlas. La diferencia con un chat es que el agente ejecuta acciones, no solo contesta.
- MCP
- Model Context Protocol. El estándar para exponerle herramientas y datos a un modelo sin escribir una integración a la medida por cada cliente.
- RAG
- Recuperar primero, responder después: buscas los documentos relevantes y se los das al modelo en el prompt para que conteste con la información del cliente.
- Embedding
- Un texto convertido en números para poder compararlo por significado. Es lo que hace que “factura vencida” encuentre “pago pendiente”.
- Webhook
- Una URL tuya que otro sistema llama cuando pasa algo. Verifica siempre la firma y aguanta recibir el mismo evento dos veces.
- Idempotente
- Que correrlo dos veces da el mismo resultado que correrlo una. Obligatorio en cobros y en mensajes.
- RSC
- React Server Components: componentes que se pintan en el servidor y no mandan su JavaScript al navegador. El default en Next.
- Serverless
- Tu código corre solo cuando alguien lo llama y escala solo. A cambio: arranques en frío y nada de estado en memoria entre llamadas.
- RLS
- Row Level Security: reglas en Postgres que deciden qué filas puede ver cada usuario. Sin esto, Supabase enseña toda la tabla.
- TTS y STT
- Texto a voz y voz a texto. Las dos mitades de un agente que contesta el teléfono.
- Ventana de 24 h
- En WhatsApp, el tiempo que tienes para responder libre después de que el usuario escribe. Fuera de ahí, solo plantilla aprobada.
- Rate limit
- Tope de peticiones por usuario o por IP. Protege la factura de tokens y evita que alguien te tire el endpoint.
- Vista previa
- La URL que Vercel genera por cada PR. Es la forma correcta de enseñar trabajo sin publicarlo.
- Token
- La unidad con la que se cobra un modelo — más o menos tres cuartos de palabra. Cachear el prompt fijo baja la cuenta muchísimo.
- Ventana de contexto
- Cuánto le cabe al modelo en una sola conversación, contando lo que le mandas y lo que responde. Un millón de tokens son como diez libros; cuando se acaba, hay que resumir o cortar.
- Pesos abiertos
- Modelos cuyos archivos puedes descargar y correr en tu propia infraestructura — Qwen, DeepSeek, Kimi. Es la respuesta cuando el cliente dice que sus datos no salen de su casa. Abierto no siempre es gratis: revisa la licencia comercial.
- Effort
- La perilla de cuánto piensa el modelo antes de contestar, de low a max. Subirla cuesta tokens y tiempo; bajarla en tareas rutinarias casi no se nota y sí se ve en la factura.