Asistente de IA en tu navegador
Habla con un asistente que atiende a los clientes de un negocio de ejemplo. El modelo de IA se ejecuta 100% en tu dispositivo — nada se envía a ningún servidor.
Este asistente atiende a un negocio ficticio («Restaurante La Terraza»). Es una demo de integración de IA — no es un negocio real ni toma reservas de verdad.
Prueba el asistente
Cárgalo una vez y conversa con él en español, como lo haría un cliente del negocio.
El modelo de IA se ejecuta 100% en tu navegador. Descarga única (~0,7 GB). Nada se envía a ningún servidor.
Descargando modelo… esto solo ocurre una vez.
Tu navegador no soporta el modelo en local; mostrando una demo guiada.
El problema
Tus clientes preguntan lo mismo una y otra vez — horarios, reservas, ubicación, opciones del menú — y muchas de esas preguntas llegan fuera de horario, cuando no hay nadie para responder. Un cliente sin respuesta rápida se va a otro sitio. Atender ese goteo de dudas a mano consume tiempo que no tienes.
Cómo funciona
Esta demo carga un modelo de lenguaje cuantizado directamente en tu navegador mediante WebLLM y WebGPU. Una vez descargado (solo la primera vez), el modelo queda en caché y responde sin volver a conectarse a internet. Todo el cómputo ocurre en tu dispositivo: nada de lo que escribes sale de tu navegador.
El asistente lleva un system prompt con los datos del negocio (horario, carta, ubicación) y responde solo dentro de ese contexto. En un montaje real, ese bloque se sustituye por los datos de tu negocio — clínica, peluquería, gimnasio, tienda — y el asistente se integra donde te haga falta: web, WhatsApp o ficha de Google.
Stack & arquitectura
Sin servidores, sin claves de API, sin coste por mensaje. Si el dispositivo no soporta WebGPU, la demo cambia automáticamente a un modo guiado con respuestas predefinidas.
¿Quieres un asistente así para tu negocio?
Hablemos: te digo en 5 minutos si encaja con tu caso.