← Volver a Capacidades
Integración IA Demo

Asistente de IA en tu navegador

Habla con un asistente que atiende a los clientes de un negocio de ejemplo. El modelo de IA se ejecuta 100% en tu dispositivo — nada se envía a ningún servidor.

Este asistente atiende a un negocio ficticio («Restaurante La Terraza»). Es una demo de integración de IA — no es un negocio real ni toma reservas de verdad.

Prueba el asistente

Cárgalo una vez y conversa con él en español, como lo haría un cliente del negocio.

El modelo de IA se ejecuta 100% en tu navegador. Descarga única (~0,7 GB). Nada se envía a ningún servidor.

El problema

Tus clientes preguntan lo mismo una y otra vez — horarios, reservas, ubicación, opciones del menú — y muchas de esas preguntas llegan fuera de horario, cuando no hay nadie para responder. Un cliente sin respuesta rápida se va a otro sitio. Atender ese goteo de dudas a mano consume tiempo que no tienes.

Cómo funciona

Esta demo carga un modelo de lenguaje cuantizado directamente en tu navegador mediante WebLLM y WebGPU. Una vez descargado (solo la primera vez), el modelo queda en caché y responde sin volver a conectarse a internet. Todo el cómputo ocurre en tu dispositivo: nada de lo que escribes sale de tu navegador.

El asistente lleva un system prompt con los datos del negocio (horario, carta, ubicación) y responde solo dentro de ese contexto. En un montaje real, ese bloque se sustituye por los datos de tu negocio — clínica, peluquería, gimnasio, tienda — y el asistente se integra donde te haga falta: web, WhatsApp o ficha de Google.

Stack & arquitectura

WebLLM WebGPU Llama 3.2 JavaScript
Navegador WebGPU Modelo en local Respuesta

Sin servidores, sin claves de API, sin coste por mensaje. Si el dispositivo no soporta WebGPU, la demo cambia automáticamente a un modo guiado con respuestas predefinidas.

¿Quieres un asistente así para tu negocio?

Hablemos: te digo en 5 minutos si encaja con tu caso.