Saltar al catálogo

Kit Prototipado con IA Reto Del Río

Herramientas y proyectos open source para armar el avatar de inducción de cajeros de Del Río y Superette: qué es gratis, qué corre en su laptop, qué habla español de México y qué se rompió este año. Tengan esta página abierta mientras construyen, de aquí a la demo.

Verificado el 8 de octubre de 2026 111 herramientas · 13 categorías

01Cómo usar este kit

  1. Empiecen por su combo. Elijan el perfil de su equipo (sin programadores, web o Python) y quédense con ese stack. No prueben todo.
  2. Filtren el catálogo. Categoría, etiquetas y buscador se combinan, y el enlace guarda el filtro: cópienlo y pásenselo al equipo.
  3. Antes de construir, lean lo que cambió y lo de privacidad. Muchas guías de internet ya no sirven, y los manuales de Del Río no van a cualquier capa gratis.

Las etiquetas solo se ponen cuando la fuente oficial lo confirma. Donde dice «reportado», lo dice un tercero: pruébenlo antes de confiar. La dificultad va de 1 (una tarde, sin código) a 5 (GPU NVIDIA y paciencia).

02El manual del reto, leído con IA

«Manual de procedimientos para cajeros · Tienda Escuela»: el material oficial que les entregaron. Es ficticio: Tienda Escuela no existe y no describe políticas de Del Río ni de Superette.

  1. Cabe completo. Son 34 páginas, unas 7,300 palabras: del orden de 10 mil tokens (estimación). Pueden pegarlo entero en las instrucciones del avatar; el RAG con embeddings conviene cuando sean muchos manuales.
  2. Citen como pide el manual: número de sección y subtítulo, por ejemplo [sección 8, Ticket sin ningún pago]. Troceen por sección y subtítulo: cada sección trae qué cubre, reglas, procedimiento, casos especiales y ejemplos.
  3. Ojo con las tablas. La referencia rápida, el catálogo y los cálculos vienen en tablas. Al pasarlo a texto (Docling o MarkItDown) revisen que no se desarmen.
  4. Las preguntas de cálculo son trampa. El modelo apuesta números: denle los ejemplos resueltos de la sección 7 (por ejemplo, $160.50 a las 09:00 y $163.50 a las 10:31) o una herramienta que calcule.
  5. La tabla «Lo que este manual no define» ya les dice a quién canalizar: salarios y prestaciones a Recursos Humanos, la fecha de abono de un reembolso al supervisor. De ahí salen sus 2 consultas sin respuesta.
  6. Datos sensibles: el manual prohíbe pedir NIP, contraseñas o números completos de tarjeta (secciones 4 y 13). Su avatar tampoco los pide.

03Combos por perfil de equipo

Un stack completo por tipo de equipo. Elijan uno y no se dispersen.

A · Sin programadores

Nadie del equipo programa, o casi nadie.

Construir
Google AI Studio Build con gemini-3.8-flash
Conocimiento
Gemini File Search, o AnythingLLM / Dify
Respaldo
Bolt.new (300K tokens al día)

Una sola persona maneja el constructor; los prompts se planean antes, entre todos.

B · Algo de web

Alguien sabe JavaScript o TypeScript.

Construir
Next.js o Vite + Vercel AI SDK v7 (o el SDK de OpenAI con baseURL)
Modelo
Gemini por su URL compatible; respaldo: Groq gpt-oss-120b u OpenRouter gemma-4:free
Conocimiento
Gemini File Search, o embedMany en memoria
Publicar
Vercel Hobby o Cloudflare
Agente de código
Copilot Student, Antigravity o Codex

La API key va en el servidor (variables de entorno), nunca en el frontend.

C · Python / ML

Alguien se mueve bien en Python y hay una laptop con 16 GB.

Modelo
Ollama con qwen3.5:9b o gemma4:e4b (16 GB)
Embeddings
embeddinggemma o bge-m3
Base vectorial
Chroma o LanceDB
Documentos
Docling
Cara
Gradio ChatInterface o Streamlit

Mismo cliente de OpenAI para el respaldo en la nube. Tengan la demo local como plan B.

Logística
  • Creen las API keys antes de empezar a construir, no a la hora de la demo.
  • Descarguen los modelos de Ollama por USB entre equipos para no saturar el WiFi.

04Lo que cambió en 2026

No se vayan con la finta: esto cerró, cambió de nombre o se puso más restrictivo, y muchas guías todavía no se enteran.

Cerraron o se abandonaron

  • GitHub Models Retirado el 30 de julio de 2026. Fuente
  • GitHub Spark Sin apps nuevas desde el 4 de agosto y sin acceso desde el 31 de agosto de 2026. Fuente
  • Firebase Studio Sin altas nuevas desde el 22 de junio de 2026; cierra el 22 de marzo de 2027. Fuente
  • Flowise Archivado; fin de vida el 31 de agosto de 2026. Fuente
  • Verba (Weaviate) Archivado el 8 de junio de 2026. Fuente
  • Roo Code Repo archivado (mayo de 2026). Fuente
  • Mesop Sin mantenimiento desde el 30 de septiembre de 2026. Fuente
  • OpenAI Assistants API Apagada el 26 de agosto de 2026 (reportado). Usen la Responses API. Fuente
  • OpenAI fine-tuning Cerrado a usuarios nuevos. Fuente
  • Gemini API tuning No hay desde mayo de 2025; solo en Agent Platform. Fuente
  • HF AutoTrain Sin mantenimiento. Usen Axolotl o TRL. Fuente
  • create-llama Estancado: última versión en julio de 2025. Fuente
  • Ready Player Me Cerró el 31 de enero de 2026, comprado por Netflix (reportado). Fuente
  • Coqui TTS La empresa cerró; el fork mantenido es idiap/coqui-ai-TTS. Fuente

Cambiaron de nombre

  • Windsurf Ahora es Devin Desktop. Fuente
  • NotebookLM Ahora es Gemini Notebook (16 de julio de 2026). Sin API para apps. Fuente
  • HeyGen Interactive Avatar Ahora es LiveAvatar (liveavatar.com); la API de streaming de HeyGen está deprecada. Fuente
  • LobeChat Ahora es LobeHub. Fuente
  • Vertex AI Ahora es Gemini Enterprise Agent Platform; Vertex AI Search ahora es Agent Search. Fuente
  • HeyGem Ahora es Duix-Avatar. Fuente
  • Quivr Pivoteó a motor de ingesta; ya no es chat. Fuente

Se pusieron más restrictivos

  • Gemini CLI Dejó de servir a cuentas personales gratis el 18 de junio de 2026. Reemplazo: Antigravity CLI (agy). Fuente
  • Hugging Face Spaces Gradio y Docker piden PRO; gratis solo 2 Spaces ZeroGPU con cuenta de más de 30 días. Sin crédito de Inference Providers para cuentas gratis. Fuente
  • Cerebras Ya no hay capa gratis permanente: prueba de $5 por 30 días, con tarjeta. Fuente
  • Cloudflare AutoRAG Ahora es AI Search y empieza a cobrar el 1 de noviembre de 2026. Fuente
  • bitHuman El plan gratis dice «API access until 12 October». Fuente

Otros cambios que rompen guías

  • Vercel AI SDK Va en v7: system pasa a instructions (deprecado) y stepCountIs a isStepCount. Fuente
  • Piper Se movió a OHF-Voice/piper1-gpl y ahora es GPL-3.0. Fuente
  • promptfoo Lo compró OpenAI (marzo de 2026); sigue open source. Fuente
  • Langfuse Lo compró ClickHouse (enero de 2026); el núcleo sigue MIT. Fuente

05Privacidad y llaves

Lo que mandan a una capa gratis deja de ser solo suyo. Y una llave en el frontend es una llave regalada.

Privacidad

  • La capa gratis no es privada. La capa gratis de Gemini usa lo que mandan para mejorar productos de Google; Mistral, reportadamente, igual. En OpenRouter algunos modelos gratis registran los prompts, y en OpenCode Zen algunos entrenan con sus datos. DeepSeek procesa en China.
  • Materiales internos de Del Río. Antes de subirlos a una capa gratis, pidan permiso al enlace de Del Río, usen una capa de pago o corran local. Decirlo en la presentación suma en viabilidad del piloto (10 %).
  • Nada de datos personales. Solo materiales autorizados: sin datos personales ni contraseñas en la base de conocimiento ni en las pruebas.

Llaves

  • La llave nunca va en el frontend. Va en el servidor, en variables de entorno, y fuera del repo (.env en el .gitignore). AI Studio Build la deja del lado del servidor y guarda los secretos en Settings.
  • Compartir también gasta. Si comparten una app de AI Studio Build, el uso de quien la abra cuenta contra la cuota de quien la compartió.
  • Una cuenta por integrante. Las capas gratis suelen ser por cuenta: si se les acaba la cuota, otra persona del equipo saca su llave.

06Escalera de voz y avatar

De $0 y fácil a lo más impresionante. Suban un peldaño solo cuando el anterior ya funciona: el 15 % de experiencia se gana con que el cajero entienda, no con 3D.

  1. Peldaño 1: Solo texto + imagen fija Obligatorio

    El chat funciona aunque todo lo demás falle.

    Con: Una imagen autorizada con estados (escucha, piensa, habla)

  2. Peldaño 2: Voz del navegador + boca falsa

    Lee la respuesta en voz alta y la boca se mueve con onboundary.

    Con: Web Speech (voces es-MX según el sistema)

  3. Peldaño 3: Mejor voz gratis + boca por amplitud

    Una voz más natural; la boca se abre con el volumen del audio.

    Con: Gemini TTS, ElevenLabs, Azure es-MX o Piper es_MX

  4. Peldaño 4: Avatar 3D en el navegador

    Un personaje 3D que habla, en cualquier laptop.

    Con: TalkingHead (avatar MPFB) o three-vrm + VRoid

  5. Peldaño 5: Voz en tiempo real + avatar 3D

    Conversación hablada, conectada al avatar del peldaño 4.

    Con: Gemini Live o ElevenLabs Agents

  6. Peldaño 6: Video fotorrealista

    Construyan contra un simulacro, gasten los minutos al final y graben un video de respaldo.

    Con: Simli > Tavus > Anam > LiveAvatar

  7. Peldaño 7: Fotorrealista local

    Solo si alguien trae GPU NVIDIA.

    Con: LiveTalking

Antes de la demo
  • Las capas gratis suelen ser por cuenta: cada integrante puede abrir la suya.
  • La mayoría pide ser mayor de 18 años.
  • El navegador bloquea el audio hasta que alguien hace clic: llamen a AudioContext.resume() en el primer clic.
  • El WiFi del evento puede tumbar la voz en la nube: tengan respaldo en texto.