Volver a la wiki

Decisión 2026-09-30 · Todo el Workspace pasa a Gemini 3.8 Flash (chat del Correo, bib_ask, Help, Tutor y HyDE)

Decisión de Edu (30-09-2026, s353): tras otro fallo del chat del Correo (”{“action”:“leer”,…}” crudo en pantalla y, a la tercera, frases sin sentido), el resto del Workspace sigue al Oráculo: gemini-3.8-flash con razonamiento bajo en la síntesis de bib_ask y del Help de CreaRack (normal y en streaming), el Tutor, HyDE y el chat del Correo. Auto-Plan (visión de planos, en CreaRack Pro) sigue en Gemma 4, que lo hace bien. CreaRack Pro (CNS, Tutor de red, asistente MIB) es un paso aparte, con su propio cambio de código.

Por qué (medido)

Reproducción local de la conversación real de Edu del 30-09 (“busca el último correo de UptimeRobot y léemelo”) con el mismo prompt del código (extraído de functions/api/correo/ask.ts), la misma generationConfig y resultados de búsqueda y de lectura simulados (repro-correo.mjs):

ModeloÚtilesQué pasó
gemma-4-26b-a4b-it (temp 0,3)0 de 5Las 5 veces: buscar → leer sin folderId (el Worker responde que falta) → JSON sin cerrar, que el chat enseñaba tal cual. Es exactamente lo que vio Edu.
gemini-3.8-flash (low, temp 1,0)5 de 5buscar → leer con carpeta → resumen correcto del correo, 4-5 s en total.

Era el quinto arreglo sobre el mismo chat (temperatura, recorte de bucles, rescate del JSON roto, prompt directo): cuando el mismo fallo vuelve tras varios parches, lo que falla es el modelo, no el parche. El 13-09 ya se había medido lo mismo en el Oráculo (Gemma 0/20, Gemini 8/8): [[decision—20260913—oraculo-gemini-38-flash]].

Qué cambia

Marcha atrás

Sin deploy: WORKSPACE_LLM_MODEL = "gemma-4-26b-a4b-it" en las variables de CF Pages. Un modelo que no sea Gemini vuelve a los techos y temperaturas de antes y sin thinkingConfig.

Coste

Gemma 4 en AI Studio: gratis. Gemini 3.8 Flash: 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de salida hasta el 31-12-2026; el doble desde 2027 (revisar en la mensual de enero). El Oráculo con este modelo cuesta céntimos al mes; el volumen de Help, bib_ask y Correo está por medir tras el despliegue.

Siguiente paso previsto

  1. CreaRack Pro (CNS, Tutor de red, MIB) a Gemini: separar la variable que hoy comparte con Auto-Plan y ajustar techo y razonamiento en el proveedor google_genai.
  2. Cloudflare AI Gateway delante de todas las llamadas de IA: registro de cada llamada, caché, límites y cambio automático de modelo si uno falla (funciones gratuitas, admite Google AI Studio y OpenRouter según su documentación).
Subir