[ Scrolls & chronicles ]Migration from Codea Bien
Blog
What I measured and what I learned.
- AUG 2026AI #llm serving #continuous batching
Serving in production: batching, concurrency and autoscaling
Mi servidor respondía perfecto con un usuario y se arrastraba con diez. La culpa no era del modelo ni de la GPU: era que atendía las peticiones de a una. El mismo modelo, la misma…
3 min // 150 xp
- AUG 2026Angular #angular #embeddings
RAG with Angular, Embeddings and Gemini
La mayoría de los desarrolladores Angular sigue pensando que RAG es territorio exclusivo de backenders y data engineers. No lo es. Si tu app necesita buscar información relevante y…
7 min // 350 xp
- AUG 2026AI #gpu for llm #vram needed
What hardware do you need? GPU, VRAM and cloud
"¿Compro una GPU o alquilo?" es la pregunta equivocada. La correcta es: ¿cuántas horas al mes la voy a usar? Todo lo demás (modelo, VRAM, precio) se deriva de esa cifra y de una cu…
3 min // 150 xp
- AUG 2026AI #quantization #4-bit
Quantization with numbers: quality vs VRAM vs speed
Un modelo que pesa 40 GB corriendo en una GPU de 16 GB. Eso no es un truco de marketing: es cuantización, y en un experimento documentado por Hugging Face fue exactamente el result…
3 min // 150 xp
- AUG 2026Angular #angular #testing
AI-Powered Feature Testing in Angular
Un test generado por Gemini en un proyecto Angular encontró un bug que llevaba semanas escondido (Si, Gemini xd)Si todavía escribes todos tus tests manualmente, estás dejando diner…
6 min // 300 xp
- AUG 2026AI #local inference #lm studio
Local inference in 2026: from LM Studio to vLLM (with VRAM math)
Instalé LM Studio un sábado por curiosidad. Dos horas después tenía un modelo corriendo en mi máquina y una pregunta nueva: si esto es tan fácil, ¿por qué la gente habla de VRAM co…
3 min // 150 xp
- AUG 2026AI #codebase for agents #deep modules
Design your repo so agents work better
Tu codebase influye más en el resultado del agente que tu prompt o tu AGENTS.md. Y eso es una buena noticia: es lo único de la lista que puedes diseñar en lugar de redactar mejor.
3 min // 150 xp
- AUG 2026AI #structured outputs #valid json
Structured outputs without suffering: JSON that doesn't break
En la demo el JSON sale bien. En producción, cuando el input es raro o la respuesta se alarga, sale casi bien. Y "casi" es un bug: un campo que falta a las 3 de la mañana es una pá…
4 min // 200 xp
- JUL 2026AI #agents.md #claude.md
AGENTS.md vs CLAUDE.md vs rules: the context your agent actually reads
Casi todo lo que escribes en tu AGENTS.md se ignora. Y no es culpa del agente: es que cada token de ese archivo se carga en cada petición, compita o no con la tarea del momento. Si…
4 min // 200 xp
- JUL 2026AI #ai workflow #web development with agents
My complete AI web development workflow: from issue to deploy
El error de mis primeros meses con agentes fue pedir código. "Hazme esta feature" y esperar magia. El resultado era predecible: código que funcionaba a medias, revisiones eternas y…
3 min // 150 xp