Skip to content

[ Scrolls & chronicles ]Migration from Codea Bien

Blog

What I measured and what I learned.

  • AI #llm serving #continuous batching

    Serving in production: batching, concurrency and autoscaling

    Mi servidor respondía perfecto con un usuario y se arrastraba con diez. La culpa no era del modelo ni de la GPU: era que atendía las peticiones de a una. El mismo modelo, la misma…

    3 min // 150 xp

  • Angular #angular #embeddings

    RAG with Angular, Embeddings and Gemini

    La mayoría de los desarrolladores Angular sigue pensando que RAG es territorio exclusivo de backenders y data engineers. No lo es. Si tu app necesita buscar información relevante y…

    7 min // 350 xp

  • AI #gpu for llm #vram needed

    What hardware do you need? GPU, VRAM and cloud

    "¿Compro una GPU o alquilo?" es la pregunta equivocada. La correcta es: ¿cuántas horas al mes la voy a usar? Todo lo demás (modelo, VRAM, precio) se deriva de esa cifra y de una cu…

    3 min // 150 xp

  • AI #quantization #4-bit

    Quantization with numbers: quality vs VRAM vs speed

    Un modelo que pesa 40 GB corriendo en una GPU de 16 GB. Eso no es un truco de marketing: es cuantización, y en un experimento documentado por Hugging Face fue exactamente el result…

    3 min // 150 xp

  • Angular #angular #testing

    AI-Powered Feature Testing in Angular

    Un test generado por Gemini en un proyecto Angular encontró un bug que llevaba semanas escondido (Si, Gemini xd)Si todavía escribes todos tus tests manualmente, estás dejando diner…

    6 min // 300 xp

  • AI #local inference #lm studio

    Local inference in 2026: from LM Studio to vLLM (with VRAM math)

    Instalé LM Studio un sábado por curiosidad. Dos horas después tenía un modelo corriendo en mi máquina y una pregunta nueva: si esto es tan fácil, ¿por qué la gente habla de VRAM co…

    3 min // 150 xp

  • AI #codebase for agents #deep modules

    Design your repo so agents work better

    Tu codebase influye más en el resultado del agente que tu prompt o tu AGENTS.md. Y eso es una buena noticia: es lo único de la lista que puedes diseñar en lugar de redactar mejor.

    3 min // 150 xp

  • AI #structured outputs #valid json

    Structured outputs without suffering: JSON that doesn't break

    En la demo el JSON sale bien. En producción, cuando el input es raro o la respuesta se alarga, sale casi bien. Y "casi" es un bug: un campo que falta a las 3 de la mañana es una pá…

    4 min // 200 xp

  • AI #ai workflow #web development with agents

    My complete AI web development workflow: from issue to deploy

    El error de mis primeros meses con agentes fue pedir código. "Hazme esta feature" y esperar magia. El resultado era predecible: código que funcionaba a medias, revisiones eternas y…

    3 min // 150 xp