Juanchi.dev
Nativo Digital · sistemas reales
·
InicioCVBlogLabContacto
Juanchi.dev
Nativo Digital · sistemas reales
·
InicioCVBlogLabContacto

Agentes y LLM con criterio

39 posts sobre LLM y 30 sobre agentes: sandboxes, guardrails, costo por tarea y benchmarks propios en vez de capturas de pantalla ajenas.

  • Agentes que ejecutan

    Sandboxes, permisos y qué pasa cuando un agente corre comandos de verdad.

  • Medir modelos

    Comparaciones sobre casos propios, con costo y latencia, no rankings genéricos.

  • Costo real de la IA

    Tokens por tarea, caching y de dónde sale la factura a fin de mes.

Lecturas recomendadas

Ver más
17 ago 2026

Noroboto: Lying Fonts y mitigación en Rust — lectura técnica sin hype

Las fuentes mienten. Noroboto documenta cómo el subsistema de texto puede devolver métricas incorrectas y propone mitigaciones en Rust. Antes de copiarlo a producción, hay que entender qué problema resuelve, dónde falla la receta común y qué experimento reproducible vale la pena correr.

17 ago 2026 · 8′ · Opinión · linux · sistemas

8′
17 ago 2026

Cline en producción: el agente de código autónomo para VS Code que uso con restricciones deliberadas

Cline puede crear archivos, ejecutar comandos y abrir el browser de forma autónoma desde VS Code. Eso suena a productividad. También huele a riesgo si no sabés qué permisos le das antes de empezar. Mi tesis: el modelo mental importa más que la herramienta.

17 ago 2026 · 9′ · Tutoriales · TypeScript · LLM

9′
02 ago 2026

Qwen3 en local con Ollama: qué cambió en la arquitectura y si vale el cambio

Qwen3 llegó con thinking mode y mejoras reales en código. Pero antes de reemplazar el modelo que ya tenés corriendo en Ollama, hay preguntas técnicas que responder primero. Acá las respondo sin vender hype.

02 ago 2026 · 9′ · Tutoriales · TypeScript · Inferencia Local

9′
22 jun 2026

Rate limiting en Next.js: qué proteger antes de elegir una librería

Rate limiting no es una dependencia npm: es una política de abuso. Antes de copiar middleware, necesitás definir qué activo protegés, qué patrón de abuso esperás y cuánto te cuesta un falso positivo. Una guía con matriz de decisión, gotchas reales y observabilidad para Next.js.

22 jun 2026 · 9′ · Tutoriales · TypeScript · nextjs

9′
20 jun 2026

OWASP LLM Top 10 en producción: cómo audité mi pipeline de agentes TypeScript contra los 10 riesgos y qué encontré

Aplicar el OWASP LLM Top 10 como auditoría real es muy distinto a leerlo como lista. Lo corrí contra mi stack de agentes TypeScript con system prompts, MCP tools y Cline — y los hallazgos fueron incómodos.

20 jun 2026 · 9′ · Tutoriales · TypeScript · LLM

9′
15 jun 2026

Métodos formales y el futuro de la programación: qué vale la pena probar y dónde está el techo

Formal methods aparece cada tanto en el radar técnico como la solución que la industria ignoró. Mi lectura: el problema que señala es real, pero la receta que circula omite costos que cambian la ecuación.

15 jun 2026 · 9′ · Opinión · TypeScript · sistemas distribuidos

9′

Juanchi.dev es el cuaderno público de Juan Torchia — arquitectura, sistemas reales y decisiones de producto. Escrito y revisado a mano en Buenos Aires. Construido con Next.js, Prisma y PostgreSQL; desplegado en Railway. Sin trackers de terceros más allá de analítica agregada.

BlogUsesNowGitHubRSS© 2026 Juan Torchia · Todos los derechos reservados.