notas de campo
Notas de lo que
me voy encontrando.
Tutoriales, arquitectura y trampas de producción. Lo que aprendo construyendo, escrito mientras todavía me acuerdo de por qué me costó.
Explorar los casos de estudio- Observabilidad de un LLM: tus logs no ven el fallo
- DPO frente a RLHF: alinear un modelo sin aprendizaje por refuerzo
- El patrón ReAct: razonar y actuar en el mismo bucle
- Codificación posicional rotatoria (RoPE), explicada
- Reescritura de consultas: el paso que a tu RAG le falta
- Razonamiento en inferencia: cuándo conviene que el modelo piense más
- GraphRAG: cuándo el grafo le gana al vector
- FlashAttention: la atención no era lenta por las cuentas, sino por la memoria
- RAG agéntico: cuando recuperar deja de ser un solo paso
- PagedAttention: gestionar la KV cache como memoria de un sistema operativo
- Prefill y decode: por qué un LLM tiene dos velocidades
- Atención agrupada: el truco que encoge el KV cache