notas de campo

Notas de lo que
me voy encontrando.

Tutoriales, arquitectura y trampas de producción. Lo que aprendo construyendo, escrito mientras todavía me acuerdo de por qué me costó.

Explorar los casos de estudio
  1. Observabilidad de un LLM: tus logs no ven el fallo llm · observabilidad · produccion
  2. DPO frente a RLHF: alinear un modelo sin aprendizaje por refuerzo llm · fine-tuning · alineamiento
  3. El patrón ReAct: razonar y actuar en el mismo bucle agentes · llm · razonamiento
  4. Codificación posicional rotatoria (RoPE), explicada llm · transformers · atención
  5. Reescritura de consultas: el paso que a tu RAG le falta rag · recuperación · llm
  6. Razonamiento en inferencia: cuándo conviene que el modelo piense más llm · razonamiento · inferencia
  7. GraphRAG: cuándo el grafo le gana al vector rag · graphrag · grafos
  8. FlashAttention: la atención no era lenta por las cuentas, sino por la memoria llm · atencion · rendimiento
  9. RAG agéntico: cuando recuperar deja de ser un solo paso rag · agentes · llm
  10. PagedAttention: gestionar la KV cache como memoria de un sistema operativo llm · inferencia · kv-cache
  11. Prefill y decode: por qué un LLM tiene dos velocidades llm · inferencia · rendimiento
  12. Atención agrupada: el truco que encoge el KV cache llm · atencion · inferencia