[!NOTE] Automatische vertaling Dit artikel is automatisch vertaald vanuit de oorspronkelijke Engelse versie.
Rand van de context
Praktische tips van Slava Dubrov over AI engineering. Hierin schrijf ik over de onderdelen van AI-systemen die in een productieomgeving moeten blijven functioneren: agent runtimes, geheugen, beveiliging, retrieval, evaluatie, LLM-infrastructuur en de ontwikkelaartools die daarbij horen.
Begin hier
- Agent architectuur: reasoning lussen, geheugen, tool use, beveiliging, en langlopende runtimes.
- Retrieval en evaluatie: RAG evaluatie, zoekranking, en context engineering.
- LLM infrastructuur: fine-tuning, vLLM structured outputs, LoRAX serving, en LLM ingenieursconcepten.
- Ontwikkelaarstools: UV op macOS, pyproject.toml, en lokale LLMs op macOS.
De blog bekijken
De Index van de blog Elke post wordt opgesomd en kan gefilterd worden op onderwerp of serie. Het ontwerpen van de Agentic-stack hij loopt stap voor stap door het agent-architectuurdeel. Voor informatie over de achtergrond van de auteur, conferentiepresentaties en de behandeling van onderwerpen, zie Over mij.