Кэширование
Раздел темы «LLM в продакшене». Вопросы проверяют понимание практики, а не память на API конкретных библиотек. После ответа — разбор: почему верный вариант верен, чем плох каждый неверный и какую главу прочитать.
Сложность теста Форматы: несколько верных, один верный вариант
01
Что проверяем
- Точное кэширование
- Утечка через кэш
- Семантический кэш
- Кэш на клиенте и на сервере
- Зачем вообще кэшировать
- Экономия оптимизаций не складывается
02
Где читать
- Ли, AI Agents in Depthразд. 7.6.3
- Хьюэн, Инженерия ИИгл. 10
- Lakshmanan, Hapke, Generative AI Design Patternsгл. 8, паттерн 25