К Roadmap
Оптимизация inference и high-load serving
Основы оптимизации inference
Latency, throughput, память, стоимость, профилирование, поиск узкого места, компромиссы batching и учёт конкретного железа.
Полный доступ
Открыть Roadmap «Продвинутая ML-инженерия»
Все опубликованные темы Roadmap
Объяснения, формулы и примеры в подготовленных главах
Практика в главах, где она уже подготовлена
Будущие обновления без доплаты
Отдельная покупка остаётся в аккаунте навсегда и включает будущие обновления.