2 / 25
FastAPI + ML: как за 30 строк сделать inference-эндпоинт?
FastAPI — это стандарт де-факто для оборачивания ML-моделей в HTTP-API. За 30 строк вы получаете типизированный @app.post("/predict") с pydantic-валидацией входа, автоматическим OpenAPI-доком на /docs и async-обработчиком. Модель грузится один раз на старте через lifespan, а сервер uvicorn уже готов к деплою в Docker / Kubernetes.