Tags
第 15 頁
MLOps
MLflow:AI 團隊真正缺的常常不是模型,而是能追蹤、評估、交付的生命週期
vLLM:開源模型上線真正難的,不是跑出第一個 token,而是把吞吐、延遲和成本一起撐住
SkyPilot 把 AI 團隊最容易失控的算力調度,拉回同一個控制面
BentoML 正在補上 AI 團隊最容易低估的交付層
模型一多就會亂:LiteLLM 想做的不只是 API 轉接
1
2