搜索:MLOps

共命中 2 条(服务端检索)
LLM 应用的可观测性:看懂每一次模型调用的四个层面
传统 APM 盯的是「请求是否 200」,LLM 应用的问题是「200 的请求答得对不对、花了多少钱」。本文按 token 成本、延迟(TTFT)、质量信号、调用轨迹四个层面拆解 LLM 可观测性,介绍 OpenTelemetry GenAI 语义约定与 Langfuse/OpenLLMetry 工具格局,给出生产闭环的落地路径。
原创 后端技术 精选 · 原创 · 今天 阅读 1·访客 1
Nebius Opens 2026 Physical AI Awards: Five $150K Compute Credit Prizes
Once a physical AI product is in the field, the compute problem changes shape. Fleet data starts arriving faster than a …
行业动态 MarkTechPost · 9-30 阅读 31·访客 30