MLflow 3.7.0
·9 分钟阅读
MLflow 3.7.0 针对生成式 AI (GenAI) 的可观测性、评估和提示词管理引入了多项重大功能和改进。
主要功能
- 📝 实验提示词 UI:实验界面中新增的提示词功能允许您直接在实验中管理和搜索提示词,并支持在追踪 (Traces) 中使用过滤字符串和提示词版本搜索。 (#19156, #18919, #18906, @TomeHirata)
- 💬 多轮对话评估支持:增强后的
mlflow.genai.evaluate现已支持多轮对话,通过 DataFrame 和列表输入,能够对对话式 AI 应用进行全面的评估。 (#18971, @AveshCSingh) - ⚖️ 追踪对比:追踪 UI 中新增的并排对比视图允许您分析和调试不同运行 (Runs) 之间的 LLM 应用行为,从而更轻松地识别回归问题和改进项。 (#17138, @joelrobin18)
- 🌐 Gemini TypeScript SDK:为 Google 的 Gemini 提供 TypeScript 自动追踪支持,扩展了 MLflow 对 JavaScript/TypeScript AI 应用的可观测性能力。 (#18207, @joelrobin18)
- 🎯 判分器 (Judges) 的结构化输出:
make_judgeAPI 现已支持结构化输出,从而能够获取更精确且可编程的评估结果。 (#18529, @TomeHirata) - 🔗 VoltAgent 追踪:增加了对 VoltAgent 的自动追踪支持,将 MLflow 的可观测性扩展至该 AI Agent 框架。 (#19041, @joelrobin18)
重大变更
- [Tracking] SQLite 现已成为 MLflow 跟踪服务器的默认后端。 (#18497, @harupy)
- [Models] 移除已弃用的
diviner模式 (flavor) (#18808, @copilot-swe-agent) - [Models] 移除已弃用的
promptflow模式 (flavor) (#18805, @copilot-swe-agent)
功能更新
- [Tracking] 为 SQLite 数据库文件创建父目录 (#19205, @harupy)
- [Prompts] 在加载/注册提示词时关联提示词与实验 (#18883, @TomeHirata)
- [Tracking] 将环境变量回退功能包含在 SGC 运行恢复中 (#19143, @artjen)
- [Tracking] 增加从 Databricks Jobs 恢复 SGC 运行的支持 (#19015, @artjen)
- [Evaluation] 在
mlflow scorers list命令中增加--builtin/-b标志 (#19095, @alkispoly-db) - [Tracing] Pydantic AI 聊天 UI 支持 (#18777, @joelrobin18)
- [Tracking] 增加评估器 (scorers) 的身份验证支持 (#18699, @BenWilson2)
- [Evaluation] 从评估器中移除实验性标志 (#18122, @BenWilson2)
- [Evaluation] 为所有内置评估器添加描述字段 (#18547, @alkispoly-db)
错误修复
- [Tracing] 处理包含第三方通用根 Span 的追踪 (#19217, @B-Step62)
- [Tracing] 根据 OpenTelemetry 规范修复 OTLP 端点路径处理 (#19154, @harupy)
- [Tracing] 为 OTLP 追踪端点增加 gzip/deflate 内容编码 (Content-Encoding) 支持 (#19024, @Miaoxiang-philips)
- [Tracing] 添加缺失的
_delete_trace_tag_v3API (#18813, @Tian-Sky-Lan) - [Tracing] 修复聊天会话视图中的漏洞:由于时间戳过滤错误,导致 UI 启动后创建的新会话不可见 (#18928, @dbczumar)
- [Tracing] 修复空列表/字典的 OTLP 原型 (proto) 转换问题 (#18958, @B-Step62)
- [Tracing] Agno V2 修复 (#18345, @joelrobin18)
- [Tracing] 修复
/v1/traces端点以返回 protobuf 而非 JSON (#18929, @copilot-swe-agent) - [Tracing] 在 MCP extra 中锁定
click!=8.3.0以修复 MCP 服务器故障 (#18748, @copilot-swe-agent) - [Tracing] 为外部用户修复 MCP 服务器
uv安装命令 (#18745, @copilot-swe-agent) - [Evaluation] 通过使用 agentic judge 适配器修复基于追踪的评估器评估问题 (#19123, @alkispoly-db)
- [Evaluation] 修复受管评估器注册失败问题 (#19146, @xsh310)
- [Evaluation] 修复
InstructionsJudge将评估器描述用作评估值的问题 (#19121, @alkispoly-db) - [Evaluation] 为正确性评估器的预期字段添加验证 (#19026, @smoorjani)
- [Evaluation] 修复模型 URI 下划线处理问题 (#18849, @RohanRouth)
- [Evaluation] 修复
evaluate_tracesMCP 工具错误:使用result_df代替tables(#18825, @alkispoly-db) - [Evaluation] 通过添加必需的
anthropic_version字段修复 Bedrock Anthropic 适配器 (#17744, @harupy) - [Evaluation] 修复现有身份验证表的迁移问题 (#18793, @BenWilson2)
- [Tracking] 修复跟踪 URI 的传播 (#18023, @shaperilio)
- [Tracking] 修复
SqlLoggedModelMetric与experiment_id的关联 (#18382, @mcompen) - [Tracking] 将 Flask 路由添加到身份验证验证器中 (#18486, @BenWilson2)
- [Tracking] 添加缺失的协议处理器以处理数据集的实验关联 (#18769, @BenWilson2)
- [UI] 在评估数据集 UI 中显示完整的数据集记录内容并添加搜索栏 (#19000, @dbczumar)
- [UI] 从相对 API 路径请求 TraceInfo 和 Trace 评估 (#19032, @kbolashev)
- [UI] 定义
LoggedModelOutput.to_dictionary(),以便可以将LoggedModelOutput和包含它们的运行进行 JSON 序列化 (#19017, @nicklamiller) - [UI] 修复 TracesUI 页面中的路由问题 (#19044, @joelrobin18)
- [Build] 修复
mlflow gc以删除模型工件 (#17282, @joelrobin18) - [Build] 修复 MCP 服务器中 Click 8.3.0 的
Sentinel.UNSET处理 (#18858, @harupy) - [Build] 为 Amazon S3 添加存储桶所有权检查 (#18542, @kingroryg)
- [Docs] 修复自定义追踪快速入门示例中的 Python 缩进 (#19185, @copilot-swe-agent)
- [Docs] 修复 API 文档中属性块水平渲染的问题 (#19125, @copilot-swe-agent)
- [Docs] 修复文档侧边栏中缺失 api_reference 前缀的 CLI 链接 (#18893, @copilot-swe-agent)
- [Docs] 修复笔记本下载 URL 以使用版本化路径 (#18806, @harupy)
- [Docs] 修复已删除的入门页面文档重定向问题 (#18789, @copilot-swe-agent)
- [Models] 修复共享集群中的 Py4j 有状态问题 (#19139, @BenWilson2)
- [Models] 防止本地工件存储中的符号链接路径遍历 (#18964, @BenWilson2)
文档更新
- [Docs] 添加 LangGraph 优化指南 (#19180, @TomeHirata)
- [Docs] 为多轮评估支持的第一阶段添加文档 (#19033, @smoorjani)
- [Docs] 更新 transformers 和 sentence transformers 文档 (#18925, @BenWilson2)
- [Docs] 清理经典评估 (Classic Eval) 文档 (#19013, @BenWilson2)
- [Docs] 改进
prompt_template的文档说明 (#19105, @ingo-stallknecht) - [Docs] 修复机器学习文档主页中的拼写错误 (#19048, @copilot-swe-agent)
- [Docs] 将文档中的 GIF 动画转换为 MP4 视频 (#18946, @harupy)
- [Docs] 通过调整侧边栏布局和样式提高可读性 (#18937, @kevin-lyn)
- [Docs] 清理 scikit-learn 文档 (#18794, @BenWilson2)
- [Docs] 清理 XGBoost 文档 (#18790, @BenWilson2)
- [Docs] 清理 TensorFlow 文档 (#18850, @BenWilson2)
- [Docs] 在 OTel collector YAML 中使用正确的 OTLP HTTP 导出器 (#18930, @Miaoxiang-philips)
- [Docs] 清理 SpaCy 和 Keras 文档 (#18895, @BenWilson2)
- [Docs] 修复追踪文档页面中的内容 (#18750, @B-Step62)
- [Docs] 改进文件存储弃用警告消息 (#18900, @harupy)
- [Docs] 清理 MLflow 3 文档内容 (#18871, @BenWilson2)
- [Docs] 使用
make_judgeAPI 和直接调用评估器添加多轮评估创建指南 (#18897, @xsh310) - [Docs] 清理 PyTorch 文档 (#18816, @BenWilson2)
- [Docs] 清理 Prophet 文档 (#18814, @BenWilson2)
- [Docs] 清理 SparkML 文档 (#18811, @BenWilson2)
- [Docs] 清理传统 ML 落地页 (#18799, @BenWilson2)
- [Docs] 清理深度学习落地页 (#18820, @BenWilson2)
- [Docs] 清理评估数据集文档 (#18766, @BenWilson2)
- [Docs] 修复 OpenTelemetry 文档 (#18810, @joelrobin18)
- [Docs] 阐明
mlflow gc命令针对固定运行和注册模型时的行为 (#18704, @copilot-swe-agent)
有关变更的完整列表,请查看 版本变更日志,并查看 mlflow.org 上的最新文档。
