大数跨境

【7月重点功能发布】阿里云大数据+ AI 一体化平台

【7月重点功能发布】阿里云大数据+ AI 一体化平台 阿里云大数据AI平台
2026-08-13
2
导读:大数据 AI 产品技术月刊【2026 年 7 月】,涵盖 7 月技术速递、产品和功能发布、市场和客户应用实践等内容,帮助您快速了解阿里云大数据& AI 方面最新动态。
大数据& AI 产品技术月刊【2026 年 7 月】,涵盖 7 月技术速递、产品和功能发布、市场和客户应用实践等内容,帮助您快速了解阿里云大数据& AI 方面最新动态。

云原生大数据计算服务 MaxCompute

1. Agentic 生态接入套件正式发布

MaxCompute 推出 Agentic 生态接入套件,含 AI 数据探索客户端、MCP Server、CLI 三大组件,以 AI Query 智能问数、AI Coding 辅助编码为核心,打通桌面交互分析到 AI Agent 自动化的全场景数据开发。


2. MaxFrame 具身行业 EGO 数据管线解决方案发布

面向具身智能训练数据生产场景,MaxFrame 推出具身行业 EGO 端到端数据管线解决方案,基于 MaxCompute DPE 引擎打通"第一视角人手视频 → LeRobot 数据集"全流程,统一调度 CU/GU/Token 三类资源,覆盖切分抽帧、几何估计、3D 手部重建、动作分段、VLM 打标与 Embedding、LeRobot 导出多个环节。


3. MaxAgent正式版本发布

MaxAgent 是 MaxCompute 平台的 AI 智能助手,为用户提供全链路自服务与智能运维能力,降低使用门槛,提升运维效率。MaxAgent 支持以自然语言方式完成作业诊断、数据查询、成本分析、资源优化、权限审计、元数据探索等场景,无需记忆复杂命令或手动查找文档,即可完成日常开发与运维工作。


4. Maxcompute多模态检索能力发布

MaxCompute 在原有离线批处理与数据分析引擎的基础上,通过原生 VECTOR 数据类型、 AI_EMBEDDING 函数、向量索引VECTOR INDEX 及向量检索函数VECTOR SEARCH Function的全链路能力,使用户能够直接通过 SQL 完成从多模态数据入仓、Embedding 生成和和向量化存储、索引构建、及最终的离线批量相似性检索的端到端链路,尤其适用于需要对海量数据


5. SQL 增强版嵌套列裁剪功能

作为MaxCompute 面向复杂类型数据查询提供的一项性能优化能力,当表中包含 STRUCT、ARRAY<STRUCT>、MAP<STRING, STRUCT> 或多层组合嵌套类型时,查询通常只会访问其中少量字段。开启增强版嵌套列裁剪后,MaxCompute 可以在读取数据时只扫描实际需要的子字段,避免读取未使用的嵌套字段,从而减少存储 I/O、降低内存开销并提升查询性能。


6. 支持生成列Generated Column能力

生成列(Generated Column)是 MaxCompute 提供的一种特殊列类型,其值由表中其他列通过确定性表达式自动计算得出,无需用户手动插入或更新。生成列可以显著简化数据处理逻辑、保证数据一致性,并提升查询性能。


7. MaxFrame AI Function 多模态混合输入能力支持

MaxFrame AI Function 新增多模态混合输入能力,支持单次调用同时传入文本、图片、音频、视频的任意组合,对接百炼 Qwen-Omni 全模态模型完成跨模态联合推理,具备批量处理混合模态数据能力。


8. MaxFrame 自动弹性内存功能

MaxFrame 提供 SubStep 粒度的 OOM 自动识别与弹性扩容重试机制,将内存资源从"全局按峰值预留"升级为"分片按需分配",从根本上解决数据倾斜导致的内存浪费与作业失败问题,一行配置即可开启,在特定场景下 CU 成本降低最高达 60%+。

实时数仓 Hologres

1. AI助手新增CPU/内存诊断、慢SQL日志诊断、诊断报告

围绕Hologres实例,AI助手基于资深数仓专家沉淀的多个Skills,提供多agent协同支撑数仓全生命周期问题,包含知识问答、实例诊断、SQL调优等丰富的数仓场景,助力数仓从入门到精通,0代码,0门槛,开箱即用。

大数据开发治理平台 DataWorks

1. Data Agent 消耗 Token 支持租户级与用户级的限额管理

用户限额支持批量调整或逐个调整,让团队可以根据角色和任务需要分配用量,降低超额消耗带来的成本风险。


2. ChatBI - 会话支持上传临时文件分析

ChatBI 会话新增临时文件上传功能,支持用户直接上传本地文件作为临时数据进行即席分析。方便进行敏捷探查,提高数据分析灵活性。


3. ChatBI - 深度对接语义层与 Data Agent

ChatBI 数据集全面关联语义解析任务,并接入 DataWorks Data Agent,显著提升自然语言问答的准确性与智能分析深度。


4. ChatBI - 支持自定义 Skill 与多端 AI 协同

ChatBI 开放自定义 Skill 注册管理,并全面对接 DataWorks AI 助理,可通 IM 端打造无缝衔接的办公协同数据分析体验。


5. ChatBI - 会话交互体验升级与权限下放

ChatBI 新增会话置顶与数据集详情侧边栏,优化界面交互;同时下放数据源引用权限,降低普通成员使用门槛。


6. ChatBI - 深度分析模式联动 Notebook 生成

ChatBI 深度分析模式下支持自动生成 Notebook 并预览,实现分析过程的代码化沉淀与后续二次编辑。


7. 基于 Data Agent 的安全管理套件与 SKILL 全新发布

推出数据保护与安全中心专家套件及多项安全 SKILL,通过 AI 赋能数据安全运营、权限管理与自动化审批,全面提升企业数据安全防护与治理效率。


8. 安全中心支持敏感数据行为日志支持备份到 OSS

DataWorks 安全中心支持敏感数据行为日志支持导出/备份到 OSS,满足日志长期保存与合规归档需求。


9. 开放平台专家套件发布

DataWorks 开放平台推出专家套件,聚焦 API 可观测分析与开发者智能服务,全面提升 API 运营效率与开发者接入体验。

实时计算 Flink版

1. Flink Agents 支持流式 AI Agent 开发

实时计算 Flink 版新增 Flink Agents 能力,支持开发事件驱动的流式 AI Agent 作业。开发者可在 Flink 作业中处理持续到来的业务事件,并将实时数据处理结果接入智能体工作流,构建面向实时感知、分析与决策的 AI 应用。


2. Kafka YAML Source 增强复杂 JSON 与删除事件处理

Kafka YAML Source 支持重复键 JSON 和 Tombstone 删除事件,提升复杂数据接入兼容性及日志压缩 Topic 同步能力。


3. Paimon Variant Shredding 上线

实时计算 Flink 版的 Paimon 新增 Variant Shredding 能力,可对半结构化 Variant 数据进行分层存储与处理,提升数据存储效率及查询性能,帮助客户更高效地管理和分析 JSON 等半结构化数据。


4. SQL Server CDC Source 公测上线

SQL Server CDC Source 开启公测,支持实时捕获 SQL Server 数据变更,扩展企业数据库实时同步能力。


5. Flink AI Function 支持 NVIDIA Triton Inference Server

实时计算 Flink 版的 AI Function 新增 NVIDIA Triton Inference Server 支持。用户可将 Flink 作业连接至已部署的 Triton 推理服务,调用远程模型完成实时推理,扩展模型服务接入方式并更好地复用现有 NVIDIA Triton 推理基础设施。


6ml_predict 支持复用 CREATE MODEL 模型参数

ml_predict 函数支持复用 CREATE MODEL 中定义的部分模型参数。开发者无需在每条推理 SQL 中重复填写相同配置,即可保持模型调用参数一致,并降低作业编写与后续维护成本。该能力适用于需要批量构建实时 AI 推理作业的场景。


7Flink 多模态模型调用参数适配优化发布

实时计算 Flink 版优化了多模态模型调用的参数适配能力,支持开发者在流式 SQL 作业中更便捷地调用图像和视频理解模型。该能力可降低多模态推理接入与参数配置的复杂度,帮助客户将图像、视频等非结构化内容的理解结果实时融入数据处理链路,提升内容理解与实时业务分析的开发效率。


8支持接入 NVIDIA Triton Inference Server 远程推理服务

实时计算 Flink版 VVR 11.7 支持接入 NVIDIA Triton Inference Server,扩展远程在线推理服务的接入选择。开发者可在流式数据处理作业中调用 Triton 推理服务,构建实时智能处理流程。


9Flink Agents 流式 AI Agent 开发支持

实时计算 Flink版 VVR 11.7 支持 Flink Agents,可基于开源 Flink Agents 开发事件驱动的流式 AI Agent 作业。该能力将实时数据处理与 AI Agent 开发结合,帮助开发者更高效地构建实时智能应用。


10ml_predict 支持复用 CREATE MODEL 参数

ml_predict 函数支持复用 CREATE MODEL 中定义的模型参数。创建模型后,用户可在推理 SQL 中直接引用模型配置,减少重复填写参数的工作量,简化模型推理作业开发。


11Paimon Variant Shredding 支持发布

实时计算 Flink 版新增 Paimon Variant Shredding 支持。该能力可优化半结构化数据的组织方式,提升 JSON 等 Variant 数据在 Paimon 中的存储与查询效率,帮助用户更高效地构建实时数据湖仓分析链路。


12Paimon 向量表检索能力发布

实时计算 Flink版新增 Paimon 向量表检索能力。用户可通过 vector_search 存储过程对 Paimon 向量表执行检索,便于在湖仓场景中实现向量数据的存储、管理和检索,为智能检索、RAG 等应用提供数据处理基础。


13. Flink 智能助手新增 Skill 调用能力

控制台智能助手支持在对话界面通过自然语言触发作业操作、运维诊断、资源调优和知识问答等 Skill,并以结构化方式返回执行结果,同时给出后续参数推荐与操作建议。


14Flink Agent Skill 上架阿里云 Skill Hu

实时计算 Flink 版首批 2 个 Agent Skill 已上架阿里云 Skill Hub,支持接入 Claude Code、OpenClaw 等主流 AI Agent 平台,完成实例管理、命名空间管理和工作空间作业运维操作。


15Flink 新购支持 PrivateZone 共享 VPC

实时计算 Flink 版新购实例支持 PrivateZone 共享 VPC。在共享 VPC 环境中,用户无需进行额外网络配置即可购买实例,降低网络接入复杂度并提升实例开通效率。


16自动调优支持 Flink CDC YAML 数据摄入作业

自动调优功能现已支持 Flink CDC YAML 数据摄入作业。您可在数据摄入场景中使用自动调优能力,根据作业运行状况获取资源配置优化建议并执行调优,提升资源使用效率和作业运行稳定性。


17Fluss正式商业化

Fluss正式商业化,提供湖流一体一站式方案,支持主键表upsert与点查,简化实时架构,降低运维成本。


18CDC YAML 支持百炼内置模型调用

VVR 11.8.0.preview.2 在 CDC YAML 作业中支持使用内置模型调用 AI Function,并支持配置系统提示词。该能力为公测预览版本,建议在开发测试环境中试用。


19AI Function 支持多模态组合输入

VVR 11.8.0.preview.2 的 AI Function 新增 content-types 参数,支持组合文本、图片等多种模态数据传递给模型进行推理,扩展多模态智能处理能力。该能力为公测预览版本,建议在开发测试环境中试用。


20Python DataFrame API 新增多模态处理算子

新增多模态算子,覆盖图像变换、检测识别、人脸处理和视频抽帧等场景。依赖和模型内置于 VVR 镜像。VVR 11.8.0.preview.2 公测预览。


21Flink SQL 可直接调用多模态处理函数

Python 内置多模态处理函数加载后可在 Flink SQL 中直接调用,无需编写 Python 代码。VVR 11.8.0.preview.2 公测预览,建议在开发测试环境中试用。


22新增 OSS CDC Connector

通过消费 MNS 队列中的 OSS 事件通知,实时捕获对象存储 OSS 的文件新增和删除事件,实现增量数据读取;同时支持全量扫描指定路径下的对象元数据。VVR 11.8.0.preview.2 公测预览,建议在开发测试环境中试用。


23Flink 智能巡检(公测)支持自动巡检及日报推送

新增系统自动巡检触发能力:每日定时对全量运行作业执行健康巡检,无需手动发起。新增巡检日报推送能力:通过控制台消息中心推送每日巡检报告,包含健康分概览、风险作业列表、根因分析及优化建议。该能力处于公测期,免费且不计入 Flink AI 服务免费额度。


24Flink AI服务(内置模型)正式支持按量付费

Flink AI 服务正式上线按量付费模式。使用内置模型进行推理调用将产生独立于 CU 计算资源的模型调用费用,并按 Token 用量计费。每个主账号每个地域每个自然月前 100 万 Token 免费,输入与输出合计,超出部分按定价计费。


25Flink 智能助手新增思维链可视化并优化交互体验

新增思维链可视化展示,工具调用过程与中间参数默认折叠,用户可按需展开查看完整推理过程。优化助手组件布局、对话流畅度和结果展示格式,响应卡片视觉统一并支持结构化内容折叠展开;同时修复特定场景下对话上下文丢失问题。


26Flink AI 内置模型服务免注册调用

Flink AI 内置模型服务新增免注册调用能力。您无需配置 API Key、Endpoint 或私网连接,即可在实时计算作业中直接调用内置模型服务,减少模型接入配置与网络连通成本,加快实时 AI 应用的开发和上线。


27DLF Paimon 向量表检索

支持 vector_search 和 vector_search_agg 函数直接检索 DLF Paimon 向量表。客户无需额外同步向量数据,即可在实时计算作业中完成向量相似度查询和聚合检索,降低实时智能检索应用的开发与运维成本。


28SQL AI Function支持音频、视频多模态处理发布

SQL AI Function新增音频、视频多模态处理能力。用户可在实时计算作业中使用SQL AI Function处理音频和视频数据,并结合模型推理实现多模态内容分析与理解,扩展实时AI推理可处理的数据类型,帮助开发者构建更丰富的实时智能应用。


29Flink Agents 支持 SQL 表值函数调用

实时计算 Flink 版支持在 SQL 作业中以表值函数(TVF)方式调用 Flink Agents,并适配 Flink Agents 0.3 版本。该优化让开发者可直接在现有 SQL 开发流程中集成 AI Agent 能力,减少跨语言与接口集成成本,提升实时智能应用的开发效率。


30Lookup Join支持自定义超时处理逻辑

异步Lookup Join支持在AsyncLookupFunction和AsyncTableFunction中自定义超时处理逻辑。您可按业务需要处理异步查询超时结果,降低超时对实时作业稳定性和数据处理连续性的影响,提升异常场景下的可控性与容错能力。


31Kafka Canal JSON支持元数据保留与DDL同步

Kafka Canal JSON格式新增保留mysqlType、sqlType等字段元数据的能力,并支持DDL同步。该优化可帮助使用Canal JSON接入Kafka数据源的客户更完整地传递表结构与字段类型信息,减少下游解析和schema演进中的适配工作,提高实时数据同步链路的兼容性、稳定性和运维效率。


32OSS支持通过AssumeRole使用自定义角色

OSS连接器新增通过AssumeRole使用自定义RAM角色的能力。用户可为作业配置自定义角色,由系统获取临时访问凭证访问OSS,无需在作业配置中长期保存AK/SK。该能力可降低长期密钥暴露风险,并支持按业务、环境和数据访问范围实施更灵活的最小权限控制。

开源大数据平台 E-MapReduce

1. EMR Agent支持API调用

提供基础会话、告警诊断、定时巡检等API。帮助客户将智能运维集成进业务平台,适用于更多的场景。

检索分析服务 Elasticsearch版

1. 国际站支持可用区单升多

国际站现已支持 Elasticsearch 实例从单可用区变配为多可用区,帮助客户提升跨可用区容灾能力与业务可用性。


2. ES Agent 智能助手 GA 发布

ES Agent是阿里云检索分析服务Elasticsearch版提供的智能运维助手,经过公测阶段的服务能力与稳定性验证,正式启动商业化发布。

智能开放搜索 OpenSearch

1. 向量检索版索引数据恢复功能上线

支持向量检索版从索引中恢复数据,并从恢复记录中重建索引,解决了向量检索版客户需要重建索引只能从空数据重建的功能缺失。


2. 行业算法版支持分时弹性扩缩容

用户预先配置时间规则与目标 LCU,系统按计划在指定时间自动扩展或缩减 OpenSearch 实例的计算资源(以 LCU 为单位),并在任务完成后自动恢复。


3. 行业算法版新增中国香港Region共享集群

行业算法版新增中国香港Region共享集群,支持包年包月+按量付费。


4. 行业算法版支持下拉模型

新增「抽取模型」选项:选择后,系统将通过大模型对抽取生成的候选词进行筛选,过滤无意义候选词。该能力仅在字段使用「抽取生成」时生效,并将按模型实际消耗的 Token 数计费;「历史搜索词」功能即将下线,创建页将不再展示该选项。


5. 向量检索版支持视频检索Pipeline功能

实现一站式视频检索/文搜视频/视频理解等端到端视频向量检索分析功能

向量检索服务 Milvus 版

1. AI 中心全新升级

向量检索服务 Milvus 版 AI 中心升级为统一的 AI 能力入口,除原有向量化(Embedding)模型外,新增支持重排序(Rerank)、文本生成及多模态理解相关模型,并提供关键参数说明和代码示例,帮助您更高效地完成模型选型与接入。


2. 托管弹性伸缩功能

向量检索服务 Milvus 版 新增“托管弹性伸缩”策略。您只需为支持的节点类型设置最小和最大节点数,系统即可根据实时资源负载,在设定范围内自动扩容或缩容,无需自行配置伸缩时间规则、负载阈值或冷却时间。该策略适用于流量波动明显且难以提前预测的在线 RAG、多租户检索等业务场景。


3. 弹性伸缩功能新增节点支持范围

向量检索服务 Milvus 版弹性伸缩新增支持 Proxy、Streaming Node和 Query Node的弹性扩容与缩容。您可以分别针对接入流量、流式数据处理和查询负载调整对应节点数量,使不同处理链路能够根据各自的业务压力独立扩展。

/ END /


▼ 关注「大数据智能体官网」 
复制下方链接或者扫描右边二维码
即可快速拥有大数据超级助理从此躺赢数据开发
了解详情:https://www.aliyun.com/activity/bigdata/dataagent/skills
图片

点击阅读原文了解更多关于大数据&AI产品解决方案~

【声明】内容源于网络
0
0
阿里云大数据AI平台
阿里云大数据AI平台依托阿里领先的云基础设施、大数据和AI工程能力、场景算法技术和多年行业实践,一站式地为企业和开发者提供云原生的大数据和AI能力体系。帮助提升AI应用开发效率,促进AI在产业中规模化落地,激发业务价值。
内容 768
粉丝 0
阿里云大数据AI平台 阿里云大数据AI平台依托阿里领先的云基础设施、大数据和AI工程能力、场景算法技术和多年行业实践,一站式地为企业和开发者提供云原生的大数据和AI能力体系。帮助提升AI应用开发效率,促进AI在产业中规模化落地,激发业务价值。
总阅读12.4k
粉丝0
内容768