大数跨境

AI日报:豆包手机助手消费者版发布;Suno发布v6音乐模型;ElevenLabs发布Music v2.5音频模型

AI日报:豆包手机助手消费者版发布;Suno发布v6音乐模型;ElevenLabs发布Music v2.5音频模型 AIbase基地
2026-09-14
2
AI 日报

9 月 14 日•AIbase

1、豆包手机助手消费者版发布:AI 键指纹直唤,跨应用 Agent 再升级

2、Suno 发布 v6 音乐模型:联合华纳、BMG 共创,自然语言即可改歌混音

3、ElevenLabs 发布 Music v2.5 音频模型,同步开放 APP 与 API

4、宇树人形机器人 G1+ 发布:电机、视觉、交互与续航全面增强

5、智谱获 50 亿美元新融资,加速下一代 GLM 递归自我改进

6、全新 Apple TV 或今秋发布:芯片升级,Siri 成核心

7、京东发布可交互视听世界模型 EchoWM,长视频生成超 10 分钟

8、DeepSeek-V4.1-Flash 上线千问平台,API 与 Token Plan 同步开放

豆包手机助手消费者版发布:AI 键指纹直唤,跨应用 Agent 再升级

豆包手机助手消费者版在交互、记忆、Agent 执行及安全维度迎来全面升级,推动手机 AI 从“被动问答”向“主动办事”转型。

核心亮点

AI 物理按键支持指纹鉴权,实现锁屏状态下一键唤醒;记忆能力显著增强,可安全检索本地数据;采用端云结合的数据处理机制,构建完善的安全防护体系。

Suno 发布 v6 音乐模型:联合华纳、BMG 共创,自然语言即可改歌混音

Suno 联手华纳音乐、BMG 等巨头推出新一代音乐模型 v6。该模型以套件形式呈现,涵盖旗舰版、探索版和轻量版,旨在满足多元化创作需求。v6 支持多模态输入,用户可通过自然语言指令精确修改歌曲内容,标志着 AI 与音乐产业融合迈入新阶段。

核心亮点

通过与顶级唱片公司合作,推动音乐创作大众化;提供分层模型版本以适应不同创作者;支持文字、音频、图片及视频多模态输入,具备高精度的自然语言编辑能力。

ElevenLabs 发布 Music v2.5 音频模型,同步开放 APP 与 API

ElevenLabs 正式发布 ElevenMusic v2.5 版本,并通过移动端 APP 及 API 向全球开放。新版模型在 R&B、灵魂乐、嘻哈、摇滚及管弦乐等多种曲风中表现卓越,同时推出免费版与专业版服务,兼顾普及性与专业性。

核心亮点

显著提升音频生成的质量与自然度;提供灵活的服务版本以满足差异化需求;强调版权合规性,有效规避行业版权纠纷风险。

宇树人形机器人 G1+ 发布:电机、视觉、交互与续航全面增强

宇树科技推出人形机器人 G1+,在运动性能、感知交互及智能体验上实现多项突破。升级点包括颈部自由度增加、电机输出与热管理优化、视觉触觉感知增强以及供电续航提升。标准版售价 9.5 万元,并同步推出面向科研开发的 G1+ EDU 版本。

核心亮点

新增 2DOF 颈部结构,大幅提升头部灵活性与运动表现;搭载双视觉系统、3D 激光雷达及腹部广角相机,强化空间理解能力;配备外部供电口与快拆智能电池,续航约 2 小时,适应长时间作业场景。

智谱获 50 亿美元新融资,加速下一代 GLM 递归自我改进

智谱宣布完成约 50 亿美元融资,资金将重点投入下一代 GLM 基础模型研发及自训练体系建设。项目致力于推进国产芯片适配与推理效率优化,构建技术高效迭代闭环。

核心亮点

基于上一代模型智能构建训练环境,实现递归式自我改进;利用自动化数据生成与筛选机制,提升长程推理能力;工程层面深化国产芯片适配与算子开发,最大化硬件产出效能。

全新 Apple TV 或今秋发布:芯片升级,Siri 成核心

苹果计划于秋季低调发布新一代 Apple TV 机顶盒。此次升级核心在于接入 Apple Intelligence 生态、搭载高性能芯片以及增强 Siri AI 助手能力,进一步巩固其作为全屋智能中枢的地位。

核心亮点

全面融入 Apple Intelligence 生态,凭借更强芯片提升整体性能;Siri 升级为具备深度情境理解的 AI 助手,支持复杂指令与跨平台推荐;强化 Thread 与 Matter 协议支持,优化家庭设备协同体验。

京东发布可交互视听世界模型 EchoWM,长视频生成超 10 分钟

在 JDD 大会上,京东发布了 JoyAI-Echo1.5 与 EchoWM 模型,分别突破超长音视频生成与可交互视听世界建模技术。同期展示的 JoyAI 基础模型矩阵,标志着京东 AI 布局从数字世界向物理世界延伸。

核心亮点

JoyAI-Echo1.5 实现 10 分钟以上持续音视频生成;EchoWM 开源并支持多轮交互探索与声音同步变化;JoyAI 矩阵覆盖图像视频生成及多模态理解等全方位能力。

DeepSeek-V4.1-Flash 上线千问平台,API 与 Token Plan 同步开放

DeepSeek-V4.1-Flash 正式登陆千问 AI 平台,凭借优异的性能成本比,成为企业长文档解析、客服知识库构建等任务的理想选择。

核心亮点

采用 MoE 架构,输入激活约 8B、输出激活约 16B,支持图文理解;成本大幅优化,KV Cache 对 HBM 需求降至前代四分之一,SSD 存储需求降至八分之一;支持北京新加坡及全球多地域调用。

【声明】内容源于网络
0
0
AIbase基地
1234
内容 558
粉丝 0
AIbase基地 1234
总阅读12.1k
粉丝0
内容558