大数跨境

AI大模型产业最新动态:十大热点新闻与解读 -2026年8月16日

AI大模型产业最新动态:十大热点新闻与解读 -2026年8月16日 模达科技-AI绘未来
2026-08-16
19

“ 模达卓越,智启未来”

www.modatech.com.cn / www.modatech.cn









 模达卓越,智启未来

   模达科技       

www.modatech.com.cn / www.modatech.cn

国内外大模型发展如火如荼,近期有哪些值得关注的新闻?一起看看吧!

国际篇

INTERNATIONAL NEWS

  • 支持5张参考图融合与智能扩图,xAI Imagine Image2.0正式上线

xAI发布Imagine Image2.0,作为Grok旗下Web端Imagine服务及iOS、Android应用中的全新质量模式,重点面向需要可控布局、清晰字体和视觉元素一致性的创意场景。目前,该模型API访问计划正在推进,但尚未正式开放。

xAI表示,Image2.0能够理解复杂指令,在密集构图中完成字体与布局规划,并保持小尺寸文字的清晰度。同时,该模型支持多轮生成和编辑,在反复调整过程中保留用户指定的视觉元素。其编辑工具支持通过魔棒和分割功能精准选择图像区域,实现局部修改而不影响其他部分,并支持背景移除、透明图像导出,以及一次生成融合最多5张参考图像,降低复杂视觉创作中的手动合成成本。

此外,Image2.0新增智能调整大小功能,可将图像扩展至指定画幅,支持1:2至9:16比例,以及正方形、横向和2:1等多种格式。xAI还推出针对重复创作任务的模板工作流,覆盖照片编辑、产品颜色调整、电商图片、专业头像、图标、角色精灵、表情符号和商品设计等场景。

在视频策划场景中,相关模板能够帮助用户分别生成角色、场景和道具,并保持统一视觉风格,从而构建连续一致的内容世界。

xAI称,Image2.0在文本生成图像和图像编辑能力评测中均位列全球第二。在Arena测试中,grok-imagine-image-2(low)文生图得分1320分,低于gpt-image-2的1380分;图像编辑得分1439分,低于gpt-image-2的1463分。单独测试的grok-imagine-image-quality两项得分分别为1228分和1390分。xAI表示,其模型在Arena平台上以SpaceXAI名义参与测试。

图源:网络

  • Meta开源30B参数Muse Glimmer,瞄准消费级硬件本地AI Agent

Meta于8月10日发布开源模型Muse Glimmer,旨在为消费级硬件上的本地AI Agent提供支持,被视为其“个人超级智能”愿景的最新实践。该模型拥有300亿参数,本质上是Meta今年4月发布的封闭模型Muse Spark的开放版本,模型权重采用Apache2.0许可证,开发者可下载、修改和微调。

Muse Glimmer面向多步骤代理任务,可调用工具、编写和调试代码、处理文件及屏幕截图,并执行扩展工作流。模型支持文本和图像,训练覆盖100多种语言,可在配备单块消费级GPU的Mac或PC上本地运行,并被设计为“始终在线”,即使没有网络连接也能工作。

Meta设想其用于管理日程、撰写邮件、整理文件等需要处理大量个人数据的任务,通过本地处理降低信息上传云端的需求,探索更注重隐私的个人AI助手。

这一方向与扎克伯格此前提出的“个人超级智能”理念一致。他在8月10日新公开信中表示,广泛普及超级智能有望赋能个人,并希望相关工具最终能够免费或以可负担的价格提供。不过,Meta仍在区分开放与闭源模型:能力更强的Muse Spark继续保持封闭,而Glimmer则允许用户下载并本地运行,显示出其在AI开放程度与模型控制之间采取分层策略。

图源:网络


  • OpenAI正式发布Linux版ChatGPT预览应用

近日,OpenAI官方宣布正式推出Linux版本的ChatGPT桌面端预览应用。这一举措进一步拓展了其桌面端产品的生态版图,为使用特定Linux系统的开发者和日常用户带来了更便捷的本地化交互体验。

据了解,该预览版应用在支持的系统环境中可以直接运行,并完整整合了常规对话、ChatGPT Work以及面向编程场景的Codex功能。为了适配不同用户的发行版需求,官方同步提供了针对x64和arm64架构的 .deb与 .rpm格式安装包。

在具体的系统兼容性方面,此次发布的版本主要覆盖了主流的长期支持与稳定发行版。其中包括 Ubuntu24.04LTS 与26.04LTS、Debian13,以及 Fedora43和44等系统。

回顾近期动态,OpenAI在今年7月对其桌面应用程序进行了重大整合,将此前的Codex升级并演变为全新的多功能桌面客户端,将聊天、工作模式与编程助手融为一体。用户在更新后不仅能无缝保留原有的任务和项目进度,还可以根据个人喜好在应用设置中自定义专属的图标样式。

图源:网络

  • 性能狂飙!Grok 4.6正式发布,实力比肩GPT-5.6 Sol

近日,SpaceX AI正式推出了其全新升级的旗舰级人工智能模型Grok4.6。该模型专注于处理复杂、长程的Agent任务,并在多项核心基准测试中展现出与OpenAI旗舰模型GPT-5.6Sol相媲美甚至超越的强劲实力。

回顾其技术演进,SpaceX AI曾在7月份联合Cursor推出了由数万张英伟达GB300GPU算力支持训练的Grok4.5。在此基础之上,Grok4.6实现了进一步飞跃。其训练过程重点针对长程复杂任务进行了全面优化,大量采用了涵盖推理能力、高级技术概念以及高质量工程代码的模型生成数据。同时,该模型还接受了广泛的Agent强化学习训练,覆盖知识工作、通用编程及多个专属领域环境,在构建视觉和交互式应用时能够输出更优质的初始效果。

在权威评测机构Artificial Analysis涵盖九项热门AI基准测试的综合指数中,Grok4.6的综合成绩已经追平GPT-5.6Sol,目前仅落后于Claude Opus5与Fable5Max。具体来看,在评估逻辑与知识水平的GDPval-AA v2测试中,Grok4.6取得了1753的Elo得分;而在衡量长时程知识工作Agent任务的私有基准测试AA-Briefcase中,其Elo得分也达到了1577分,两项关键表现均仅次于Claude Opus5。

在带来显著性能升级的同时,Grok4.6继续保持了极具竞争力的运行速度与价格体系。该模型的运行速度可达80TPS,基础版本的输入与输出价格分别为每百万Token2美元和6美元,高速变体版则为每百万Token4美元和12美元。目前,Cursor与Grok Build用户已经可以直接上手体验,广大开发者也能够通过API进行便捷接入。

图源:网络


  • 韩国AI新王Solar Pro 4登场,直接硬刚全球顶尖大模型?

近日,韩国人工智能实验室Upstage正式推出了面向复杂智能体任务的商用大模型——Solar Pro4。这款新模型拥有高达512K的上下文窗口,支持最高128K的输出长度,能够让用户在单次会话中轻松加载并处理多份合同、报告及数据文件。

在定价方面,Solar Pro4展现出了极具竞争力的优势。其每100万Tokens的输入价格为0.3美元,缓存读取输入价格为0.06美元,而每100万Tokens的输出价格则为1.2美元。

聚焦于智能体任务的表现,该模型针对真实工作场景进行了深度优化,重点涵盖长文档、终端任务和多轮工具调用。在官方公布的核心测试中,Terminal-Bench v2.1得分为57,τ³-Banking得分为23,AA-LCR得分则达到了71。Upstage通过一个模拟咖啡品牌的门店选址分析任务进行了演示:模型仅用3条提示词便在10个候选站点中完成了政策筛选,并自动、按顺序生成了Excel工作簿、审查报告和幻灯片三类完整的交付物。

目前,Solar Pro4已经全面亮相多家国际权威AI模型评测平台。作为首个登上Agent Arena、Code Arena: WebDev和Text Arena排行榜的韩国实验室模型,它在Agent Arena榜单中位列第44位,实力与MiniMax M2.7以及Nemotron3Ultra等知名模型处于同一水平线。

图源:网络


国内篇

DOMESTIC NEWS

  • 豆包接入抖音来客酒店交易收取约12%服务费

8月11日消息,豆包接入抖音来客酒店交易渠道后,将针对成交订单执行独立软件服务费政策,商家通过豆包入口跳转抖音来客完成酒店订单后,将按照11.4%的软件服务费和0.6%的支付手续费计算,综合费率约12%。

针对“豆包推荐酒店抽取12%佣金”的市场说法,豆包公关负责人刘星8月10日晚在微博回应称,该表述并不准确。豆包生活服务业务目前没有付费推广机制,酒店推荐不会收取广告费,商家也无法通过付费影响推荐结果或排序。相关费用仅在订单成交后产生,主要用于渠道服务。

刘星表示,与部分平台采用“佣金+广告”的商业模式不同,豆包当前阶段主要按照成交结果收费,商家更应关注实际渠道成本与新增订单效果。同时,豆包生活服务仍处于早期探索阶段,将持续根据用户和商家反馈进行优化。

此前,7月27日,抖音生活服务学习中心发布《2026年抖音生活服务平台特定渠道软件服务费政策说明》。根据政策,自2026年8月10日0时起,平台将对特定渠道订单执行新的软件服务费规则,具体费率通过商家来客后台通知。

该政策显示,软件服务费计算基数为用户实付金额以及除商家外其他主体提供的补贴金额(如平台通用券),费率将根据商家类型、商品类目、POI类目、产品类型及成交渠道等因素确定。其中,豆包被纳入特定渠道范围,具体费率可能根据平台服务情况调整,订单是否属于特定渠道以结算单展示为准。

图源:网络

  • 深夜震撼发布:DeepSeek V4 Pro正式版亮相,比肩顶尖Fable大模型

8月13日,AI领域迎来密集的产品发布潮。在马斯克推出Grok4.6以及千问开源Qwen3.8Max的同时,DeepSeek也于深夜低调推出了V4Pro的正式版——DeepSeek-V4-Pro-0813。

目前,该正式版已经全面上线,其API与Chat端均已完成更新。用户在调用时保持原有的方法不变,直接通过指定相关的名称即可接入最新版本。

官方公布的性能跑分测试显示,V4-Pro-0813在各项核心指标上表现优异,不仅顺利超越了Opus4.8,与美国顶尖的Fable5模型相比也具备了极强的竞争力,整体处于行业第一梯队水平。

在定价方面,该版本整体依旧延续为V4-Flash价格的三倍。虽然此前官方曾透露过价格调整计划,但目前平台页面暂未显示具体调整幅度,预计后续将通过官方渠道正式发布相关的价格变动通知。

图源:网络

  • MiniMax发布Music3音乐模型:可生成最长5分钟歌曲

MiniMax-Music3是一款能够根据歌词和音乐描述生成最长5分钟完整歌曲的音乐生成模型,其采用分层自回归架构,由全局语言模型和局部语言模型协同工作,分别负责歌曲的长程语义与结构变化以及细粒度的声学信息补全。该模型在长音频中能够稳稳守住音乐主题、节奏、歌声身份和编曲的推进,并支持多种音乐结构如前奏、主歌、副歌等

图源:网络

  • 京东七鲜咖啡全球首发24小时无人店:机器人现制、AI荐饮

京东集团旗下七鲜咖啡宣布首家24小时智能化无人咖啡店将在北京银河Soho开业,主打全天候、全自动化概念,通过机器人与AI全程接管制作流程,并提供个性化定制服务。同时,AI荐饮功能将根据用户身体状况智能推荐咖啡因摄入量,体现了零售场景智能化的进一步发展。

图源:网络

  • AI企业也能按Token融资:广东首推“Token贷”

8月14日,广东省首个词元经济专项金融产品“Token贷”在广州海珠区发布,旨在为算力及AI相关中小微企业提供更匹配其业务模式的融资支持。

以中国银行广州分行为例,该行针对海珠区算力中小微企业推出“算力Token贷”,按照企业合同金额及Token消耗额度核定融资额度,主要采用信用、应收账款质押、订单融资等担保方式,并可组合保证、抵押等增信措施进一步扩大额度。对于新设企业,在能够提供原经营企业连续经营佐证材料或担保的情况下,也可按订单申请融资。

据悉,中国银行此前已开展试单授信,累计资金规模达到2800万元。随着大模型应用快速扩张,Token消耗逐渐成为AI企业经营活动的重要指标,此类金融产品尝试将算力、Token使用量及订单等业务数据纳入授信体系,为AI企业融资提供新的信用评估维度,也标志着金融机构开始探索适配词元经济的新型金融服务模式。

图源:网络

>>>>>>END<<<<<<

模达科技AI前沿,与您一起见证智能科技的蓬勃发展!

文章仅代表我司观点,请您甄别借鉴。



模达科技公众号

微信号 : modatechsub

 扫码关注我们。

【声明】内容源于网络
0
0
模达科技-AI绘未来
1234
内容 81
粉丝 0
模达科技-AI绘未来 1234
总阅读12.3k
粉丝0
内容81