技术动态
01
蚂蚁百灵:开源面向真实金融工作流的 Ling-3.0-flash-Fin
9月4日,蚂蚁百灵大模型正式开源面向真实金融工作流的 Ling-3.0-flash-Fin,并同步开放面向金融搜索 Agent 的评测基准 FinFIRST(Financial Information Retrieval, Sourcing and Traceability)。
Ling-3.0-flash-Fin基于124B参数的Ling-3.0-flash架构,专为金融工作流优化。具备四大核心能力:金融信息检索、深度研究推理、财务估值建模和研报撰写,能处理年报、财报表格等长文本分析任务。其特色是与FinFIRST评测基准联动,强调答案可溯源和计算复核,综合性能优于多款通用模型。
Ling-3.0-flash-Fin 模型仓库
Hugging Face:
https://huggingface.co/inclusionAI/Ling-3.0-flash-Fin
ModelScope:
https://www.modelscope.cn/models/inclusionAI/Ling-3.0-flash-Fin
FinFIRST 技术报告
https://huggingface.co/datasets/inclusionAI/FinFIRST/blob/main/FinFIRST_paper.pdf
原文链接>> Ling-3.0-flash-Fin 与 FinFIRST 正式开源
02
VAST:推出3D生成模型 Tripo P2.0
9月2日,VAST推出支持原生四边面拓扑的3D生成模型Tripo P2.0,其核心突破在于能在生成阶段直接输出符合工业标准的四边面网格(最高支持25000面),无需后续重拓扑处理。
Tripo P2.0基于VAST自研的Nexus算法框架,通过解耦顶点与拓扑生成,实现扩散模型端到端的网格构建,相关成果已获SIGGRAPH顶会认可。
论文地址:
https://arxiv.org/pdf/2607.13563
原文链接>> Vibe Coding杀进3D领域
03
腾讯:开源Hy4 preview轻量版
9月1日,腾讯混元把Hy4 preview的权重从接近1.5TB压缩到约214GB,大幅降低运行这一模型的硬件门槛。
Hy4 preview轻量版采用自研Sherry稀疏三值量化,四个权重一组编码为5比特、平均1.25比特,并以MIX-STQ1_0按各层敏感度逐层分配混合精度。该版本在保持长文理解、多轮上下文检索能力的同时,数学性能小幅回落,但仍能胜任日常编码辅助、工具调用及常规问答等任务。
量化 GGUF 库:
https://huggingface.co/AngelSlim/Hy4-preview-GGUF
Hy4-Preview :
https://huggingface.co/tencent/Hy4-preview
AngelSlim 代码仓库 :
https://github.com/Tencent/AngelSlim
原文链接>> Hy4 preview 轻量版来了
04
讯飞:开源端侧通用大模型星火X2.5-4B和星火X2.5-1.7B
9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。
星火X2.5-4B和星火X2.5-1.7B采用混合注意力架构,围绕智能体、代码、数学与指令遵循优化。基于全国产算力用约20万亿Token预训练,适配英伟达、华为、海光等平台与vLLM、llama.cpp等框架。
Hugging Face:
https://huggingface.co/collections/XHToken/spark-x25
Github:
https://github.com/XHToken/Spark-X2.5
原文链接>> 端侧开源模型:星火X2.5-4B&1.7B让小模型干大活
05
DeepSeek:开放V4-Flash-Vision-Exp模型权重
8月31日,DeepSeek开放DeepSeek-V4-Flash-Vision-Exp模型权重。
根据官方模型页面,DeepSeek-V4-Flash-Vision-Exp约有3050亿参数,是DeepSeek V4系列首个实验性多模态模型。它不只负责识别图片,还将视觉理解能力接入Agent任务,希望让模型在“看懂”之后继续使用工具完成工作。
DeepSeek-V4-Flash-Vision-Exp 模型卡:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp
Vision-Exp 配置:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp/blob/main/config.json
Vision-Exp 视觉前端代码:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp/blob/main/inference/vision.py
Vision-Exp 推理主干代码:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp/blob/main/inference/model.py
Vision-Exp 最小推理说明:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp/raw/main/inference/README.md
DeepSeek-V4-Flash-0731:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
原文链接>> DeepSeek开放V4视觉模型权重
06
阿里:开源本地优先检索工具zg(zvec-grep)
8月31日,阿里开源本地优先检索工具zg(zvec-grep),安装后只需一次索引即可在终端或Agent中使用,数据默认本地处理,远程服务需授权。
zg结合了向量检索、BM25关键词和ripgrep正则三种搜索能力,支持代码、文档等多格式内容。通过混合检索模式,先用语义查找相关文件再精准定位,帮助开发者和AI Agent减少搜索轮次和token消耗。
项目地址:
github.com/zvec-ai/zvec-grep
原文链接>> zg 正式开源:本地检索,不止于关键词
行业动态
07
OpenAI:发布 GPT‑6 Astra
9月3日,OpenAI宣布发布GPT‑6 Astra,重点提升电脑操作、软件开发和复杂工作任务的处理能力。
GPT‑6 Astra能直接在浏览器、办公软件和专业工具中完成填写表单、编写代码、分析数据等任务。相比上一代,Astra在编程和科学计算能力上有显著提升。目前优先向部分机构开放,后续逐步扩展至付费用户。
原文链接>> OpenAI发布GPT‑6 Astra
08-1
Meta:发布新一代旗舰模型 Muse Spark 1.3
9月3日,Meta发布新一代旗舰模型Muse Spark 1.3,属于Muse系列轻量级产品线,主打智能体和编程能力。
Muse Spark 1.3模型采用文本/图像/视频多模态输入,支持1M token上下文,特别在代码生成和多轮任务表现突出,成本低于同级竞品。Meta计划后续开源该模型,并透露将推出更大规模的版本。
原文链接>> Meta旗舰模型翻身
08-2
Meta:推出实时音频感知模型 Muse Voice Transcribe
9月2日,Meta推出实时音频感知模型Muse Voice Transcribe,支持流式语音转写、说话人分离和端点检测三大功能集成。
Muse Voice Transcribe采用自适应延迟技术,能动态调整处理速度与准确率的平衡,提供实时流式自动语音识别(ASR)、支持超过20位说话人的语音分割以及端点控制功能,处理速度最快可达80毫秒/块音频;同时支持70多种语言(25种已验证)和中英夹杂场景,能处理超过1小时的长音频,可实现无缝语码切换,并通过语言、关键词和上下文偏好来提高识别准确率。
原文链接>> Meta甩出语音转写神器
09
谷歌:正式推出 Gemini 3.8
9月2日,谷歌推出Gemini 3.8 Flash,属于Gemini Flash系列第三代产品。
该模型引入"智能体循环"机制,能自主拆解复杂任务并多轮调用工具,但复杂任务的Token消耗可能增加30%。在长周期软件工程、终端编程等任务中表现突出,尤其在金融分析、法律工作流等垂直领域反超高价旗舰。同步推出网络安全专用版Cyber。
原文链接>> 谷歌Gemini 3.8登场
10
腾讯:上线WorkBuddy开放平台
9月2日,WorkBuddy开放平台正式发布上线,首批引入超百家生态伙伴,面向智能硬件、行业应用与开发者等全面开放底层 Agent 能力。
发布会现场首发9款联名智能硬件,合作方包括plaud、rokid、影石、科大讯飞、安克、猛玛、京东京造等品牌,30余个行业应用同步接入,覆盖金融、法律、医疗、教育、公益等20多个领域。腾讯云副总裁、WorkBuddy负责人刘毅表示,目标是把WorkBuddy打造成面向agent时代的操作系统,做一个能承载所有工具的平台。
原文链接>> WorkBuddy开放平台上线:全面开放Agent基座能力
11
World Labs:发布多模态世界模型 Atlas
9月2日,World Labs发布多模态世界模型Atlas,能处理文本、图像、视频和3D数据,支持相机可控生成、空间重建、时空模拟和图像生成四大功能。
Atlas采用多模态自回归扩散Transformer架构,通过共享空间上下文实现像素级精准控制,可从少量真实视频重建机器人仿真环境,并支持物体替换、光照调整等可控变体生成。支持像素级相机控制生成,单张图片即可输出最长1分钟、1440p视频,稀疏视角3D重建效果超过专用开源模型;可同时建模空间与时间,为机器人生成逼真RGB与深度数据,打通Real-to-Sim路径。
原文链接>> 李飞飞发布多模态世界模型
12
Runway:公布界面世界模型 Solaris
9月1日,Runway公布界面世界模型Solaris,App与网页界面可像视频一样实时生成,用户点击、拖拽后模型直接生成下一帧,无需开发者预先写好代码。
Solaris基于Gen-4.5视频模型改造,采用逐帧自回归、少步蒸馏与自生成结果训练,在720p下实现实时交互,由语言模型负责推理、世界模型负责渲染。
原文链接>> Runway界面世界模型,UI自己长出来
13
影眸:发布世界生成模型 Hyper3D WorldGen
9月1日,影眸Hyper3D发布世界生成模型Hyper3D WorldGen,让3D生成从“生成物体”系统性走向“组织场景”。
用户只需上传一张场景图片,WorldGen即可自动识别其中的主要物体生成3D资产,也可以根据用户手动框选的内容完成生成;并通过自研的CAST架构重构图像中物体之间的物理属性与关系,重建其位置、尺度、朝向及相互关系,最终生成一个由多个独立3D资产构成的完整场景。场景中的每个资产都可以被单独移动、替换和持续编辑,并进一步进入DCC软件、实时引擎与仿真环境。
原文链接>> Hyper3D WorldGen上线
14
中科院大连化学物理研究所等:发布智能化工大模型3.0 Pro
8月31日,由中国科学院大连化学物理研究所等共同研发的智能化工大模型3.0 Pro正式发布。
智能化工大模型3.0 Pro突破了传统大模型以知识问答和内容生成为主的应用模式,构建了“大模型—智能体—专业技能与工具—应用场景”的四层技术体系,集成了超过400个化工智能体和工具。其中,大模型作为认知核心,负责专业知识理解、多模态信息解析、方案生成和任务规划。智能体作为执行主体,围绕任务目标完成流程分解、工具调用、结果校核与动态调整,形成贯通认知、推理、规划、执行和验证的闭环能力。
原文链接>> 智能化工大模型3.0 Pro正式发布
政策趋势
15
工信部:印发《人工智能中小企业创业支持计划(2026-2028年)》
9月4日,工信部办公厅印发《人工智能中小企业创业支持计划(2026-2028年)》。
提出通过三年时间,在行业应用、数据服务、智能算力等重点领域,培育形成一大批创新活力强、成长潜力大的人工智能创业企业,新培育科技和创新型中小企业1万家以上,专精特新“小巨人”企业突破2000家,涌现一批瞪羚企业和独角兽企业。
聚焦人工智能领域,高标准建设10个科技型企业孵化器、10个国家中小企业公共服务示范平台(基地),新培育10个国家级中小企业特色产业集群,人工智能中小企业创业创新活力持续迸发,人工智能赋能中小企业高质量发展格局初步形成。
原文链接>> https://www.miit.gov.cn/jgsj/qyj/wjfb/art/2026/art_86c400b4473849818629663a94a6d44b.html
16
工信部:关于开展人工智能应用服务商培育专项行动的通知
8月31日,工业和信息化部办公厅发布开展人工智能应用服务商培育专项行动的通知,旨在落实国家“人工智能+”战略,通过培育专业化服务商推动AI技术落地。
该行动明确将服务商定义为提供AI解决方案咨询、交付、运营等全链条服务的机构,提出到2026年底全国培育2000家服务商,2027年达3000家的目标。重点任务包括建立资源池、组建服务团、推广标准化产品,并支持企业出海及降低算力成本。政策首次系统提出服务商需具备“懂行业、通技术、知安全、善交付”的复合能力要求,并配套制定相关国家标准。
原文链接>> https://www.miit.gov.cn/jgsj/kjs/wjfb/art/2026/art_331b6f1d28ad410aa9df711acf42dbfe.html
17
中央网信办:深入开展“清朗·整治AI应用乱象”专项行动第二阶段工作
近日,中央网信办组织开展“清朗·整治AI应用乱象”专项行动第二阶段工作。
聚焦利用AI制作发布虚假信息、传播暴力低俗内容、假冒仿冒他人、侵害未成年人权益等突出问题,部署各地网信部门深入推进重点整治任务,督促网站平台集中清理AI生成各类违法不良信息,依法查处违规账号和移动应用程序,有效遏制AI生成合成信息内容乱象,推动AI应用服务健康有序发展。
原文链接>> https://www.cac.gov.cn/2026-09/02/c_1790099041364574.htm
18
深圳:印发《深圳市推动人工智能与应用发展行动计划(2026—2028年)》
9月4日,深圳市工业和信息化局、深圳市发展和改革委员会、深圳市科技创新局印发《深圳市推动人工智能与应用发展行动计划(2026—2028年)》,旨在通过六大方向23项任务推动人工智能全领域应用。
该计划提出到2028年实现AI核心产业规模超3000亿元、企业数量超3000家的目标,重点覆盖科研创新、产业升级、消费提质、民生改善、城市治理和国际合作六大方向。配套政策包括强化算力供给、数据开放、人才培育等七大支撑措施,要求各部门落实“管行业即管AI应用”的责任机制。
原文链接>> https://gxj.sz.gov.cn/xxgk/xxgkml/qt/tzgg/content/post_12965466.html
19
深圳:印发《深圳市推动智能机器人产业高质量发展工作方案(2026—2028年)》
9月2日,深圳市工业和信息化局、深圳市科技创新局印发《深圳市推动智能机器人产业高质量发展工作方案(2026—2028年)》。
《方案》提出,到2028年,将深圳建设成为全球最具影响力的智能机器人产业高地,打造全国最具活力的智能机器人创新企业集聚区、全球领先的智能机器人软硬件配套集聚区和国际机器人友好示范城市中心、粤港澳大湾区机器人开源生态中心,形成“两区两中心”协同发展的产业新格局。
原文链接>> http://gxj.sz.gov.cn/gkmlpt/content/12/12960/post_12960913.html#3115
声明:资料素材均来源官方媒体/网络,如有侵权,请联系删除。
✦
✦
END
南京新一代人工智能研究院
Nanjing Research
Institute of Next-generation Artificial Intelligence
南京新一代人工智能研究院,是中国信息通信研究院在人工智能、大数据领域投资组建的控股企业,是江苏省人工智能产业公共技术服务平台的落地运营单位。
研究院以“服务国家战略实施,促进地方产业升级”为导向,在人工智能和大数据领域,开展前沿技术研究、标准制定、评测工具开发、实验能力建设等工作,可为企业提供全方位的诊断、咨询、培训、评估服务。
联系方式
吴老师 17788386765(微信同号)
杨老师 15221125491(微信同号)

