📰 本周AI速览
各位周一好!又到了AI资讯速递时间。过去一周AI圈热闹非凡——OpenAI放出重磅预告、国内大模型厂商再次掀起价格战、还有几个让人眼前一亮的新产品。
1️⃣ OpenAI剧透GPT-5新能力:长上下文+多模态融合
OpenAI在本周的一次开发者分享会上透露了GPT-5的部分新特性:
• 超长上下文窗口:支持最高1M token,相当于一次能处理三本《三体》的体量
• 原生多模态融合:文本、图片、音频、视频在同一模型中端到端处理,不再是拼接式
开发者关系团队表示,新模型在推理能力上有质的飞跃,尤其在数学推理和代码生成方面。预计Q3开启部分灰度测试。
2️⃣ 国内大模型混战:通义千问2.5宣布全面免费
继DeepSeek之后,阿里云本周宣布通义千问2.5版本全线降价,入门款直接免费开放。百度文心一言紧随其后,宣布ERNIE 4.5 Turbo调用价格下调60%。
这已是今年第三轮大模型价格战。对用户来说当然是好事,但对于中小模型厂商而言,生存空间正被进一步压缩。
价格变化一览:
• 通义千问2.5:免费(原0.008元/千tokens)
• 文心ERNIE 4.5 Turbo:降60%
• 智谱GLM-5:降45%
• 腾讯混元:跟进中
3️⃣ Midjourney V7发布:生成质量再次升维
Midjourney悄悄发布V7版本beta测试,图像质量再次惊艳。主要升级点:
• 光影真实感大幅提升:接近专业摄影级别
• 文字渲染能力:终于能稳定生成清晰准确的英文文字
• 风格控制更精细:新增风格滑条,从写实到插画可无级调节
设计师朋友们可以冲了。
4️⃣ 字节跳动发布AI编程助手CodeMate Pro
字节跳动本周正式推出面向开发者的AI编程工具CodeMate Pro,定位团队级AI编程助手。特色功能:
• 全仓库理解:不只是看当前文件,理解整个项目代码结构
• PR自动审查:自动分析代码变更,给出优化建议
• 一键生成测试:根据代码逻辑自动生成单元测试用例
定价:个人版免费(每天200次调用),团队版99元/人/月。支持VS Code和JetBrains系IDE。
5️⃣ 斯坦福发布新研究:AI Agent自主性评估框架
斯坦福大学团队发布AgentBench 2.0评估框架,专门衡量AI Agent在真实任务中的自主执行能力。
考察维度:
• 任务拆解能力:能否把复杂目标分解成可执行步骤
• 工具调用准确度:能否正确选择和调用工具
• 错误恢复:出错了能否自己发现并纠正
• 长程规划:超过50步的多步骤任务完成率
对于做Agent产品开发的朋友,这是很好的参考基准。
📌 本期总结
AI这趟车越跑越快。你有什么想了解的AI话题?欢迎留言告诉我,下周说不定就安排上😊
参考来源:OpenAI开发者分享会、阿里云官方公告、Midjourney官方博客、字节跳动CodeMate Pro产品页、Stanford AgentBench 2.0论文

