谷歌推出全新自然语言模型“双子座”(Gemini),直接对标OpenAI。作为迄今最灵活的LLM,Gemini针对Ultra、Pro和Nano三种尺寸优化,兼顾模型性能与任务适配性。
谷歌将分两阶段在Bard上线Gemini:先推英语版Pro版本覆盖170国,后续扩展多语种;再升级Ultra版本以提供顶级AI体验。因需充分测试性能及确保合规,发布节奏较预期延后。
测试涵盖图像音频理解、数学推理等维度,结果显示Gemini多项表现优于GPT-3.5。
双子座核心能力
- 多模态推理:可解析复杂图文数据,高效处理海量文档,助力科学、金融等领域数字化提速。
- 跨模态理解:同步识别文本、图像、音频等信息,精准把握细微语义,擅长解答数学、物理等复杂学科问题。
- 多语言编程支持:兼容Python、Java、C++、Go等主流语言,在HumanEval等评测中表现优异;作为AlphaCode 2基础模型,可解决编码及数理理论难题。

