OpenAI和Google竞争,谁能引领AI新潮流

GoogleGemini新模型的亮点与突破
Google于9月25日发布了两款新模型Gemini-1.5-Pro-002和Gemini-1.5-Flash-002。这并非大版本更新,而是整体模型的升级。其中,价格降低是重要的更新重点。Gemini1.5Pro的输入、输出和增量缓存token价格均有大幅下降,这无疑为用户降低了使用成本。
速率限制的提高也是一大亮点。1.5Flash的速率限制从1000RPM提升至2000RPM,1.5Pro的速率限制从360RPM提高到1000RPM。输出速度的提高和延迟的降低,将为用户带来更高效的体验。

Google还强调了模型在数学、长上下文窗口和视觉等方面的进步。在MMLU-Pro基准测试中,性能提升约7%;在数学和HiddenMath基准测试中,进步更是显著,达到约20%。对于视觉和代码使用场景,表现也有2-7%的提升。
Gemini模型的长上下文和多模态功能独具特色。部分开发者已经利用GeminiFlash的免费额度构建了应用,并取得了不错的效果。
OpenAI高级语音模式的创新与特色
OpenAI在同日宣布推出高级语音模式,从即日起向Plus和Team用户推送,周内全量推送。其与标准语音模式有所区分,以蓝色旋转球表示,并新增5种新语音。
高级语音模式的一大重要亮点是提供个性化定义。用户可以自定义指令,让模型以特定口音发音、记住事件以及称呼用户喜欢的名字等。比如,输入名字和所在城市,模型能给出更个性化的周末计划。
高级语音模式也存在一些限制。Plus和Team用户每天有使用限制,且可能变化。在剩余15分钟使用时间时,OpenAI会通知用户。使用高级语音模式无法使用GPTs。而且,该模式在某些嘈杂场景下更容易被打断。
OpenAI与Google的竞争态势
OpenAI和Google在AI领域的竞争日益激烈。此前,Google发布Gemini模型大更新前,OpenAI就曾提前宣布将带来高级语音模式。此次Google发布新模型,OpenAI又卡点推出高级语音模式,竞争态势愈发明显。
值得一提的是,负责Google此次新模型对外沟通交流的LoganKilpatrick,正是OpenAI前开发者关系负责人。这一人员流动,也为双方的竞争增添了一丝戏剧性。
在硅谷,AI的战争仍在如火如荼地进行,未来谁能在技术创新和用户体验上更胜一筹,引领AI的新潮流,让我们拭目以待。

相关问答
GoogleGemini新模型有哪些价格优势?
Gemini5Pro的输入、输出和增量缓存token价格大幅降低,输入token价格降低64%,输出token价格降低52%,增量缓存token价格降低64%。
OpenAI高级语音模式有什么个性化功能?
用户可以自定义指令,让模型以特定口音发音、记住事件、用喜欢的称呼称呼自己,还能根据所在城市给出个性化的周末计划。
OpenAI高级语音模式对用户有使用限制吗?
Plus和Team用户每天有使用限制,且可能变化。当一天的高级语音还剩15分钟时,OpenAI会向用户发出通知,并且使用该模式无法使用GPTs。
GoogleGemini模型在哪些方面有性能提升?
在数学、长上下文窗口、视觉和代码使用场景等方面有性能提升,在MMLU-Pro基准测试中性能提升约7%,在数学和HiddenMath基准测试中进步约20%,在视觉和代码使用场景提升范围在约2-7%之间。
OpenAI和Google在AI领域的竞争有什么特点?
竞争激烈,OpenAI常常在Google发布新模型时推出新功能,且双方人员流动也为竞争增添了戏剧性。

