Gemini:谷歌正式发布Gemini3系列
11月18日,谷歌正式发布Gemini3,并于发布首日立即在谷歌搜索、Gemini应用程序App及多个开发者平台同步上线。Gemini3在全球AI模型LMArena排行榜上以1501分的历史最高分登顶,Humanity’s Last Exam基准测试中获得37.5%的最高分,超越了GPT-5Pro的31.64%。该模型擅长数学、多模态理解和事实准确性、代码生成等。同时推出了增强的推理模式Gemini3Deep Think,可进一步提升Gemini3的性能。Gemini3保留了跨模态信息综合能力,无缝处理文本、图像、视频、音频和代码等多种模态信息,并配备100万token的上下文窗口,定价为2美元/12美元(<20万个token)、4美元/18美元(>20万个token)。在智能体能力方面,Gemini3能够在整整一年的模拟运营中保持一致的工具使用和决策能力,在不偏离任务的情况下实现更高回报。同时谷歌还推出了Gemini3ProImage,可以根据文本提示生成和修改图片。它会使用推理功能“思考”提示,并检索实时数据(例如天气预报或股市图表),然后使用Google搜索进行事实依据核查,最后生成高保真图片,65k/32k上下文窗口。
Gork:正式发布Grok4.1
11月17日,xAI正式发布Grok4.1。版本已面向grok.com、X平台以及iOS、Android应用的所有用户开放。马斯克称Grok4.1把重点放在更快的响应、更高的事实准确性,以及更自然、更具个性的对话体验上了。官方数据显示:Grok4.1的幻觉率从12.09%降到4.22%,减少近三倍;得益于强化学习基础设施与新的奖励模型体系,Grok4.1使用“前沿推理模型”作为奖励模型,模型能自主评估并快速迭代,不再过度依赖大规模人工标注。在EQ-Bench情感智能测试、创意写作评测中表现出色。Grok4.1的上下文窗口最高可支持256,000tokens,在Fast模式下可扩充至200万。能够更好地应对内容生产、长文档协作以及持续对话场景,减少上下文丢失,。情绪理解方面,新版本不再停留在前代安慰句式,而是主动延展情绪线索,体察用户失落背后的细节,不再只是识别悲伤,而是能够陪伴悲伤。
Qwen:千问APP正式上线
11月16日,千问APP在应用商店中上线。阿里巴巴官宣千问APP正式开启公测,免费开放,人人可用,网页端与PC版同步开放。千问APP搭载Qwen3-Max,是通义千问家族尺寸最大、能力最强的基础模型。援引阿里人士观点称,推出千问APP的时机“刚刚好”,因为Qwen3-Max模型已达全球领先,且集团内部的Agent生态(如淘宝、高德等)也到了可以被模型普遍调用的阶段。此次千问App的推出,阿里巴巴在AI变现策略上转向消费者(C端)市场。
**郑重声明:**东方财富发布此内容旨在传播更多的信息,与本站立场无关,不代表东方财富观点。建议用户在阅读研报过程中,请认真仔细阅读研报里的风险提示、免责声明、重要声明等内容,用户据此操作风险自担。
- 原文作者:知识铺
- 原文链接:https://index.zshipu.com/stock003/post/20251027/AI%E5%A4%A7%E6%A8%A1%E5%9E%8B%E5%91%A8%E6%8A%A5-%E7%AD%96%E7%95%A5%E7%A0%94%E6%8A%A5-_-%E6%95%B0%E6%8D%AE%E4%B8%AD%E5%BF%83/
- 版权声明:本作品采用知识共享署名-非商业性使用-禁止演绎 4.0 国际许可协议进行许可,非商业转载请注明出处(作者,原文链接),商业转载请联系作者获得授权。
- 免责声明:本页面内容均来源于站内编辑发布,部分信息来源互联网,并不意味着本站赞同其观点或者证实其内容的真实性,如涉及版权等问题,请立即联系客服进行更改或删除,保证您的合法权益。转载请注明来源,欢迎对文章中的引用来源进行考证,欢迎指出任何有错误或不够清晰的表达。也可以邮件至 sblig@126.com