Gemini 3 推出 Deep Think 模式:面向 Ultra 订阅用户的深度推理升级 Google在持续推进Gemini3模型系列演进的过程中,正式推出全新功能模式——Gemini3DeepThink。该模式基于Gemini3Pro架构,通过增加计算资源投入并融合前沿技术手段,重点强化... 奈飞网 2025-12-14 24 #推理 #deep
Google新一代视觉AI称霸?Gemini 3 Pro视觉推理分数超车GPT‑5.1 Google正式公布,其最新多模态大模型Gemini3Pro在近期多项权威视觉AI基准测试中斩获多项榜首成绩,尤其在聚焦高阶图像与视频理解能力的MMMU‑Pro与Video‑MMMU两大评测中表现亮眼... 奈飞网 2025-12-14 20 #推理 #人工智能
3A 大作!阿里 ROLL 团队从基建->算法->机理,推动 RL4LLM 全栈协同优化 近日,阿里巴巴ROLL团队(淘天未来生活实验室联合阿里巴巴智能引擎团队)携手上海交通大学、香港科技大学正式发布「3A」全栈协同优化框架——涵盖Async架构(AsynchronousTraining)... 奈飞网 2025-12-13 20 #优化策略 #推理
迎战Gemini!OpenAI推GPT-5.2 称史上最强推理AI OpenAI正式推出全新一代大语言模型GPT-5.2,官方称其为目前性能最强、表现最优的版本。本次发布涵盖三大差异化版本:Instant、Thinking与Pro,分别面向实时交互、深度分析及高阶专业... 奈飞网 2025-12-13 21 #推理 #openai #人工智能
DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理 两个月前,我们推出了实验性版本DeepSeek-V3.2-Exp,并收到了大量热心用户提交的对比测试反馈。截至目前,并未发现V3.2-Exp在任何特定任务场景下显著弱于V3.1-Terminus,这充... 奈飞网 2025-12-01 27 #能力模型 #推理 #https #api
Meta 发布 CoT 验证模型:基于 Llama 3.1 的白盒推理纠错工具 MetaAI实验室近日在HuggingFace平台发布了一款全新大模型,旨在推动链式思维(Chain-of-Thought,CoT)推理的验证与优化。该模型暂命名为“CoT-Verifier”,基于L... 奈飞网 2025-11-28 20 #cot #推理
快手开源新一代旗舰多模态模型 Keye-VL 快手正式推出全新一代旗舰级多模态大模型Keye-VL-671B-A37B,并同步开源其代码。官方表示,该模型具备“善看会想”的能力,在通用视觉理解、视频分析、数学推理等多项核心基准测试中表现卓越,全面... 奈飞网 2025-11-28 29 #模态分析 #能力模型 #推理
阿里千问登顶空间推理全球榜首,超越Gemini 3与GPT-5.1 近日,在衡量多模态模型空间推理能力的关键基准测试SpatialBench的最新榜单中,来自阿里巴巴的视觉理解模型取得了瞩目的成绩。其旗下的千问Qwen3-VL和Qwen2.5-VL模型,成功包揽了榜单... 奈飞网 2025-11-26 26 #阿里 #推理
谷歌发布新一代 AI 模型 Gemini 3:在推理、多模态、编程等主流测试中全面领先 谷歌正式推出全新一代人工智能模型Gemini3,并迅速将其集成到谷歌搜索、Gemini应用程序以及企业级解决方案中。公司CEO桑达尔・皮查伊表示,这是迄今为止“最强大的AI模型”。根据官方说明,Gem... 奈飞网 2025-11-19 31 #谷歌 #测试模型 #人工智能 #推理
腾讯云开源 DeepSeek 量化部署方案:性能最高提升 3.9X 腾讯云联合小红书HilabInfra团队,在SGLang中实现了DeepSeek量化模型的高效推理优化,并在HuggingFace中发布了DeepSeek-V3.1-Terminus的量化模型。量化方... 奈飞网 2025-11-19 24 #量化模型 #量化分析 #权重 #推理