分类: 前沿模型

  • DeepSeek 夜间重大更新上线,36氪实测复盘模型体验变化

    DeepSeek 今晚上线了一次重大产品更新,面向其对话式 AI 用户提供新的模型体验。此次更新被外界视为一次重要版本调整,36氪围绕更新后的实际表现做了完整评测,重点检验回答质量、使用体验与预期之间的差距。和旧版相比,这次变化的关键在于 DeepSeek 对线上模型服务进行了集中调整,但公开摘要未披露具体版本号、参数规模或完整功能清单。评测文章的核心问题是:这次更新是否达到用户对“大更新”的预期,还是出现体验落差。对于正在使用 DeepSeek 处理问答、写作、代码和资料整理的用户,这类更新会直接影响日常调用体验和模型选择。据36氪报道。

  • 腾讯锁定AI算力“粮仓”,大模型训练和推理补上供给侧

    36氪报道,腾讯正在加码AI算力供给,围绕大模型训练、推理和云端部署持续补充资源,外界将这一动作称为给AI计算力建起“粮仓”。同一报道还提到,长鑫已登上总市值第一的位置,国产半导体链条在算力周期中的分量进一步上升。对腾讯来说,这类算力储备直接关系到自研模型迭代、产品接入和服务交付效率,也让大模型竞争从单看参数和效果,转到比拼算力供给、部署速度和持续训练能力。据36氪报道。

  • 智谱发布 GLM-5.3:代码能力提升 50%,两周后开源权重

    智谱 AI 发布了 GLM-5.3,官方称其代码能力较上一版提升 50%,并将在两周后开放模型权重。此次更新主要面向开发者、代码助手和自动化编程场景,重点强化代码生成、调试、重构等任务,继续把 GLM 系列往更强的工程开发能力推进。对比前代版本,GLM-5.3 把编程表现作为最直接的升级点,也为后续开源生态和二次开发留出空间。据finance.biggo.com报道。

  • 月之暗面发布 Kimi K3,Kimi 系列再推新一代前沿模型

    月之暗面发布了 Kimi K3,推出 Kimi 系列的新一代模型版本,面向通用对话、内容生成和复杂任务处理场景。此次更新把 Kimi 继续往前沿大模型竞争区间推进,也意味着 月之暗面 继续围绕自家模型主线做迭代,而不是只停留在应用层功能补充。对于依赖 Kimi 的普通用户和开发者来说,新模型通常意味着更强的文本理解、更稳的多步任务处理,以及在 API 调用、知识问答和生产力工具接入上的新选择。与上一代相比,Kimi K3 的变化重点在于模型能力升级本身,直接对标的仍是 GPT、Claude、Gemini 这一档旗舰模型。据mshale.com报道。

  • Z.ai 发布 GLM-5.3:强化前沿编程能力,网络安全表现超出训练预期

    Z.ai 发布了新一代模型 GLM-5.3,主打前沿编程能力和更强的网络安全任务表现。此次更新面向开发者、代码生成与审查、自动化工程辅助以及安全分析等场景,重点提升模型在复杂代码理解、生成和问题定位中的可用性。与旧版 GLM 系列相比,GLM-5.3 的增量集中在编码能力和网络安全能力上,尤其是后者被描述为“超出训练阶段预期”,显示模型在漏洞分析、攻击路径理解等任务上出现更强泛化表现。这也让 GLM-5.3 在代码模型和安全智能体方向上,进一步进入与国际前沿模型竞争的区间。据Unite.AI报道。

  • 苹果联手阿里开发中国专属 AI 模型,Apple Intelligence 入华推进

    苹果与阿里巴巴合作开发面向中国市场的专属 AI 模型,用于支撑 Apple Intelligence 在中国上线。此次合作面向中国区 iPhone、iPad 和 Mac 用户,重点覆盖系统级写作、摘要、图片生成、语音助手等 Apple Intelligence 场景。关键增量在于,苹果不再直接沿用海外版模型服务,而是引入本地合作方参与模型开发与适配,以满足中国市场的产品落地和服务要求。对苹果而言,这将补上其生成式 AI 功能在中国设备上的缺口;对阿里而言,其模型能力将进入苹果硬件生态。据finance.biggo.com报道。

  • 腾讯确认资本优先投向 AI 基础设施,云与大模型算力投入提级

    腾讯确认将在资本配置中优先投入 AI 基础设施,把算力、数据中心和相关底层能力放到更高优先级。这一调整面向腾讯内部 AI 业务、云服务客户以及需要训练和部署大模型的企业场景,直接指向模型训练、推理服务和 AI 应用落地所需的基础资源。与单纯发布新模型不同,腾讯此次更新的是投入顺序:资本开支将更集中服务于 AI 基础设施建设,为混元等模型能力、企业云上 AI 服务和内容生成、广告、游戏等业务提供更稳定的算力支撑。在阿里云、百度智能云等国内厂商持续强化 AI 云服务的背景下,腾讯的表态意味着其云与模型业务会获得更明确的资源倾斜。据Inven Global报道。

  • xAI发布Grok 4.6,主打长时间运行的智能体任务

    xAI发布Grok 4.6,把Grok系列更新重点放在长时间运行的智能体工作上。新版本面向需要模型持续执行多步骤任务的开发者和企业团队,包括任务拆解、连续推理、工具调用后的状态跟进等代理式场景。与旧版Grok更偏即时对话和短链路任务相比,Grok 4.6的增量是服务长周期agent流程,让模型在较长任务中保持上下文和执行连贯性。该更新也使xAI在与OpenAI、Anthropic、Google等厂商争夺智能体工作流入口时,拥有更明确的长任务版本定位。据TestingCatalog AI News报道。

  • OpenAI 预览 GPT-5.6 Ultrafast Mode,低延迟模式进入前沿模型竞争

    OpenAI 预览了 GPT-5.6 的 Ultrafast Mode,这是围绕 GPT-5.6 增加的超高速运行模式。此次变化指向低延迟交互场景,面向需要快速响应的聊天产品、开发者调用、客服助手和代码辅助等应用。相对常规 GPT-5.6 使用方式,Ultrafast Mode 的关键增量集中在响应速度档位,而不是单独发布一个全新模型名称;它让同一代模型可以按速度需求提供更快体验。报道未披露该模式的开放范围、价格、接口细节和具体性能指标,因此目前可确认的信息是 OpenAI 已对 GPT-5.6 的高速模式进行预览。对模型服务商而言,低延迟能力正在成为与 Claude、Gemini 等产品竞争……

    阅读全文

  • OpenAI为GPT 5.6 Sol推出Ultrafast模式,推理速度提升至14倍

    OpenAI发布了面向GPT 5.6 Sol的新模式“Ultrafast”,将该模型的运行速度提升至原来的14倍。此次更新针对需要低延迟响应的AI使用场景,包括实时问答、代码辅助、客服对话和高频调用的开发者应用。与此前GPT 5.6 Sol的默认运行方式相比,Ultrafast的关键变化是把同一模型的响应速度大幅拉高,而不是发布一款全新模型。对开发者和企业用户来说,这意味着在使用GPT 5.6 Sol时可以用更短等待时间完成生成、分析和交互任务,也让OpenAI在高性能模型之外继续强化速度维度的竞争。据TechCrunch报道。

  • Anthropic 发布 Mythos-Class Claude 5,瞄准 AWS 与 Microsoft Foundry 企业模型入口

    Anthropic 发布了被称为“Mythos-Class”的 Claude 5,将 Claude 系列推进到新一代旗舰模型。这次变化首先是产品代际更新:Claude 从上一代模型进入 Claude 5 阶段,并以更高阶的 Mythos-Class 定位面向企业开发者、云平台客户和需要在业务系统中接入大模型的应用团队。围绕 Claude 5,竞争焦点落在 Amazon AWS 与 Microsoft Foundry 等企业级模型平台入口上,云厂商需要用更强模型供给吸引开发者和企业工作负载。与旧款 Claude 产品相比,Claude 5 的增量主要体现在新旗舰版本和企业平台分发竞争上;与 Op……

    阅读全文

  • DeepSeek上调V4模型API价格,低价调用策略出现调整

    DeepSeek上调了V4系列模型的API价格,面向通过接口接入其模型能力的开发者、企业客户和应用服务商。此次变化不是新模型发布,而是对已开放V4模型调用成本的调整,影响文本生成、智能客服、代码辅助、Agent应用等依赖API计费的场景。和此前V4模型的价格相比,开发者在同等调用量下需要承担更高成本,原本依靠DeepSeek低价API构建产品的团队,需要重新核算推理成本、用户定价和模型路由策略。此次调价也会改变DeepSeek在商业API市场中的价格竞争位置,尤其是在开发者同时评估OpenAI、Anthropic、Qwen、Kimi等模型服务时,价格优势将不再只由“低调用费”决定。据路透社报道……

    阅读全文

  • 阿里更新 Qwen 3.8 许可:开放权重,但给商业化收入设上限

    阿里巴巴更新了 Qwen 3.8 许可条款,在继续开放模型权重的同时,对商业化使用设置收入上限。开发者、创业公司和企业团队仍可基于 Qwen 权重做微调、部署和产品集成,用于智能体、企业助手、内容生成、代码等场景;但当使用方收入规模超过许可规定范围时,需要进入额外授权或商业合作流程。与完全封闭的 API 模型不同,Qwen 仍保留本地部署和二次开发空间;与更

  • IBM与OpenAI官宣企业AI合作,GPT-5.6进入企业工作流

    IBM和OpenAI发布企业级AI合作,OpenAI的GPT-5.6将被整合进IBM面向企业的AI能力和相关工作流中,主要服务企业客户的开发、部署和业务应用场景。这意味着IBM不再只是提供自家企业AI工具,也开始把OpenAI最新模型纳入产品体系,企业用户可以直接在IBM生态里使用更强的生成、推理和自动化能力。和以往单一厂商自建模型路线相比,这次合作把Ope

  • SpaceX 推出新一版 Grok AI,直面 Anthropic 和 OpenAI

    SpaceX 推出了新一版 Grok AI,把这款模型进一步推到更直接的通用 AI 竞争线。此次更新的重点不是概念展示,而是把 Grok 放进更明确的产品发布节奏里,和 Anthropic 的 Claude、OpenAI 的 ChatGPT 正面同场。对外部市场来说,这意味着马斯克体系内的 AI 产品继续补强,竞争焦点也从单次功能演示转向持续迭代和模型能力对

  • xAI 发布新版 Grok,直接向 Anthropic 和 OpenAI 施压

    xAI 发布了新版 Grok AI,进一步把这款模型推到与 Anthropic 的 Claude 和 OpenAI 的 GPT 系列正面竞争的位置。此次更新的重点是继续强化 Grok 在通用对话与推理场景中的能力,并把它作为 xAI 在模型市场中的主力产品推进。对用户来说,Grok 的新版本意味着可用能力再向前一步,尤其是在与主流闭源大模型的直接对比中,xA

  • OpenAI最核心人物创业后作品曝光:可自我学习的大模型,可能掀起AI革命

    X 用户 @iruletheworldmo 爆料称,Ilya Sutskever 创办的 Safe Superintelligence 正在测试一种可在推理时自我学习的小型模型引擎。 这件事的核心不是 SSI 终于要发布模型,也不是 Ilya 离开 OpenAI 后第一次露面,而是模型路线可能发生变化:它不是继续把模型做得更大、上下文塞得更长,而是让模型在解

  • Meta 发布 Muse Glimmer 30B,基准表现压过 Qwen 3.627B

    Meta 发布了 Muse Glimmer 30B 大模型,并在多项基准测试中跑赢了 Qwen 3.627B。这个 30B 级模型面向开发者和研究场景,重点展示的是通用模型能力与推理表现,而不是单一任务优化。按 Geeky Gadgets 的说法,Muse Glimmer 30B 在公开测试里的成绩已经超过 Qwen 3.627B,说明 Meta 这次把竞争

  • DeepSeek 推出旗舰 V4-Pro,对标 Kimi K3 正面交锋

    DeepSeek 发布旗舰模型 V4-Pro,直接把新一代主力模型推向和月之暗面 Kimi K3 的同场竞争。此次上线的是 DeepSeek 的旗舰版本,面向通用对话、内容生成和开发者调用等场景,目标是覆盖高频使用的前沿模型需求。和此前产品线相比,V4-Pro 进一步强化了 DeepSeek 在高端模型市场的存在感,也让国产大模型阵营的竞争焦点更集中到旗舰能

  • 阿里开源 2.4 万亿参数大模型,性能对标 Fable 5

    阿里巴巴开源发布了一款 2.4 万亿参数大模型,面向开发者、研究机构和企业 AI 团队开放使用,可用于模型评测、应用原型开发和私有化部署等场景。此次更新的关键增量是参数规模达到万亿级,并以开源方式提供,降低外部团队接入和二次开发门槛。性能层面,该模型被称可与 Fable 5 对标,意味着阿里在开源大模型赛道继续向高性能闭源模型施压,也为企业在自建 AI 应用