2026年7月24日,全球AI大模型市场迎来了一个密集发布日。xAI正式发布了Grok 4.5模型,在iOS、Android、网页端及X平台全面开放。官方将其称为目前最聪明的模型,主打更聪明的回答与更好的意图跟随能力。与此同时,DeepSeek宣布其V4满血版正式版GA正式上线,旧版deepseek-chat和deepseek-reasoner接口在同日下线。两个重量级模型的同时发布让全球大模型市场的竞争格局再次出现了新的变数。从技术路线来看,xAI的Grok 4.5和DeepSeek V4选择了截然不同的方向。Grok 4.5强调长对话稳定性和复杂推理能力,走的是增强通用智能的路线。DeepSeek V4则延续了其高效的模型架构和激进的定价策略,Flash版和Pro版分别面向高频调用和深度推理两种使用场景。
Grok 4.5相对于前代版本最重要的改进在于对话稳定性的提升。过去使用Grok进行长对话时不少用户反馈在对话中期会出现遗忘早期上下文的状况。Grok 4.5通过在训练中引入更长的上下文窗口和记忆保持机制,使得这一问题得到了显著改善。程序员群体特别关注的是Grok 4.5的编程能力提升。xAI官方宣称新版本在代码生成和Bug修复任务上的表现明显优于前代。Grok此前在编程领域的表现一直被评价为中等偏上,与Claude和GPT相比存在一定差距。这次更新有望缩小这一差距。Grok 4.5已经在所有平台上开放使用,包括iOS、Android、网页端以及X平台。免费用户和X Premium订阅用户都可以使用不同级别的模型访问权限。xAI没有公布具体的定价变化,但有分析认为Grok 4.5的发布将继续推动大模型价格的下行。
根据xAI官方公布的信息,Grok 4.5在多个维度上实现了显著的性能提升。首当其冲的是长对话记忆的稳定性。之前的AI模型在长对话中经常出现遗忘早期对话内容、上下文理解偏差等问题。Grok 4.5通过在训练阶段引入更长的上下文窗口和专门的记忆保持机制,使得模型在多轮对话中能够更稳定地追踪和理解对话的上下文脉络。在编程能力方面Grok 4.5也有大幅提升。xAI官方宣称新版模型在代码生成、Bug修复和代码理解等任务上的表现明显优于前代版本。对于程序员来说这意味着Grok 4.5可以更好地辅助编写复杂应用、理解遗留代码库和处理跨文件的代码重构任务。另一个重要提升是意图跟随能力。Grok 4.5在处理模糊指令和复杂请求时表现出了更好的理解能力。如果用户给出的指令不够明确,模型会更主动地追问确认,而不是直接猜测然后给出错误答案。这种交互质量的提升对于实际应用场景来说意义重大,因为真实世界的用户很少能给出完美无歧义的指令。Grok 4.5已在所有平台上开放使用,包括iOS、Android、网页端以及X平台。xAI没有公布具体的定价信息,但根据此前的定价体系,免费用户和X Premium订阅用户都可以使用不同级别的模型访问权限。
同日上线的DeepSeek V4满血版同样值得关注。这是DeepSeek继4月推出V4预览版后首次发布GA正式版。V4系列包含两个版本:deepseek-v4-flash和deepseek-v4-pro。Flash版拥有2840亿参数其中130亿活跃参数,提供了GPT-5.6级别的性能,而输出价格仅为每百万Token 0.28美元。Pro版则拥有1.6万亿参数,定位为满血旗舰版,在推理能力上对标Claude Opus和GPT-5.6 Sol等顶级模型。这次发布伴随的一个重要变化是DeepSeek正式切换了其API接口。旧版deepseek-chat和deepseek-reasoner接口于UTC时间7月24日15:59正式下线,在此时间之后任何使用旧接口的请求都会返回错误。开发者需要将代码中的模型名称切换为新的V4系列模型名称。值得注意的一个陷阱是:旧版的deepseek-reasoner实际指向的是V4-flash的思考模式而非V4-pro。如果开发者直接将deepseek-reasoner更名为deepseek-v4-flash,会遭遇隐性的质量降级。只有明确切换到deepseek-v4-pro才能保留高推理能力。此外DeepSeek V4将思考模式从模型名称中解耦出来变为请求参数,开发者现在可以在请求中自由切换是否开启链式思考推理,而不再需要为此切换模型。V4的两个版本都支持100万Token的上下文窗口和最大384K的输出长度。
xAI和DeepSeek的同步发布折射出当前大模型市场的三大趋势。第一是闭源与开源两条路线并行发展的格局更加清晰。xAI选择了完全闭源的路线,而DeepSeek虽然在API层面收费但模型权重保留了一定程度的学术开放。两种路线各有优势,分别服务于不同的客户群体和需求场景。第二是价格战的持续深化。DeepSeek V4 Flash版每百万Token输出仅0.28美元的价格再次刷新了大模型服务的性价比上限。这种价格水平倒逼着所有大模型厂商不断优化推理效率。第三是模型能力的垂直分化。xAI的Grok 4.5强调长对话和复杂推理,DeepSeek V4 Pro聚焦编程和Agent能力,各自选择了一个核心赛道进行深度耕耘。随着大模型能力的持续提升和应用场景的不断拓展,这种差异化的竞争策略将越来越成为主流,一个通用模型打天下的时代正在逐渐远去。