ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

DeepSeek与Grok同日发布新模型:性能提升价格有变,中美大模型价差渐小

时间:2026-08-13 19:03:44来源:天脉网编辑:快讯

8月12日,全球人工智能领域迎来重要时刻,DeepSeek与马斯克旗下SpaceXAI同日发布新模型DeepSeek-V4-Pro和Grok 4.6,标志着新一轮大模型竞争进入白热化阶段。从最新评测数据来看,两款新模型均展现出强劲实力,逐步逼近全球顶尖水平,引发行业广泛关注。

DeepSeek-V4-Pro在智能体相关测试中表现尤为突出。根据官方公布的评测结果,与今年4月发布的预览版相比,正式版在多项关键指标上实现显著提升。其中,软件工程能力测试DeepSWE得分从12.8跃升至62.7,高难度数据科学任务测试DSBench-Hard得分从31.1提升至67.2,终端操作能力测试Terminal Bench 2.1得分从72.1提高到87.9,网络安全测试Cybergym得分从52.7增至83.3,HLE带工具测试得分也从48.2上升至60.0。这些数据充分证明,DeepSeek-V4-Pro在复杂任务处理能力上取得重大突破。

在与国际顶尖模型的对比中,DeepSeek-V4-Pro同样表现出色。评测数据显示,该模型在多项测试中超越Anthropic的Claude Opus 4.8,与Fable 5则各有优势。具体来看,在Terminal Bench 2.1测试中,V4-Pro得分87.9,与Fable 5的88.0基本持平;在Cybergym测试中,V4-Pro以83.3分略高于Fable 5的83.1分;但在DSBench-FullStack测试中,V4-Pro得分71.1,略低于Fable 5的77.2分。半导体与AI研究机构SemiAnalysis的评测进一步证实,V4-Pro在Agent任务上的表现大幅领先英伟达Nemotron 3 Ultra,Terminal Bench 2.1测试中,Nemotron 3 Ultra得分53.9,而V4-Pro高达87.9。

除性能提升外,DeepSeek-V4-Pro在功能支持方面也实现全面升级。新模型支持100万Token上下文窗口和最高38.4万Token输出,同时提供思考与非思考两种模式,其中思考模式为默认开启状态。官方API文档显示,V4-Pro还新增工具调用功能,并兼容OpenAI和Anthropic两套API格式,为用户提供更多选择和便利。值得注意的是,尽管性能显著提升,DeepSeek此前预告的API"大幅涨价"并未随V4-Pro正式版上线同步实施。截至最新信息,V4-Pro每百万Token缓存命中输入价格仍为0.025元,缓存未命中输入为3元,输出为6元,与预览版定价保持一致。

与此同时,SpaceXAI发布的新一代模型Grok 4.6也引发市场热议。这款距离上一代Grok 4.5发布仅一个多月的新模型,主要面向长时间运行的AI智能体以及更复杂的交互和视觉任务。AI模型评测机构Artificial Analysis的最新数据显示,Grok 4.6在综合得分上已追平OpenAI旗舰模型GPT-5.6 Sol,两者在最新版本的Artificial Analysis Intelligence Index中均获得61分。这一指数综合了9项关键评测,包括高经济价值职场任务测试GDPval-AA v2、终端操作测试Terminal-Bench v2.1等,能够全面衡量模型的实际应用能力。

在成本控制方面,Grok 4.6展现出显著优势。SpaceXAI公布的价格显示,新模型每百万Token输入和输出价格分别为2美元和6美元,与上一代Grok 4.5保持一致。相比之下,Claude Opus 5的输入和输出价格分别为5美元和25美元,GPT-5.6 Sol则高达5美元和30美元。Artificial Analysis的测算显示,Grok 4.6完成一项智能指数测试任务的平均成本仅为0.84美元,与Kimi K3持平,在性能相当的情况下具有更高的性价比。马斯克在新模型发布后多次在社交平台宣传,称Grok 4.6"智能、快速且性价比超高",在综合考虑智能水平、速度和成本的情况下"客观上是第1"。

行业分析指出,中美大模型市场的竞争格局正在发生深刻变化。摩根士丹利最新研报显示,中国大模型API平均价格过去一年明显上涨,而美国闭源模型价格持续下降,两国大模型价格差距正在收窄。具体来看,2025年一季度,中国大模型输入、输出API均价仅分别占美国同行的6%和5%,到2026年二季度,这一比例已上升至19%和14%。随着中国模型价格上涨和美国厂商继续降价,预计这一差距还将进一步缩小。

研报认为,中国大模型市场的竞争重点正在从"价格战"转向"智力战"。以DeepSeek为例,尽管此前预告将"大幅"上调API价格,但这一调整可能与V4系列需求增强带来的定价能力提升、维持合理毛利以支持前沿模型持续投入等因素有关。随着模型能力和规模继续提升,中国新一代大模型的定价可能进一步上升,行业竞争将更多转向模型能力和算力供给。摩根士丹利强调,"模型智能,而非价格,才是大模型长期竞争地位的关键决定因素",因为头部模型厂商可以推出价格更低、能力稍弱的模型进入大众市场,而普通模型厂商要追赶至最前沿水平则困难得多。

更多热门内容
马斯克多次点赞中国电力优势 内蒙古成AI算力绿色发展新热土
马斯克 7月,在《经济学人》专访中,马斯克说得更直白:中国发电量已超美国、欧洲和印度总和,未来可能达到美国的4倍。中国新能源企业把AI算力中心建在新能源富集的戈壁滩上,用绿电直供的方式让AI“生长”。由此,…

2026-08-13

名创优品一次性内裤街头“解体”,女生尴尬社死,品牌整改岂能敷衍?
为了验证是不是自己不小心扯坏的,回到酒店之后,曾女士直接拆开了这包内裤的最后一条,结果更离谱的来了! 但,曾女士从头到尾都没要求赔偿,她拍视频发声,只是单纯吐槽自己的糟心遭遇,就想问问品牌,能不能把最基础的…

2026-08-13

王思聪5年前电脑如今值129万,硬件保值引热议:是理财新路还是富人游戏?
有人算了一笔账:“5年涨了29万,年均收益率接近6%,比存银行强多了,这才是真正的硬通货。” 对此,有硬件分析师试图从“存储芯片供需周期”角度解释涨价逻辑,结果被网友直接怼了回去:“专家别分析了,人家买的是定…

2026-08-13

AI大模型赛道财富狂飙:梁文锋领跑全球富豪增速榜,Anthropic七人紧随
金融研究机构bestbrokers在8月12日发布了过去一年的全球亿万富翁财富涨幅榜,DeepSeek创始人梁文锋以3850%的年增长排全球第一。 有意思的是,7月亿万富豪指数更新,梁文锋的身家为360亿美…

2026-08-13