区块链文库报道:
DeepSeek V4 Pro与Grok 4.6同日发布
8月12日,DeepSeek推出V4 Pro,每百万输出令牌定价0.87美元。同日,SpaceXAI发布Grok 4.6,每百万输出令牌定价6美元。
两款产品的发布时间仅相隔数小时。创始人梁文峰于昨日早些时候发布了生产版本的V4 Pro,此前预览版已运行约四个月。由埃隆·马斯克领导的人工智能部门SpaceXAI在同一天发布了Grok 4.6。
两家公司均将模型定位于长周期智能体任务。该模型能持续调用工具、修改代码、检查结果并生成完整的成品。
V4 Pro的输出速率约为Grok 4.6的七分之一,OpenAI GPT-5.6 Sol的三十五分之一,以及Claude Fable 5的五十七分之一。SpaceXAI为Grok 4.6标价每百万输入令牌2美元,每百万输出令牌6美元。快速版本价格翻倍,超过20万令牌的长上下文请求则分别为4美元和12美元。
DeepSeek更具价格优势:缓存未命中时输入价格为每百万令牌0.435美元,缓存命中时低至0.003625美元。V4 Pro采用混合专家系统,总参数达1.6万亿,每个令牌激活参数490亿,训练数据超过32万亿令牌。其上下文窗口为100万令牌,输出上限为38.4万令牌。开放权重在Hugging Face上一个月内被下载超过140万次。
性能与安全表现
V4 Pro在安全与自动化方面表现优异。它在CyberGym智能体基准测试中得分83.3,高于Fable 5的83.1和Claude Opus 4.8的78.3。在AutomationBench上,V4 Pro取得31.8分,领先于两者。在Terminal-Bench 2.1中,V4 Pro得分为87.9,高于Opus 4.8的85.0,但比Fable 5低0.1分。
SpaceXAI的测试显示,Grok 4.6在GDPVal-AA v2上以1753 Elo排名第一(Grok 4.5为1526 Elo),在Harvey法律基准测试中得分15.8%,而GPT-5.6 Sol仅为2.5%。在人工分析智能指数中,Grok 4.6与GPT-5.6 Sol并列61分,落后Fable 5一分。
实际应用对比
在Flappy Bird游戏构建中,V4 Pro使用了超过2万令牌,花费0.019美元,生成了更丰富的细节;Grok 4.6使用了约5000令牌,但花费0.03美元。不过V4 Pro在制作鹈鹕动画时出现失败,鸟的动画显示为向后移动。
DeepSeek V4 Pro 0813版本已在OpenRouter上线。据报告,V4 Pro预览版在智能体任务上取得了显著提升:DeepSWE 62.7(+49.9),CyberGym 83.3(+30.6),NL2Repo 61.5(+23.0),Terminal Bench 2.1 87.9(+15.8)。更多提供商即将接入。
成本效益分析
DeFi智能体可以每月87美元的成本不间断运行。执行多步交易或监控DeFi头寸的智能体可以持续运行。一个每月生成1亿输出令牌的应用,在V4 Pro上成本约为87美元,而在Claude Opus 4.7上约为2500美元,在GPT-5.5上约为3000美元。V4 Pro的定价可以让那些在西方AI模型上亏损的策略实现盈利。
DeepSeek于5月达到0.87美元的费率,当时将输出价格从3.48美元永久下调75%。但DeepSeek已表示整体API定价将迎来“显著上涨”,因此当前低点可能不会持续。在8月12日的员工讲话中,马斯克表示人工智能收入将在9月超过SpaceX所有其他业务线的总和,并在五年内占公司价值的99%。
免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。
本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复




