详细调试信息 - getPostsByCategory:
当前 cat_name: 即时经济
传入的 cat_slugs: %e5%8d%b3%e6%99%82%e7%b6%93%e6%bf%9f
当前页码: 1
is_lifetime: false
时间条件: 即时新闻 - 3个月以内
查询结果:
找到文章数: 2443
最大页数: 245
当前返回文章ID数: 10
文章IDs: 7595584, 7595563, 7595567, 7595571, 7595527, 7595494, 7595497, 7595500, 7595503, 7595467
第1页第一篇文章日期: 2026-08-12
第1页最后一篇文章日期: 2026-08-12

SpaceX推Grok 4.6 马斯克扬言“客观上排名第一” 每百万输出Token收费6美元起

SpaceX(SPCX)旗下SpaceXAI发布Grok 4.6,主打长时间运行的AI代理、编程,以及更复杂的互动和视觉项目。马斯克更在社交平台X称,Grok 4.6在“智慧、速度和成本”三方面考量下,“客观上排名第一”。新模型即日起登陆Cursor、Grok Build及API,亦可经OpenRouter、Vercel和Cloudflare等合作平台使用。

预告Grok 4.7超越所有模型

马斯克更预告,下一代Grok 4.7将会超越目前所有的模型。他扬言“尽管Anthropic大概很快就会推出更先进的模型,但SpaceX的训练语料库是如此强大且独特,若有任何模型在真实世界的工程能力上能比4.7更出色,我会感到非常震惊”。

Grok 4.6可持续处理复杂任务

SpaceXAI表示,Grok 4.6可持续处理涉及多个步骤的复杂任务,包括资料研究、资讯分析、跨程式码库工作,以及将产品构思转化为可运行的应用程式或工作成果。

部份测试更胜Fable 5 Max

按公司公布的测试结果,新模型在由9项测试组成的人工智能分析指数(Artificial Analysis Intelligence Index)中取得61分,较上一代的56分高,并追平GPT-5.6 Sol Max,仅较最高分的Fable 5 Max低一分。

在个别测试中,新模型于专业知识工作评测取得1,753分,高于Fable 5 Max的1,741分;程式开发评测则取得69.9%,高于GPT-5.6 Sol Max的67.2%。不过,新模型并非在所有项目均领先,在软件工程及终端操作评测中分别取得65.9%及26%,均落后于两款主要竞争模型。

更主动测试及验证自身工作

SpaceXAI表示,Grok 4.6尤其擅长把广泛的产品构思转化为首个可运行版本。模型可研究陌生领域、规划应用程式架构、实现核心互动,并按多轮意见持续修改。

公司指出,Grok 4.6接受较Grok 4.5更长时间的补充训练,训练材料包括模型生成的推理及进阶技术数据、高质素工程资料,以及经改良的优化器和训练方案。公司又利用了Grok 4.5重新生成涵盖科学、科技、工程及数学、软件工程和知识工作的监督微调数据,再透过模型检查剔除有问题的推理轨迹。

此外,Grok 4.6亦接受多种代理式强化学习训练,涵盖一般编程、内核优化、网页开发及电脑辅助设计等环境。SpaceXAI称,新模型在处理较长任务时,会更主动测试及验证自身工作,再进入下一步流程。

收费方面,Grok 4.6的API定价由每100万个输入Token收费2美元、每100万个输出Token收费6美元起;另设速度较快的版本,价格为标准版两倍。

SpaceXAI首周亦会在Grok Build及Cursor提供双倍使用额度,吸引开发者试用新模型。公司表示,已按模型能力调整安全措施,并进行推出前、推出后及第三方测试。

---------------------------------------------

>>>星岛网WhatsApp爆料热线(416)6775679,爆料一经录用,薄酬致意。

>>>立即浏览【生活百答】栏目:新移民抵埗攻略,老华侨也未必知道的事,移民、工作、居住、食玩买、交通、报税、银行、福利、生育、教育。
点击以下6大平台 接收加拿大新闻及生活资讯

延伸阅读

延伸阅读

芝加哥联储行长古尔斯比忧物价升幅过快 “通胀是美国经济最大问题”

电能中期纯利飙升3.8倍 售英国配电商录112亿收益 中期息维持78仙

越秀房托中期可分派总额跌16% 中期息少15% 写字楼竞争加剧 拒割喉式减租

马斯克大赞中国很棒 “强烈鼓励大家去看看” 母亲梅耶也表示认同