LWiAI Podcast #252 - GPT 5.6, Grok 4.5, Nemotron-Labs-Diffusion, AI 2040
GPT-5.6与Grok 4.5等模型发布加剧竞争,AI政策协调与安全研究成焦点。
入选理由:OpenAI推出GPT-5.6并改名ChatGPT Work,引发政府监管争议。
产品
别名:Grok4.5
Grok 系列的前代产品模型
已跟踪 20 条高相关材料
最近变化
2026-08-12 · Grok 4.6 在保持相同价格的前提下实现性能提升
为什么值得关注
Grok 4.5 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
LWiAI Podcast #252 - GPT 5.6, Grok 4.5, Nemotron-Labs-Diffusion, AI 2040
Last Week in AI · 8.5 分
GPT-5.6与Grok 4.5等模型发布加剧竞争,AI政策协调与安全研究成焦点。
Inkling and Grok 4.5 are also available in Devin Desktop and CLI
Windsurf(@windsurf_ai) · 8.5 分
Devin Desktop和CLI现已支持Inkling和Grok 4.5模型,并推出FrontierCode排行榜跟踪代码生成质量。
The FrontierCode leaderboard is now live: a dedicated page that tracks which models are writing code...
Cognition(@cognition_labs) · 8.5 分
Cognition推出的FrontierCode排行榜现已上线,实时追踪能生成实际可合并代码的模型表现,包含Grok 4.5和Inkling等模型的评分及方法论。
已收录 20 条与 Grok 4.5 相关的内容,按评分排序。
GPT-5.6与Grok 4.5等模型发布加剧竞争,AI政策协调与安全研究成焦点。
入选理由:OpenAI推出GPT-5.6并改名ChatGPT Work,引发政府监管争议。
Devin Desktop和CLI现已支持Inkling和Grok 4.5模型,并推出FrontierCode排行榜跟踪代码生成质量。
入选理由:Devin Desktop和CLI新增支持Inkling及Grok 4.5模型
Cognition推出的FrontierCode排行榜现已上线,实时追踪能生成实际可合并代码的模型表现,包含Grok 4.5和Inkling等模型的评分及方法论。
入选理由:FrontierCode排行榜包含Grok 4.5和Inkling等模型的代码生成能力评分
Perplexity Computer快速集成Grok 4.5主要因模型评估表现最优、成本效益高,且ZDR功能即开即用满足客户需求。
入选理由:Grok 4.5在Perplexity的评估中表现最佳且成本效益最高
SpaceXAI发布Grok 4.5,首个Cursor合作训练的Opus级模型,性能接近Opus但成本效率提升,专注编码与代理场景。
入选理由:Grok 4.5是Cursor合作训练的首个非软件工程专用模型
Grok 4.5在终端基准测试中超越GPT-5.5且成本降低80%,但缺乏技术细节披露。
入选理由:Grok 4.5在Terminal Bench 2.1测试中较Opus 4.8 Max提升83.3%
Grok 4.5在SpaceX和Tesla内部测试,性能接近Opus,SpaceX计划每月发布全新模型。
入选理由:Grok 4.5基于1.5T V9模型并加入Cursor数据训练
Grok 4.5在Proximal的FrontierSWE基准测试中排名第二,研究能力排名第一。
入选理由:Grok 4.5在FrontierSWE基准测试中排名第二,仅落后于Claude Fable 5。
Grok 4.5在效率和成本上显著优化,每任务token使用减少50%,成本降低至同类模型的一半。
入选理由:Grok 4.5每任务消耗的token数量减少50%
Buzz是一款开源的Slack替代应用,支持AI代理协作与GitHub集成,但技术细节和工程实践阐述不足。
入选理由:Buzz允许邀请AI代理(如Claude、Grok 4.5)参与团队协作
播客总结了AI领域近期进展,包括GPT 5.6、Grok 4.5等模型发布及政策研究动态,但缺乏技术细节。
入选理由:GPT 5.6已公开发布,包含Sol、Luna等多个变体模型
Grok 4.6 是 SpaceXAI 推出的最新模型,相比 4.5 版本有显著改进但未披露具体细节。
入选理由:Grok 4.6 在保持相同价格的前提下实现性能提升
Genspark AI Chat 现已上线 Grok 4.5,该模型专为编码和代理优化,宣称具备领先的处理速度和成本效率。
入选理由:Grok 4.5 是 SpaceXAI 首个专为编码和代理训练的模型
SpaceXAI与Cursor AI合作推出Grok 4.5模型,宣称性能超越Composer 2.5但缺乏技术细节。文章为宣传性质,信息密度低。
入选理由:Grok 4.5是Cursor AI与SpaceXAI合作的首个非软件工程领域模型
xAI发布Grok 4.5,专为编码和代理训练,结合Cursor提升效率与成本效益。
入选理由:Grok 4.5是首个专为编码和代理设计的模型
SpaceXAI宣布Grok 4.5现已开放免费使用,但欧盟用户仍需等待。
入选理由:Grok 4.5已开放免费使用,无使用限制
推文仅提及Grok 4.5使用体验和部分互动数据,缺乏技术深度与实用价值。
入选理由:推文仅提及Grok 4.5使用体验和部分互动数据,缺乏技术深度与实用价值
开发者分享了多个AI模型额度耗尽后的使用体验,指出Codex Pro可用时间缩水,但Claude重置后恢复可用性。
入选理由:Codex Pro的周额度使用时间较之前缩短至少50%
Notion推出Grok 4.5模型,宣称在搜索任务上较Grok 4.3有显著提升,但未披露技术细节。
入选理由:Grok 4.5在搜索密集型任务上表现优于Grok 4.3
该推文未提供技术细节,仅宣传Grok 4.5的工程能力,缺乏可验证的技术原理和实践案例。
入选理由:该推文未提供技术细节,仅宣传Grok 4.5的工程能力,缺乏可验证的技术原理和实践案例