T
traeai
登录

概念

RSI

别名:Reinforcement Learning with Self-Imitation

基于自模仿强化学习的模型迭代技术

已跟踪 14 条高相关材料

TraeAI 观察

相关材料

已收录 14 条与 RSI 相关的内容,按评分排序。

量子位 图标

EverMind通过三篇论文系统性解决自进化AI技术难题,构建全栈解决方案。

入选理由:EverMind提出技能层、脚手架层、模型权重层三重技术架构实现自进化

精选文章#自进化AI#EverMind#NeoLab#AI研究中文
178: 与田渊栋聊 RSI:模型自进化如何到来?

178: 与田渊栋聊 RSI:模型自进化如何到来?

晚点聊 LateTalk1967 字 (约 8 分钟)
85

RSI(模型自进化)正在成为AI领域的重要方向,Recursive Superintelligence验证了小规模成果,OpenAI等公司正加速探索。

入选理由:Recursive Superintelligence在6月初验证了AI系统自动提升性能的可行性

精选播客#RSI#AI#自动化研究#OpenAI#Recursive Superintelligence中文
Where AGI timelines go wrong | Toby Ord, Oxford University

Where AGI timelines go wrong | Toby Ord, Oxford University

80,000 Hours Podcast32179 字 (约 129 分钟)
85

Toby Ord认为递归自我改进(RSI)不会导致智能爆炸,因AI研究需更多突破,而非仅编程自动化。

入选理由:AI研究需要重大突破,自动化实验无法替代战略决策和架构创新。

精选播客#AGI#AI治理#递归自我改进#AI伦理英文
The Actual Reason Why Google “Fell Out” of the AI Race Changes Everything

The Actual Reason Why Google “Fell Out” of the AI Race Changes Everything

The Algorithmic Bridge2199 字 (约 9 分钟)
85

Google因战略选择退出AI竞赛,转向世界模型而非递归自我改进,与OpenAI/Anthropic路径形成根本分歧。

入选理由:Google DeepMind押注世界模型而非递归自我改进(RSI)实现AGI

精选文章#AI#AGI#Google#OpenAI#战略英文
AI agents can't yet do open-ended AI research

AI agents can't yet do open-ended AI research

AI Snake Oil1423 字 (约 6 分钟)
85

AI代理在开放性研究中存在显著局限,无法有效进行递归自我改进。实验显示代理在资源管理、创造性反馈处理和研究方向调整上表现不佳。

入选理由:AI代理仅使用了不到50%的API预算,显示资源意识不足

精选文章#AI研究#AI代理#递归自我改进#开放性研究英文
[AINews] Anthropic Claude Fable 5 — Mythos but Safe, with Controversial Terms

Anthropic 发布的 Mythos 级模型 Fable 5 在性能上表现强劲,但因 ZDR 和 RSI 抑制政策引发争议。

入选理由:Fable 5 的规模是 Opus 的两倍,性能在 FrontierCode Diamond 上提升了 16.9%。

精选文章#Anthropic#AI模型#Fable 5#ZDR#RSI英文
Andrej Karpathy Joins Anthropic: What Happens Next

Andrej Karpathy 加入 Anthropic:接下来会发生什么

The Algorithmic Bridge1684 字 (约 7 分钟)
75

Andrej Karpathy加入Anthropic负责Claude预训练研究,专注于AI自主改进能力(RSI),这可能加速AI独立研发进程。

入选理由:Karpathy将在Anthropic团队领导Nicolas Joseph下工作,使用Claude加速预训练研究,为RSI能力奠定基础。

精选文章#AI#Anthropic#Claude#Karpathy#RSI英文
Turning on RSI at Gumroad

Turning on RSI at Gumroad

Sahil Lavingia(@shl)102 字 (约 1 分钟)
55

推文讨论了Gumroad启用RSI(可能指重复性劳损)相关话题,但内容碎片化且缺乏技术深度。

入选理由:推文内容缺乏具体技术细节

精选推文#Gumroad#RSI#推文讨论中英混合
Suhail(@Suhail) 图标

Suhail谈RSI框架:Kaggle前18%但缺创造力

Suhail(@Suhail)134 字 (约 1 分钟)
55

Suhail开发的RSI测试框架在Kaggle竞赛中达到前18%并发现ARC-AGI 2新优化技术,但因缺乏创造力尚未实现递归自我改进。

入选理由:RSI框架自2024年11月开发,在多数Kaggle竞赛中稳定进入前18%排名。

精选推文#RSI#ARC-AGI 2#Kaggle#AI安全英文

跨材料问答 · RSI

回答基于:RSI 相关 14 条材料
    0 / 500

    AI 可能会生成不准确的信息,请核实重要内容