不更新参数就能强化学习!OpenAI翁家翌提出新范式:决策只需AI手搓一个.py 文件
不更新参数就能强化学习!OpenAI翁家翌提出新范式:决策只需AI手搓一个.py 文件没有训练梯度的AI,打破了Atari游戏满分纪录。OpenAI核心研究员翁家翌提出了一个强化学习新范式——启发式学习(Heuristic Learning, HL)。
搜索
没有训练梯度的AI,打破了Atari游戏满分纪录。OpenAI核心研究员翁家翌提出了一个强化学习新范式——启发式学习(Heuristic Learning, HL)。
俺做滴 我做了一个给 Agent 用的网盘,叫 neuDrive.ai,开源的 你在 Claude、Codex、Cursor 这些工具里攒下来的 skill、记忆、文件,可以通过 neuDrive 一键备份、相互同步
1.2万亿美元!Anthropic 估值正式反超OpenAI,硅谷局势彻底变了!手握马斯克的22万张顶级GPU,以及谷歌2000亿美元的长约,这场万亿美金级别的史诗级豪赌,正带我们见证硅谷商业史上最疯狂的「王位更替」。
OpenAI,这次又真·Open了一下。
AI圈有个怪现象: 模型越来越强,确实是好事;但随着AI用法越发多样,用起来的门槛却越来越高。
Anthropic联合创始人Jack Clark读完数百份公开数据,得出一个让他自己也坐不住的结论:2028年底前,AI自己造AI的概率是60%。支撑他这一判断的,是编程、科研复现、模型训练优化等多条能力曲线:每一条都在向右上方飞,没有减速迹象。
斯坦福大学宣布:将旗下两大AI与数据科学组织——Stanford HAI(以人为本人工智能研究院)和Stanford Data Science(斯坦福数据科学)合并为一个统一机构,名称保留Stanford HAI,由计算机科学家James Landay全面掌舵。
一分钟,4千万token,灰飞烟灭。 「龙虾之父」Peter Steinberger大概没想到,自己会以这种方式上热搜。今年2月他被Sam Altman亲自招入OpenAI,负责「下一代个人代理」的开发。
Google DeepMind再次血洗数学圈!700个地狱级难题被丢进Gemini的熔炉,结果让数学家集体破防:这哪是证明,这分明是「逻辑拆迁」。DeepMind这一波不仅贴脸爆杀了OpenAI,还砸烂了人类所有的优越感。
某大厂员工润生( 化名 )对知危表示,“公司现有项目被分成两组,一组是用 AI 的,一组是不用 AI 的。不用 AI 的是正常工作量,用 AI 的会安排 140% 的工作量,之后还会逐渐增加。”