迈向长程智能体,人大高瓴发布149页全景综述
迈向长程智能体,人大高瓴发布149页全景综述我们想强调的是:智能体 “跑得久”,并不等于 “具备长程能力”。真正的关键,不在于占用更多时间与算力,而在于能否在更长、更复杂、更真实的推理依赖链上持续、有效地行动。长期以来,Autonomous Agent、Self-Evolving Agent 等概念常与长程智能体混用。
搜索
我们想强调的是:智能体 “跑得久”,并不等于 “具备长程能力”。真正的关键,不在于占用更多时间与算力,而在于能否在更长、更复杂、更真实的推理依赖链上持续、有效地行动。长期以来,Autonomous Agent、Self-Evolving Agent 等概念常与长程智能体混用。
你有没有想过,写代码这件事的对象正在悄悄换人?上周一晚上,我在旧金山Market Street上WorkOS的办公室里待了将近两个小时,看了二十几个现场demo。进门之前我以为这只是一场普通的创业展示夜,但看完之后我意识到,这群人在展示的根本不是产品,而是他们对"写代码、用代码、读代码"这件事本身的理解,已经发生了多深的变化。
SFT是LLM从“通才”变成“专才”的关键步骤。业界默认做法是:准备标注数据(QA对、指令-回复对等)在基座模型上跑SFT训练。看loss曲线收敛了→认为训练完成。但问题在于:loss是全局平均,掩盖了样本间的差异。loss收敛只代表“大部分样本学会了”——那些始终学不会的样本被淹没了。
经常用AI的人都知道,AI给出的答案质量,很大程度上取决于你提问的方式。这一点,几乎成了当下社交媒体的流量密码。打开各大平台,随处可见兜售各类Prompt的帖子,我们自己的收藏夹里也往往躺着几十套Pr
按照超聚变的定位,TokenBox™ 是一套面向办公室场景的企业级本地 AI 平台。它将算力模块、模型服务、推理加速、Token 运营和安全管理整合进同一套产品体系,让企业能够在本地持续生产、调度和管理 Token。
Anthropic又被扒光了!这一次,Claude Opus 5的系统提示词,被人整份扒下来,传到GitHub上了。旗舰刚发,就被全网「开盒」,这一波属实猝不及防。就在上线的同一天,开发者Eversmile1直接建了个新仓库。
Agent 执行任务的时候,会反复踩坑、不断试错,最后积累一些正确的经验。但这些经验通常只能停留在当前会话,或者当前 Agent 的记忆里,很难传给其他 AI。一个 Agent 调用某个 API,花了半个小时查文档、改参数,连续失败好几次,最后终于找到正确方法。
最近,DeepSeek 接连上了几次热搜。先是因为一张实习 offer 引发围观。一位清华学生在社交媒体晒出录用信息,岗位是 DeepSeek 实习生,税前日薪 5500 元。按每月 22 个工作日计算,月薪超过 12 万元。
今年 6 月,Google DeepMind 宣布与电影公司 A24 建立长期研究合作,并向其投资约 7500 万美元。成立于 2012 年的 A24,以开发独具文艺气息的小众电影见长。它的代表作包括奥斯卡最佳影片《月光男孩》和《瞬息全宇宙》、全球票房大卖的《至尊马蒂》,以及今年热映的恐怖片《后室》。14 年间,A24 早已把片厂名字做成品牌:A24 三个字,本身就是人气的保证。
7月16日,Nature刊出消息:科学家用AI造出了自然界里从来没有过的CRISPR酶,切基因比「天然版本」更利索。论文同日发表在Science。带队的人,是2020年因为CRISPR拿下诺贝尔化学奖的Jennifer Doudna。