刚刚,十个Claude 5.5攻克百年物理猜想!
刚刚,十个Claude 5.5攻克百年物理猜想!10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。
搜索
10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。
Anthropic的Opus 5.5凭借代码直出音乐MV的能力在社交平台爆火,马斯克多次转发并盛赞"史诗级""真切感受到AGI",网友纷纷发起同题接龙挑战。
小纪有话说: “社区里每天有上万张鹈鹕踩单车的视频被发群里,问我这个鹈鹕降智了吗?”开源项目CodexRadar的发起人Lambda,在GPT-6 Astra发布之后,每天都收到巨量的鹈鹕视频,于是,
Manus发布2.0版本全家桶产品,包含新agent架构Cascade、面向工作创作的Manus Studio及个人智能体Cue,表明AI应用几乎只剩Coding/办公、视频/游戏与个人智能体三件事,并宣布组建团队开发面向国内市场的产品。
中国电信星辰通用人工智能实验室推出的轻量化文档解析模型TeleOCR(约1.2B参数)凭借形变感知学习、多边形版面分割、CGDP采样及内容—结构解耦等技术创新,在OmniDocBench v1.6、Wild-OmniDocBench、PureDocBench等多个公开榜单取得领先,并在ICDAR 2026 Sci-ImageMiner挑战赛中夺冠,目前已开源。
OpenAI宣布明天重新开放200美元Pro订阅,但新方案按API美元计价后对应用量减半,Tibo因此遭到用户强烈批评。
北京大学AI for Math团队宣布在Lean 4中完整形式化庞加莱猜想,约320万行代码、半个月内完成、成本不到3万美元,是首个同时通过Lean编译与Comparator双重验证的版本。
至知创新研究院开源了采用稀疏 MoE 架构的代码与复杂任务导向大模型 IQuest-Q1,该模型总参数约 320B、激活参数仅约 15B,在代码生成、终端操作、智能体任务等多项评测中表现均衡,并展示了从前端交互、游戏开发到强化学习训练调试等场景的可交付能力。
IDC与浪潮信息联合发布的《2026年中国人工智能计算力发展评估报告》显示,全球活跃企业Agent数量预计将从2026年的7940万个增长至2030年的22.16亿个,带动Token消耗和算力需求爆发式增长,AI基础设施正围绕Agent长链路运行进行系统性重构。
Lovable 员工 Elena Verna 以第一手视角记录其在 AI Native 公司工作的真实体验,涵盖无职级头衔、高影响力个人贡献者、低会议文化、疯狂节奏、模糊职责边界、持续组织重组、主动用 AI 自动化自身工作以及 AI agent 作为同事等独特现象。