刚刚,十个Claude 5.5攻克百年物理猜想!
刚刚,十个Claude 5.5攻克百年物理猜想!10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。
搜索
10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。
Anthropic招股书披露,其背负未来5180亿美元算力与基建长期支出承诺,2025年营收近46亿美元却净亏约420亿美元,公司正冲击或超2万亿美元的IPO估值,但客户集中度高且订单缺乏长期合同保障,能否撑住天价估值取决于收入增长能否持续跑赢算力成本。
AIHOT开发者卡兹克正式开源月活百万的AI热点资讯网站AIHOT,并上线利用Claude Opus 5.5等模型重写的AIHOT 2.0版本,以便法律、金融、HR等各行业用户基于该开源框架构建属于自己的行业热点监控产品。
说好的未来几周,Anthropic只等了6天。上周Opus 5.5发布的时候,官方顺手剧透了一嘴,Sonnet 5.5和Haiku 5.5都在后面。刚刚,Sonnet 5.5先到了。而且Claude家的“中杯”,已经撵着刚发布的旗舰追了。
欧洲开发者 Mario Zechner 开发的极简 Coding Agent Harness Pi 只给模型一个 bash,却在多项 Benchmark 中击败 Claude Code 和 Codex,凭借极简设计和高可扩展性在 2025 年底爆火,团队来自维也纳而非硅谷。
Anthropic发布Claude Sonnet 5.5,运行速度较前代提升30%、单任务成本最高降低30%,以一半的标价在多项基准测试中接近或反超大杯Opus 5.5,凭借代码、视觉理解和办公等能力成为新一代性价比之王。
Opus 5.5因网友用其设计含1113个真实零件的Microduck乐高版本并生成141页说明书、将宜家说明书转为3D配音教学视频以及尝试重现《塞尔达传说:时之笛》等"vibe coding"新玩法持续走红,并在Code Arena: WebDev榜单以低于第二名60%的价格拿下第一。
硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。
Anthropic官方指南揭秘Opus 5.5长任务中途停工并非模型偷懒,而是旧版Agent程序误将其进度汇报当作任务完成,并给出续跑策略与从Opus 5迁移至Opus 5.5的API注意事项。
Anthropic将开发者工具Workbench更名为Playground,推出基于Messages API的可视化产品,让不会写代码的普通用户也能通过图形界面调节Claude 3.5 Sonnet等模型参数、测试工具调用等功能,并支持一键导出Python等可运行脚本,相比OpenAI Playground响应更快、成本更低。