NeurIPS 2026 Spotlight|拒绝模型「自作主张」,VisInteract用交互搜索找回意图
NeurIPS 2026 Spotlight|拒绝模型「自作主张」,VisInteract用交互搜索找回意图数据要让人看懂,通常得先从数据库里查出来,再画成图。文本到可视化(Text-to-Vis)做的就是这件事:用户说出想看什么,系统去库里查询,再用图表把需要的数据展示出来。
搜索
数据要让人看懂,通常得先从数据库里查出来,再画成图。文本到可视化(Text-to-Vis)做的就是这件事:用户说出想看什么,系统去库里查询,再用图表把需要的数据展示出来。
智能体时代,安全研究不仅要关心模型说了什么,现在还必须进一步回答:它做了什么、为什么这么做,以及这次的执行轨迹是否越过了当前场景明确规定的安全边界。
大模型解短题常能给出流畅答案,推理链一长,却可能每一步都看似合理、终点仍然失效。来自弗吉尼亚理工大学、威斯康星大学麦迪逊分校和达特茅斯学院的研究团队在 NeurIPS2026 论文中提出 SAGE:用符号闭包分析(SCA)解释长推理中的探索偏差与累积偏差,再把这一诊断变成训练时的结构引导。
今天上午,OpenAI 把一个尚未发布的内部模型产出的 722 篇数学手稿一次性放上了 GitHub。发布本身的来龙去脉、模型背景和数学界的争议,我们在上一篇报道里已经梳理过。这一篇换个角度,打开仓库,看看清单上到底有哪些成果。
就在刚刚,OpenAI 宣布向 ChatGPT 全体用户推送 GPT-6,同时上线 Intelligent UI(智能界面)。
太炸裂了!
Anthropic发布Claude Haiku 5.5,单价为Haiku 4.5的十分之一,多项跑分显著提升,定位为处理摘要、上下文压缩、数据库查询和分类等任务的高速低成本模型。
谷歌推出Nano Banana 2.1,出图价为Nano Banana 2的一半,支持蒙版局部编辑、最高4K直出和最多14张参考图,并在Arena多图编辑榜排名第4,陆续登陆Gemini App、搜索AI模式、AI Studio等平台。
OpenAI公开了未发布的内部前沿模型产出的722篇数学手稿,归为372个成果族,涉及准黎曼猜想和四维挂谷猜想等,其中235族附有Lean形式化说明,仍待专家审读验证。
作者将手绘视频制作流程整理为handdrawn-explainer Skill并上传至SkillHub,使agent能按主题生成脚本和可视分镜,产出配音与绘画时序对齐的视频,并支持审阅后修改。