AI资讯新闻榜单内容搜索-AI新闻

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AI新闻
EMNLP 2026|「AI把数字说歪」,官方AI审稿现场演示了一遍

EMNLP 2026|「AI把数字说歪」,官方AI审稿现场演示了一遍

EMNLP 2026|「AI把数字说歪」,官方AI审稿现场演示了一遍

EMNLP 2026录用论文提出Claim-Locked Reporting方法,针对AI审稿等场景中数字正确但方向或结论强度被改写的统计主张失真问题,通过先锁定证据支撑的主张、再由代码固定数字与方向而模型仅负责衔接,在fMRI与临床试验报告上将跨次生成数值复现率分别提升至98.5%和100%,并消除了方向反转错误。

来自主题: AI技术研报
8644 点击    2026-10-01 13:16
看一遍就会,三星&上交提出RoboICL新方法,GPT-6 Astra多项机器人操控评测全面领先

看一遍就会,三星&上交提出RoboICL新方法,GPT-6 Astra多项机器人操控评测全面领先

看一遍就会,三星&上交提出RoboICL新方法,GPT-6 Astra多项机器人操控评测全面领先

三星与上海交通大学提出RoboICL具身上下文学习方法,通过冻结GPT-6 Astra模型并在推理时提供少量示范与机器人自身交互记忆,在RoboDojo 30项机器人操控评测中以50.64分全面领先PhysicalRSI等现有方法,并公开了929条可逐布局核查的执行记录及真实机械臂实验结果。

来自主题: AI技术研报
10102 点击    2026-10-01 13:15
国产世界模型首次出海上路!Momenta直接让百亿公里老司机开上欧洲街头

国产世界模型首次出海上路!Momenta直接让百亿公里老司机开上欧洲街头

国产世界模型首次出海上路!Momenta直接让百亿公里老司机开上欧洲街头

Momenta与神龙科技达成战略合作,将基于R7世界模型共同开发高阶智能辅助驾驶系统并搭载于标致、Jeep新量产车型,覆盖中国、欧洲及全球市场,实现国产世界模型首次出海上路进入国际品牌全球车型开发体系。

来自主题: AI资讯
8564 点击    2026-10-01 13:15
硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!

硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!

硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!

浪潮信息在AICC 2026发布搭载128芯本土AI芯片的元脑SD200 Ultra超节点AI服务器,通过超级算子融合技术将2.8万亿参数Kimi K3的Token生成时延降至5.85毫秒,与海外Inferact以"巨内核"路线共同打响万亿参数模型推理效率战。

来自主题: AI资讯
9286 点击    2026-10-01 13:15
NeurIPS'26 | 港科大:从CPU到GPU,AI能否真正加速全流程?

NeurIPS'26 | 港科大:从CPU到GPU,AI能否真正加速全流程?

NeurIPS'26 | 港科大:从CPU到GPU,AI能否真正加速全流程?

港科大团队在NeurIPS 2026上提出AccelEval基准,覆盖6个领域42项任务和43类CUDA优化策略,评测大模型能否从可信CPU程序生成端到端更快的GPU实现,其中Gemini 3.1 Pro在中规模通过正确性验证的任务上取得71.2倍几何平均加速比。

来自主题: AI技术研报
7856 点击    2026-10-01 13:14
Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写

Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写

Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写

谷歌正式发布前沿AI模型Gemini 4 Argon,其在Text Arena排名第一、Vals RSI指数超越GPT-6 Astra达30%,单任务成本仅1.99美元,单次输出上限升至100万Token,并在谷歌内部以Rust安全语言重写了80万行系统内核代码。

来自主题: AI资讯
9477 点击    2026-10-01 10:16
Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

MiniMax于9月27日上线Flash级别模型M3.1-Flash-Preview,本文通过试衣间项目改造、机器人视频拆解、北京夜光可视化和A股市场观测台四个实测任务,将其与DeepSeek V4.1 Flash和GLM-5.3-Flash对比,结果显示M3.1速度仅次于DeepSeek但成本最低,成为Flash赛道上DeepSeek的新对手。

来自主题: AI资讯
8058 点击    2026-09-30 15:44
DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源面向华为昇腾算力平台的基础设施组件,涵盖TileLang编译工具及DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect等计算与通信库,华为亦在CANN社区开源双方围绕昇腾950及超节点的联合创新实践。

来自主题: AI资讯
10025 点击    2026-09-30 15:43
GPT-6 Astra也会「看错」流程图? Einsia AI发布PPTBench,视觉编程还有多远?

GPT-6 Astra也会「看错」流程图? Einsia AI发布PPTBench,视觉编程还有多远?

GPT-6 Astra也会「看错」流程图? Einsia AI发布PPTBench,视觉编程还有多远?

Einsia AI旗下Navers Lab发布视觉编程基准PPTBench,包含500个科学流程图任务并测试10个模型36种配置,GPT-6 Astra High以77.34分居首,但64.03%的结果因流程语义错误被拒,表明视觉理解仍是当前主要瓶颈。

来自主题: AI资讯
7136 点击    2026-09-30 15:42
刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

至知创新研究院开源320B大模型IQuest-Q1,该模型在代码生成、安全漏洞挖掘等评测中表现优异,并能自主排查训练Bug,在交通调度、仓库管理、电梯调度等真实场景中展现出强大的任务解决能力。

来自主题: AI资讯
8668 点击    2026-09-30 15:42