AI资讯新闻榜单内容搜索-14

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 14
NP难问题接近被AI破解!南航牛津爆改DeepSeek-R1推理,碾压人类27年研究

NP难问题接近被AI破解!南航牛津爆改DeepSeek-R1推理,碾压人类27年研究

NP难问题接近被AI破解!南航牛津爆改DeepSeek-R1推理,碾压人类27年研究

给DeepSeek-R1推理指导,它的数学推理能力就开始暴涨。更令人吃惊是,Qwen2.5-14B居然给出了此前从未见过的希尔伯特问题的反例!而人类为此耗费了27年。研究者预言:LLM离破解NP-hard问题,已经又近了一步。

来自主题: AI技术研报
8443 点击    2025-03-04 16:20
GPT-4.5登顶6小时即失守!Grok-3上演1分逆袭

GPT-4.5登顶6小时即失守!Grok-3上演1分逆袭

GPT-4.5登顶6小时即失守!Grok-3上演1分逆袭

基础模型竞争又紧张刺激起来了!GPT-4.5刚登顶竞技场且全任务分类第一名,6小时后总榜就被马斯克的新版Grok-3反超。两者都是获得3000+票数,总分1412:1411只差一分。

来自主题: AI资讯
6199 点击    2025-03-04 13:11
Appfigure:用户2024年为AI付费达14亿美元,教育是关键领域之一

Appfigure:用户2024年为AI付费达14亿美元,教育是关键领域之一

Appfigure:用户2024年为AI付费达14亿美元,教育是关键领域之一

,最近,Appfigure 通过梳理 1000 款 AI 应用(移动端)总结了一份年度 AI 趋势报告,称AI市场在2024年近20亿美元的规模,重点介绍了AI助理、文生图、AI 陪伴、教育AI等版块。

来自主题: AI资讯
9826 点击    2025-03-04 10:30
ICLR 2025|浙大、千问发布预训练数据管理器DataMan,53页细节满满

ICLR 2025|浙大、千问发布预训练数据管理器DataMan,53页细节满满

ICLR 2025|浙大、千问发布预训练数据管理器DataMan,53页细节满满

在 Scaling Law 背景下,预训练的数据选择变得越来越重要。然而现有的方法依赖于有限的启发式和人类的直觉,缺乏全面和明确的指导方针。在此背景下,该研究提出了一个数据管理器 DataMan,其可以从 14 个质量评估维度对 15 个常见应用领域的预训练数据进行全面质量评分和领域识别。

来自主题: AI技术研报
8402 点击    2025-02-28 14:04
14岁出道编程天才:新一代码农不会写代码了,AI正培养「文盲程序员」!

14岁出道编程天才:新一代码农不会写代码了,AI正培养「文盲程序员」!

14岁出道编程天才:新一代码农不会写代码了,AI正培养「文盲程序员」!

一篇题为「New Junior Developers Can’t Actually Code」的博文炸开了锅。资深码农Namanyay对AI工具在软件开发中的广泛应用表达了忧虑——AI正在让新一代开发者跳过基础知识的学习,沦为「复制粘贴(CV)工程师」。这篇文章迅速蹿红,引发了包括马斯克在内的众多业内大佬的热议。

来自主题: AI资讯
6095 点击    2025-02-23 11:28
马斯克“地表最强”Grok 3炸场,竞技场首超1400分

马斯克“地表最强”Grok 3炸场,竞技场首超1400分

马斯克“地表最强”Grok 3炸场,竞技场首超1400分

刚刚,马斯克xAI的Grok 3终于亮相(超300万人次围观)!一出道即巅峰,竞技场(lmarena.ai)官方给出了这样的评价:Grok 3是首个突破1400分的模型,并且在所有类别中排名第一。

来自主题: AI资讯
8310 点击    2025-02-18 15:03
全球空间智能第一股!浙大清华“三剑客”,英伟达基因,填补两大技术空白

全球空间智能第一股!浙大清华“三剑客”,英伟达基因,填补两大技术空白

全球空间智能第一股!浙大清华“三剑客”,英伟达基因,填补两大技术空白

全球空间智能第一股来了!来自中国,来自杭州。2月14日,空间智能独角兽群核科技正式向港交所递交招股说明书,启动IPO进程,冲击“全球空间智能第一股”,摩根大通、建银国际为联席保荐人。

来自主题: AI资讯
8165 点击    2025-02-17 12:32
DeepSeek R1遇难题142次"I give up",研究还称需增加推理时机控制机制

DeepSeek R1遇难题142次"I give up",研究还称需增加推理时机控制机制

DeepSeek R1遇难题142次"I give up",研究还称需增加推理时机控制机制

最新大语言模型推理测试引众议,DeepSeek R1常常在提供错误答案前就“我放弃”了?? Cursor刚刚参与了一项研究,他们基于NPR周日谜题挑战(The Sunday Puzzle),构建了一个包含近600个问题新基准测试。

来自主题: AI技术研报
5843 点击    2025-02-14 17:41