AI资讯新闻榜单内容搜索-GPT

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPT
Llama架构比不上GPT2?神奇token提升10倍记忆?

Llama架构比不上GPT2?神奇token提升10倍记忆?

Llama架构比不上GPT2?神奇token提升10倍记忆?

近日,朱泽园 (Meta AI) 和李远志 (MBZUAI) 的最新研究《语言模型物理学 Part 3.3:知识的 Scaling Laws》用海量实验(50,000 条任务,总计 4,200,000 GPU 小时)总结了 12 条定律,为 LLM 在不同条件下的知识容量提供了较为精确的计量方法。

来自主题: AI资讯
4654 点击    2024-04-10 19:11
纯C语言手搓GPT-2,前OpenAI、特斯拉高管新项目火了

纯C语言手搓GPT-2,前OpenAI、特斯拉高管新项目火了

纯C语言手搓GPT-2,前OpenAI、特斯拉高管新项目火了

「Real men program in C.」 众所周知,大语言模型还在快速发展,应该有很多可以优化的地方。我用纯 C 语言来写,是不是能优化一大截? 也许很多人开过这样的脑洞,现在有大佬实现了。

来自主题: AI技术研报
2848 点击    2024-04-09 16:10
破解36年前魔咒!Meta推出反向训练大法消除大模型「逆转诅咒」

破解36年前魔咒!Meta推出反向训练大法消除大模型「逆转诅咒」

破解36年前魔咒!Meta推出反向训练大法消除大模型「逆转诅咒」

大语言模型的「逆转诅咒」,被解开了。近日,来自Meta FAIR的研究人员推出了反向训练大法,让模型从反方向上学到了事实之间的逻辑,终于改进了这个困扰人们已久的问题。

来自主题: AI技术研报
5930 点击    2024-04-09 15:57
1000行C语言搓出GPT-2!AI大神Karpathy新项目刚上线就狂揽2.5k星

1000行C语言搓出GPT-2!AI大神Karpathy新项目刚上线就狂揽2.5k星

1000行C语言搓出GPT-2!AI大神Karpathy新项目刚上线就狂揽2.5k星

训大模型的方法可能要被革新了!AI大神Karpathy发布的新项目仅用1000行的C语言训完GPT-2,而不再依赖庞大的GPT-2库。他本人预告,即将上线新课。

来自主题: AI技术研报
5733 点击    2024-04-09 15:14
AI大模型搜索之战开启,胜出黑马竟是ta?

AI大模型搜索之战开启,胜出黑马竟是ta?

AI大模型搜索之战开启,胜出黑马竟是ta?

距离AI「杀死」搜索引擎,到底还差几步?

来自主题: AI技术研报
5970 点击    2024-04-09 14:52
工业大模型也能图片、视频、CAD一键生成?「创新奇智」给出新思路

工业大模型也能图片、视频、CAD一键生成?「创新奇智」给出新思路

工业大模型也能图片、视频、CAD一键生成?「创新奇智」给出新思路

AInno-75B正式亮相,AI在视觉识别和工业设计领域的应用范围进一步拓宽。Chat GPT、Sora、Suno等AI技术的接连问世,让人类社会经历了一场认知的革命。世人开始意识到,AI不仅是单一的工具本身,更是推动人类文明进步的新引擎。在这个数据驱动、智能互联的时代,我们不禁发问:当AI的触角延伸到工业的每一个角落,它将如何重塑工业的未来?

来自主题: AI资讯
7885 点击    2024-04-09 11:26
AI治理观察:Sora或者ChatGPT生成的内容版权究竟归谁?

AI治理观察:Sora或者ChatGPT生成的内容版权究竟归谁?

AI治理观察:Sora或者ChatGPT生成的内容版权究竟归谁?

行业狂飙之际,版权利益争夺渐酣今年2月,美国OpenAI公司发布了首个视频生成模型“Sora”,再次掀起全球追进生成式人工智能的热潮。然而,据《纽约时报》近日报道,科技巨头OpenAI和谷歌被指涉嫌使用YouTube视频的转录文本来训练其人工智能模型,这一行为可能侵犯了YouTube创作者的版权。

来自主题: AI技术研报
8769 点击    2024-04-09 11:19
GPT-4推理能力为0?开发者悬赏1万美金被打脸,神秘提示正确率直冲100%

GPT-4推理能力为0?开发者悬赏1万美金被打脸,神秘提示正确率直冲100%

GPT-4推理能力为0?开发者悬赏1万美金被打脸,神秘提示正确率直冲100%

小孩子都会的脑筋急转弯推理题,GPT-4和Claude 3做不出?国外一位开发者小哥坚称这一观点,认为GPT模型在训练集外毫无推理能力,无法实现AGI,甚至悬赏1万美元,发起比赛。然而,他当天就被光速打脸了!网友用高能的prompt,让GPT-4和Claude 3几乎达到百分百的正确率。

来自主题: AI技术研报
5598 点击    2024-04-09 10:32