Llama3-8B秒杀700亿巨兽?北大博士生等全新「BoT」框架推理暴涨70倍,24点图形推理一步成神
Llama3-8B秒杀700亿巨兽?北大博士生等全新「BoT」框架推理暴涨70倍,24点图形推理一步成神24点游戏、几何图形、一步将死问题,这些推理密集型任务,难倒了一片大模型,怎么破?北大、UC伯克利、斯坦福研究者最近提出了一种全新的BoT方法,用思维模板大幅增强了推理性能。而Llama3-8B在BoT的加持下,竟多次超越Llama3-70B!
搜索
24点游戏、几何图形、一步将死问题,这些推理密集型任务,难倒了一片大模型,怎么破?北大、UC伯克利、斯坦福研究者最近提出了一种全新的BoT方法,用思维模板大幅增强了推理性能。而Llama3-8B在BoT的加持下,竟多次超越Llama3-70B!
OpenAI自研芯片的计划终于看到了实质性进展。根据SemiAnalysis最近的一篇文章,他们正从谷歌TPU团队招募人才,扩展自己的芯片研发组。
DeepMind发表了一篇名为「To Believe or Not to Believe Your LLM」的新论文,探讨了LLM的不确定性量化问题,通过「迭代提示」成功将LLM的认知不确定性和偶然不确定性解耦。研究还将新推导出的幻觉检测算法应用于Gemini,结果表明,与基线方法相比,该方法能有效检测幻觉。
开源大模型全球格局,一夜再变。
未来5年内会在AI技术架构上有大的突破,Transformer会被逐步重构。15-20年内实现通用人工智能(AGI),并通过“新图灵测试”。
生命科学领域的基础大模型来了!
大模型应用开卷,连一向保守的苹果,都已释放出发展端侧大模型的信号。
图像与视频合成、3D 视觉、人体行为识别、视觉与语言推理等研究方向论文最多,属于最热门的方向,体现当前学界对视觉生成、三维感知、人机交互等方向的高度重视。另外,多模态学习、以人为本的设计和自适应机器人可能构成人形机器人的未来。
与 DeiT 等使用 ViT 和 Vision-Mamba (Vim) 方法的模型相比,ViL 的性能更胜一筹。
检索增强生成 (RAG) 是将检索模型与生成模型结合起来,以提高生成内容的质量和相关性的一种有效的方法。RAG 的核心思想是利用大量文档或知识库来获取相关信息。各种工具支持 RAG,包括 Langchain 和 LlamaIndex。
不久之前,Google DeepMind 发布了 AlphaFold3,再次引发了人们对「AI + 生命科学」的讨论。
教育行业的AI大模型学习机正在引起热议,多家公司纷纷推出搭载大模型的学习机产品,市场前景看好。
如何制服AI吞电兽?
大脑皮层、海马体、旁回:HippoRAG的三大神器
AI 高速率时代,硅光子迎成长机遇。
AI在智能可穿戴产品上的落地,既有挑战、同样也是机遇。
对于消费电子行业,AI显然是救星一般的存在。
公司旗下Talkie产品,已在Google Play下载排行榜上跻身前五。
AlphaFold3引起的浪潮下,一个新的抗体设计生成式AI大模型浮出水面。
OpenAI研究如何破解GPT-4思维,公开超级对齐团队工作,Ilya Sutskever也在作者名单之列。
奇绩创坛的路演日舞台上,第一次出现了模型产品首发
今年AI领域的热门词汇,非”AI原生应用”莫属。
今天,OpenAI发布了一篇GPT-4可解释性的论文,似乎是作为前两天员工联名信的回应。网友细看论文才发现,这居然是已经解散的「超级对齐」团队的「最后之作」。
一夜之间,全球最强开源模型再次易主。万众瞩目的Qwen2-72B一出世,火速杀进开源LLM排行榜第一,美国最强开源模型Llama3-70B直接被碾压!全球开发者粉丝狂欢:果然没白等。
斯坦福天才少女郭文景的Pika,在成立一年之际再获一笔8000万美元融资。团队成员也首次曝光,6位IOI金牌得主,包揽9块金牌。凭借超神的速度,这家公司的产品进化路线图震惊了一众硅谷大佬。AI视频将走向何方?Pika定会拿出新的惊喜。
在AI大模型上,谈一场完美恋爱?
面对生成式AI的崛起和沉浸式传播时代的到来,河南广电倾力打造了“大象元AI创作和应用平台”。
大模型领域,开源与闭源之争一直是技术和产业界关注的焦点。阿里云通义千问最新发布的Qwen2系列模型,为这场争论提供了最新的答案。
智能体的概念自去年底开始受到广泛关注,智能体的发展及其增长策略是当前讨论的热点。