算法、系统和应用,三个视角全面读懂混合专家(MoE)
算法、系统和应用,三个视角全面读懂混合专家(MoE)LLM 很强,而为了实现 LLM 的可持续扩展,有必要找到并实现能提升其效率的方法,混合专家(MoE)就是这类方法的一大重要成员。
搜索
LLM 很强,而为了实现 LLM 的可持续扩展,有必要找到并实现能提升其效率的方法,混合专家(MoE)就是这类方法的一大重要成员。
具身智能是实现通用人工智能的必经之路,其核心是通过智能体与数字空间和物理世界的交互来完成复杂任务。
智谱大模型团队自研打造。
在 ChatGPT 走红之后,本着「打不过就加入」的心态,很多职场人学起了 AI。但遗憾的是,不少人走了弯路,甚至还被某些「199」的课程割了韭菜。
华盛顿大学和Allen AI最近发表的论文提出了一种新颖有趣的数据合成方法。他们发现,充分利用LLM的自回归特性,可以引导模型自动生成高质量的指令微调数据。
Llama 3.1 405B巨兽开源的同时,OpenAI又抢了一波风头。从现在起,每天200万训练token免费微调模型,截止到9月23日。
外媒爆料,英伟达将于明年推出一款专为中国市场定制的AI芯片,甚至还专研了一款与之搭配的服务器,这在英伟达历史上还是首次。
就在刚刚,谷歌DeepMind最新的数学模型捧得了IMO奥数银牌!它不仅以满分成绩做出了6道题中的4道,距离金牌只有1分之差,而且在第4题上只用了19秒,解题质量和速度惊呆了评分的人类评委。
OpenAI真来撼动谷歌的搜索帝国了?深夜悄悄上线的AI搜索引擎产品——SearchGPT,在同一问题的演示上,直接原地吊打谷歌和Perplexity。谷歌的AI Overview没做到的「重塑搜索引擎」,会让OpenAI达成吗?
北京时间 7 月 26 日凌晨,OpenAI 发布 AI 搜索产品 SearchGPT,GPT-4 系列模型驱动。
RNN每个step的隐状态都取决于上一个step的输出,这种连续的状态转移方式使得RNN天然带有位置信息。
40秒生成3D视频,Stability AI开源首个视频生视频模型。
想化解AI带来的压力,不妨先学会站到AI这边思考。
“灭霸”OpenAI,带着它的新产品,盯上了AI搜索的蛋糕。
每年需付微软40亿美元?
是助力,还是背刺?
OpenAI 的 AI 搜索有什么不一样
Transformer中的信息流动机制,被最新研究揭开了:
ICML 2024最佳论文出炉,结果发现其中一篇曾被ICLR 2024拒稿?
继分不清9.11和9.9哪个大以后,大模型又“集体失智”了!
OpenAI的最新AGI布局——5级路线图再被吐槽是营销手段,不仅对「超级智能」命名和定义存在模糊之处,5个级别的层次结构也被诟病「逻辑混乱」?
随着企业纷纷采用AI技术来自动筛选简历、评估面试,我们不禁会发出疑问:这些「AI招聘官」到底是铁面无私、一视同仁,还是携带偏见越走越远?
谷歌研究人员对200篇关于生成式AI滥用的新闻报道进行了研究,发现生成式AI造成的虚假信息正在互联网上泛滥成灾。但最讽刺的是,谷歌正是这些虚假信息的重要制造商之一。
紧跟着Meta的重磅发布,Mistral Large 2也带着权重一起上新了,而且参数量仅为Llama 3.1 405B的三分之一。不仅在编码、数学和多语言等专业领域可与SOTA模型直接竞争,还支持单节点部署。
9次迭代后,模型开始出现诡异乱码,直接原地崩溃!就在今天,牛津、剑桥等机构的一篇论文登上了Nature封面,称合成数据就像近亲繁殖,效果无异于投毒。有无破解之法?那就是——更多使用人类数据!
发利用于众多领域,诸如二次元、电商产品、游戏场景等,其生成图片的质量已经在多次迭代中得到了显著的提升。
AI爆发至今,业内普遍流行一句话:AIGC的尽头是AI智能体,但时至今日,大家对AI智能体的理解还比较浅,很多人依旧认为AI智能体离自己还很远。主要是市场上好用的智能体平台并不多。用户关心的是AI到底如何改善工作流,AI到底怎么落地具体的应用场景?或者AI到底是怎么帮我们干活的?
家人们!无需排队申请,快手可灵AI官宣即日起全面开放内测了。
横店,一个被竖屏短剧占领的地方,正在被AI分成两半。
在《三体》里,“智子”限制了人类底层科学的进步。