「音乐界Sora」Udio来了:前DeepMind员工创业,比Suno可定制性更强
「音乐界Sora」Udio来了:前DeepMind员工创业,比Suno可定制性更强我们已经看到,AI 已经能够理解和生成文本、图像、视频,尽管各个产品目前能达到的准确性和审美水准还不相同
搜索
我们已经看到,AI 已经能够理解和生成文本、图像、视频,尽管各个产品目前能达到的准确性和审美水准还不相同
以神经网络为基础的深度学习技术已经在诸多应用领域取得了有效成果
通过这项技术,能使transformer大模型在有限的计算资源 条件下,处理无限长度的输入。
不久前,围绕人工智能(AI)发展,特斯拉首席执行官马斯克发出这样的预警
基于华为云平台研发的“健康小美”数智健管师,是一款基于大模型技术和海量医学知识、高质量健康大数据构建的智能健康管理机器人
2024年4月11日,美国专利商标局(USPTO)在联邦公报上发布了一份《美国专利商标局关于在实践中使用基于人工智能的工具的指南》。这是美国政府首次在人工智能辅助专利撰写和申请上予以明确表示可以,并进行进一步规范的官方表态。
正逢业务系统进行又一个智能化的版本改造,和阿里百度讯飞的解决方案同学有一些业务交流,对现在大模型能力还有我的个人应用整理一下。所以我也来盘一下我的高频场景,但是最后有趣的老妈 AI 应用,十分值得思考
AI大风起兮,字节跳动旗下的教育产品Gauth在海外飞扬。
2016 年,Google CEO 桑达尔·皮查伊在 I/O 开发者大会上豪情满怀地向全世界宣布: Google 已经成为了搜索的代名词,Alphabet 未来将成为一家 AI 优先的公司。
寻找下一块“屏幕”,这无疑是最近几年科技行业的一个热门赛道。随着个人计算机点燃了互联网,智能手机让移动互联网无处不在之后,这前后两次造富神话的出现,也让所有人都在期待下一次改变的到来。那么智能手机之后的下一代通用计算设备是什么?
今年,苹果宣布取消造车计划后,终于下定决心将更多精力分配至AI项目,刚发布不久的M3 MacBook Air和即将发布的iOS 18分别对应着苹果在AI PC和AI手机两个赛道的第一份答卷。
太平洋时间4月9日,谷歌、OpenAl、Mistral在24小时内,接连发布大模型重磅更新。
风格化图像生成,也常称为风格迁移,其目标是生成与参考图像风格一致的图像。
4 月 12 日,在上海市浦东新区科技和经济委员会指导下,由上海市浦东新区产业发展促进中心、上海市浦东新区投资促进二中心、上海陆家嘴(集团)有限公司主办,上海浦东科技创业中心、中国建设银行上海浦东分行、机器之心(上海)科技有限公司承办的 “AI+金融” 论坛在张江科学城・数智天地成功举办。
自从 2023 年 11 月 Grok 首次亮相以来,马斯克的 xAI 正在大模型领域不断取得进步,向 OpenAI 等先行者发起进攻。在 Grok-1 开源后不到一个月,xAI 的首个多模态模型就问世了。
用 Suno 十秒写歌,是不是已经很震撼?现在不仅如此,用最新的 AI 工具,我们还可以快速生成歌手唱歌 MV。
通过什么方式够实现通用人工智能? 近期由AGI House组织的一场主题演讲给出了解答。
人工智能模型在对话说服力方面表现如何?
全网爆火的世界首个AI程序员Devin,如今被爆出视频竟是作假?
液体都有“智能”、可编程了? 最近,一种被称为“智能"液体的多功能可编程的新型超材料——Metafluid,登上了Nature。
首个AI程序员,演示视频大幅度造假??? 不久之前震撼硅谷的Devin,再度震撼硅谷——但这次是被打假。
万众瞩目的ChatGPT版iPhone,终于面世了! 最近,铺天盖地都是对Ai Pin的讨论声。
AI和机器人专家的长远目标,是创造出具有一般具身智能的代理,它们能够像动物或人类一样,在物理世界中灵活、巧妙地行动
120秒超长AI视频模型来了!不但比Sora长,而且免费开源
新一代视觉生成范式「VAR: Visual Auto Regressive」视觉自回归来了
培养 AI 人才,要从娃娃抓起,这句话似乎越来越不像开玩笑了。 本周五,顶级学术会议 NeurIPS 开设高中生论文 Track 的消息引爆了人工智能社区
奥特曼接待了数百名 500 强公司的高管。 技术领先的 OpenAI,正在稳步推进大模型能力的落地。
自 2020 年神经辐射场 (Neural Radiance Field, NeRF) 提出以来,将隐式表达推上了一个新的高度。作为当前最前沿的技术之一
近,来自澳大利亚蒙纳士大学、蚂蚁集团、IBM 研究院等机构的研究人员探索了模型重编程 (model reprogramming) 在大语言模型 (LLMs) 上应用,并提出了一个全新的视角
为解决大模型(LLMs)在处理超长输入序列时遇到的内存限制问题,本文作者提出了一种新型架构:Infini-Transformer,它可以在有限内存条件下,让基于Transformer的大语言模型(LLMs)高效处理无限长的输入序列。实验结果表明:Infini-Transformer在长上下文语言建模任务上超越了基线模型,内存最高可节约114倍。