AI资讯新闻榜单内容搜索-视频模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 视频模型
3 天上了两个 SOTA 模型,视频 Agent 们接得过来吗?

3 天上了两个 SOTA 模型,视频 Agent 们接得过来吗?

3 天上了两个 SOTA 模型,视频 Agent 们接得过来吗?

视频模型这个月很热闹。7 月 31 日,MiniMax H3 和字节跳动 Seedance 2.5 同日发布。3 天后,MiniMax H3 正式开源;8 月 7 日,Seedance 2.5 开放 api。模型越来越好了,但产品能把它用好吗?

来自主题: AI资讯
9236 点击    2026-08-14 16:39
实时视频版「Nano Banana」来了!京东开源160亿参数AI视频模型JoyAI-Video-Edit

实时视频版「Nano Banana」来了!京东开源160亿参数AI视频模型JoyAI-Video-Edit

实时视频版「Nano Banana」来了!京东开源160亿参数AI视频模型JoyAI-Video-Edit

新智元报道 这个 8 月,AI 视频赛道的军备竞赛又升级了。 字节跳动发布 Seedance 2.5,把单次视频生成时长从 15 秒翻倍到 30 秒。同一天 MiniMax H3 开源,价格只要闭源旗

来自主题: AI资讯
9962 点击    2026-08-07 13:54
何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

当下计算机视觉长期陷入“一任务一专用模型”内卷: 做深度估计要用DepthAnything,分割依赖SAM,人体姿态单独训练Sapiens,几何重建还得搭VGGT,各类网络骨干、解码器、损失函数完全割裂,研发与部署成本居高不下。

来自主题: AI技术研报
8656 点击    2026-08-07 09:10
刚刚,阿里悄悄上线了他们最新视频模型:Wan3.0【附10种神仙玩法】

刚刚,阿里悄悄上线了他们最新视频模型:Wan3.0【附10种神仙玩法】

刚刚,阿里悄悄上线了他们最新视频模型:Wan3.0【附10种神仙玩法】

昨天躺床上刷手机,突然看到阿里计划发布他们目前最新的生视频模型:Wan3.0。在千问创作PC端(c.qianwen.com)公测,逐步开放。并且,全能参考,相比sd的视频、文本、图片、音乐4个基础模态,Wan3.0还支持了网页链接、word等文档。

来自主题: AI资讯
9513 点击    2026-08-06 22:19
全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

这两天,AI圈百家争鸣。GPT-6曝光、DeepSeek V4 Flash公测、SD2.5发布、MiniMax多模态开源视频模型发布……

来自主题: AI资讯
10491 点击    2026-08-03 11:01
刚刚,即梦 Seedance 2.5来了!我狂测测测测...

刚刚,即梦 Seedance 2.5来了!我狂测测测测...

刚刚,即梦 Seedance 2.5来了!我狂测测测测...

就在刚刚,字节跳动正式发布了自研视频模型Seedance 2.5,而我们熟悉的「即梦AI」作为模型的官方体验入口也第一时间妥妥接入。贴心的我呢,也直接帮友友们把这次新模型最夯夯夯夯的能力都扒好了,咱先一睹为快——

来自主题: AI资讯
9156 点击    2026-07-31 15:54
从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

一个苹果从树上落下,今天的视频模型大多能生成一段「看起来正确」的运动:苹果向下、速度加快,最终落地。

来自主题: AI技术研报
6783 点击    2026-07-30 15:56
Xmax AI 发布 X2.0,把视频变成可以「玩」的界面

Xmax AI 发布 X2.0,把视频变成可以「玩」的界面

Xmax AI 发布 X2.0,把视频变成可以「玩」的界面

对着摄像头比了个手势,桌上凭空多了只企鹅

来自主题: AI资讯
9058 点击    2026-07-15 15:11
最适合机器人的视频基座模型,被中国团队开源了

最适合机器人的视频基座模型,被中国团队开源了

最适合机器人的视频基座模型,被中国团队开源了

蚂蚁灵波选择了后一条路:开源 LingBot-Video。这是一个面向具身智能的视频生成基座模型,也是一套专为机器人场景设计的 DiT 视频预训练范式。通用视频模型更多学习画面变化、镜头运动和视觉风格;LingBot-Video 则把重点放在动作、任务、交互和物理环境变化上,面向世界预测、动作理解和机器人训练构建视频生成基座。

来自主题: AI技术研报
8725 点击    2026-07-10 10:41