AI资讯新闻榜单内容搜索-生成模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 生成模型
实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

火山引擎今天上线了全新的语音模型—— 豆包音频生成模型 1.0(Seed-Audio 1.0)。

来自主题: AI产品测评
7990 点击    2026-06-24 10:29
完成数亿元新融资,影眸科技 Hyper3D 让 3D 生成进入“思考时代”

完成数亿元新融资,影眸科技 Hyper3D 让 3D 生成进入“思考时代”

完成数亿元新融资,影眸科技 Hyper3D 让 3D 生成进入“思考时代”

新模型上线首月,订阅用户与 ARR 的环比增速均超 400%。 文|王欣逸 编辑|张雨忻 2026 年开年来,3D 生成模型赛道相当热闹。 今年第一季度,影眸科技发布首个 3D 编辑模型 Rodin

来自主题: AI资讯
5877 点击    2026-06-23 10:24
刚刚,阿里HappyHorse1.1上线,我用它把国足送进世界杯

刚刚,阿里HappyHorse1.1上线,我用它把国足送进世界杯

刚刚,阿里HappyHorse1.1上线,我用它把国足送进世界杯

今天,阿里巴巴发布了其最新一代视频生成模型HappyHorse 1.1(快乐小马1.1)。阿里称,相比HappyHorse 1.1,这代模型在动态表现力、主体一致性、指令遵循、视觉质感和音频能力等维度有了一定提升。

来自主题: AI资讯
9010 点击    2026-06-22 20:15
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作

腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作

腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作

大语言模型的RL技术已日趋成熟,多模态生成模型的强化学习训练却仍在“各自为战”——图像扩散模型一套流程、视频生成另一套标准、VLM和LLM又有不同的技术栈。

来自主题: AI技术研报
7205 点击    2026-06-18 11:25
给音视频生成打草稿!复旦&腾讯提出Baton:首创语义蓝图指引,实现音画逻辑精准同步

给音视频生成打草稿!复旦&腾讯提出Baton:首创语义蓝图指引,实现音画逻辑精准同步

给音视频生成打草稿!复旦&腾讯提出Baton:首创语义蓝图指引,实现音画逻辑精准同步

当用户给出一句简单提示词时,当前的音视频生成模型往往已经能够生成具有不错质量的视听内容。然而,一旦提示词变得复杂,问题便开始暴露出来。

来自主题: AI技术研报
10060 点击    2026-06-16 09:54
一次三篇!李飞飞的空间智能公司,发论文了

一次三篇!李飞飞的空间智能公司,发论文了

一次三篇!李飞飞的空间智能公司,发论文了

今天,由李飞飞联合创立的空间智能公司 World Labs 在同一天发布了三篇技术论文!三篇论文分别由公司内部实习生主导完成,研究方向各异,但共享同一个核心命题:借助已在海量图片数据上训练成熟的 2D 生成模型,降低 3D 内容生成的难度门槛。

来自主题: AI资讯
10964 点击    2026-06-13 14:36
NEWTON:从「等物理涌现」到「请牛顿进工具箱」,Agent 驱动的视频生成新范式

NEWTON:从「等物理涌现」到「请牛顿进工具箱」,Agent 驱动的视频生成新范式

NEWTON:从「等物理涌现」到「请牛顿进工具箱」,Agent 驱动的视频生成新范式

近年来,视频生成模型发展迅猛。从 Sora、Veo、Kling 到一系列开源视频生成模型,文生视频已经逼近真实影像的观感 —— 画面清晰、镜头流畅、风格可控,一句话就能生成一段观感不错的视频。

来自主题: AI技术研报
9763 点击    2026-06-12 10:13
快手可灵提出VLM-as-Teacher:用测试时在线优化,让视频生成模型学会按规则推理

快手可灵提出VLM-as-Teacher:用测试时在线优化,让视频生成模型学会按规则推理

快手可灵提出VLM-as-Teacher:用测试时在线优化,让视频生成模型学会按规则推理

怎么让VGM学会按规则推理?过去主要有两条路。两条路,一个不动模型,一个只写文字,都没真正解决“执行”问题。为此,城大×快手可灵提出了第三条路:VLM-as-Teacher。

来自主题: AI技术研报
7866 点击    2026-06-06 09:51