AI资讯新闻榜单内容搜索-Image

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Image
DeepMind又损大将,AI总监Nando de Freitas离职,曾领导开发Gato、Genie

DeepMind又损大将,AI总监Nando de Freitas离职,曾领导开发Gato、Genie

DeepMind又损大将,AI总监Nando de Freitas离职,曾领导开发Gato、Genie

作为谷歌 DeepMind 机器学习团队的重量级人物,Nando de Freitas 曾共同领导开发出了 Imagen 2、Gato、Genie、Griffin、Lyria 等名噪一时的大模型产品。

来自主题: AI资讯
6217 点击    2024-09-15 14:37
李飞飞任CEO,空间智能公司World Labs亮相,全明星阵容曝光

李飞飞任CEO,空间智能公司World Labs亮相,全明星阵容曝光

李飞飞任CEO,空间智能公司World Labs亮相,全明星阵容曝光

World Labs 的创始团队中,有 ImageNet、NeRF、Style Transfer 和 Gaussian Splats 作者在列。

来自主题: AI资讯
4834 点击    2024-09-14 15:56
Imagen 3支持人物生成,人人可用!谷歌Gemini AI重大升级来了

Imagen 3支持人物生成,人人可用!谷歌Gemini AI重大升级来了

Imagen 3支持人物生成,人人可用!谷歌Gemini AI重大升级来了

时隔5个月,Imagen 3终于可以人人可用了,而且还能支持是生成人物图像。与此同时,谷歌宣布了Gemini AI的重大升级,全新AI定制助手Gems已经面向150多个国家推出。

来自主题: AI资讯
7913 点击    2024-08-30 20:59
一款值得收藏的实用 AI 工具:本地运行,免费无广告,支持 Win、Mac

一款值得收藏的实用 AI 工具:本地运行,免费无广告,支持 Win、Mac

一款值得收藏的实用 AI 工具:本地运行,免费无广告,支持 Win、Mac

Image-Matting(小宾AI抠图)是来自 GitHub 的一款免费、开源、无广告的,本地运行的基于 AI 的抠图应用。它简单好用,抠图效果好,目前支持 Windows、MacOS 等平台。

来自主题: AI资讯
8887 点击    2024-08-27 14:31
豆包大模型团队发布全新Detail Image Caption评估基准,提升VLM Caption评测可靠性

豆包大模型团队发布全新Detail Image Caption评估基准,提升VLM Caption评测可靠性

豆包大模型团队发布全新Detail Image Caption评估基准,提升VLM Caption评测可靠性

当前的视觉语言模型(VLM)主要通过 QA 问答形式进行性能评测,而缺乏对模型基础理解能力的评测,例如 detail image caption 性能的可靠评测手段。

来自主题: AI技术研报
9524 点击    2024-07-13 20:01
将图像自动文本化,图像描述质量更高、更准确了

将图像自动文本化,图像描述质量更高、更准确了

将图像自动文本化,图像描述质量更高、更准确了

在当今的多模态大模型的发展中,模型的性能和训练数据的质量关系十分紧密,可以说是 “数据赋予了模型的绝大多数能力”。

来自主题: AI技术研报
5423 点击    2024-06-28 11:28
字节豆包全新图像Tokenizer:生成图像最低只需32个token,最高提速410倍

字节豆包全新图像Tokenizer:生成图像最低只需32个token,最高提速410倍

字节豆包全新图像Tokenizer:生成图像最低只需32个token,最高提速410倍

在生成式模型的迅速发展中,Image Tokenization 扮演着一个很重要的角色,例如Diffusion依赖的VAE或者是Transformer依赖的VQGAN。这些Tokenizers会将图像编码至一个更为紧凑的隐空间(latent space),使得生成高分辨率图像更有效率。

来自主题: AI技术研报
9607 点击    2024-06-22 23:00
3D 版 SORA 来了!DreamTech 推出全球首个原生 3D-DiT 大模型 Direct3D

3D 版 SORA 来了!DreamTech 推出全球首个原生 3D-DiT 大模型 Direct3D

3D 版 SORA 来了!DreamTech 推出全球首个原生 3D-DiT 大模型 Direct3D

2024 年 5 月,DreamTech 官宣了其高质量 3D 生成大模型 Direct3D,并公开了相关学术论文 Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer。

来自主题: AI资讯
8716 点击    2024-06-17 19:23
AI首先替代的不是蓝领白领工作?

AI首先替代的不是蓝领白领工作?

AI首先替代的不是蓝领白领工作?

OpenAI在5月14日推出了新一代人工智能模型GPT-4o,支持文本、音频和图像的任意组合输入,并能够生成文本、音频和图像的任意组合输出。仅仅一天后,谷歌就在新一届I/O开发者大会上发布、更新了十多款产品,包括AI助手Project Astra、文生图模型Imagen3、对标Sora的文生视频模型Veo,以及备受瞩目的大模型Gemini 1.5 Pro的升级版。

来自主题: AI资讯
8595 点击    2024-06-11 15:15