微比恩 > 信息聚合 > 字节跳动最新文本生成图像 AI，训练集里居然没有一张带文字描述的图片？！

字节跳动最新文本生成图像 AI，训练集里居然没有一张带文字描述的图片？！

2022-03-23 21:36:35来源: IT之家

字节跳动最新文本生成图像 AI，训练集里居然没有一张带文字描述的图片？！

图片地址：https://img.ithome.com/newsuploadfiles/2022/3/a5f2538f-b006-41d3-8621-9f10c88ce3d4.jpg

一个文本-图像对数据都不用，也能让 AI 学会看文作图？来自字节的最新 text2image 模型，就做到了。实验数据显示，它的效果比 VQGAN-CLIP 要真实，尤其是泛化能力还比不少用大量文本-图像数据对训练出来的模型要好很多。嗯？不给文字注释 AI 怎么知道每一张图片代表什么？这个模型到底咋训练出来的？不用文字训练也能根据文本生成图像首先，之所以选择这样一种方式，作者表示，是因为收集大量带文字的图像数据集的成本太高了。而一旦摆脱对文本-图像对数据的需求，我们就可以直接用大型无文本图像数据集（比如 ImageNet）来训练强大且通用的 text2image 生成器。字节实现的这个模型叫做 CLIP-GEN，它具体是怎么操作的？一共分三大步。首先，对于一幅没有文本标签的图像，使用 CLIP 的图像编码器，在语言-视觉（language-vision）联合嵌入空间（embedding space）中提取图像的 em

关注公众号

标签：字节跳动 AI

提示：支持键盘“← →”键翻页

上一篇戴尔推出新款灵越 14 Pro 笔记本：搭载 12 代酷睿，5499 元起

下一篇《巫师》新作抛弃自家引擎改用虚幻 5，前 CDPR 员工：每次开发都推倒重来，换了更省事

赞

你的鼓励是对作者的最大支持

相关阅读

苹果因 AirPods Pro 耳机杂音问题在美国遭遇集体诉讼2024-11-14 03:38:23
2024Q3 苹果 iPad 在美国销售稳健：Pro 以 45% 主导、基础款占 33%、Air 占 13%、mini …2024-11-14 06:30:53
苹果更新 Mac / iPad 版 Final Cut Pro 视频编辑应用：引入 AI 功能、可编辑空间视频2024-11-14 07:19:07
AI 开始“卷”智能体：OpenAI 被曝明年将推 Operator，可控制电脑、独立执行任务2024-11-14 07:35:17
广汽传祺 S7 更多官图公布：配备 AI 情绪大灯，明日广州车展亮相2024-11-14 08:15:29
英伟达秀 Blackwell GPU 肌肉：训练 AI 模型速度比 Hopper H100 快 2.2 倍2024-11-14 08:33:16
Red Hat 收购 Neural Magic 并开源其技术：优化通用设备 AI 性能，可媲美专用芯片2024-11-14 09:15:26
Canalys：2024 年第三季度全球 AI PC 市场份额提高至 20%2024-11-14 09:58:26
应用来了！李彦宏发布两大“超级有用”AI技术！2024-11-13 19:15:30
AI如何赋能可持续发展？IBM 最新调研揭秘现状：企业投资热情不减，但行动尚未跟上2024-11-13 16:47:00

热门排行榜

1日1周1月

免费发布分类信息

最新图片