AnyText多语言文字生成与编辑模型——让AI绘图自由添加精美文字

随着AIGC的爆火,图片生成技术得到飞速发展,当前AI生成的图片已达到真假难辨的高保真度。例如stable diffusion与midjourney为代表的文生图大模型。不过,当合成图片中出现文字内容时,现存的AI技术依然无法驾驭文字内容。因此,modescope提出了一种新型的文字生成方法,此方法称之为AnyTex。AnyTex可以支持中文、英语、日语、韩语等多语言的文字生成,还支持对输入图片中的文字内容进行编辑。

AnyText主要基于扩散(Diffusion)模型,包含两个核心模块:

隐空间辅助模块(Auxiliary Latent Module):隐空间辅助模块对三类辅助信息(字形、文字位置和掩码图像)进行编码并构建隐空间特征图像,用来辅助视觉文字的生成;

文本

最近更新

  1. TCP协议是安全的吗?

    2024-01-12 20:16:06       18 阅读
  2. 阿里云服务器执行yum,一直下载docker-ce-stable失败

    2024-01-12 20:16:06       19 阅读
  3. 【Python教程】压缩PDF文件大小

    2024-01-12 20:16:06       19 阅读
  4. 通过文章id递归查询所有评论(xml)

    2024-01-12 20:16:06       20 阅读

热门阅读

  1. Wine源码中添加新的DLL模块

    2024-01-12 20:16:06       41 阅读
  2. SpringBoot 配置文件

    2024-01-12 20:16:06       28 阅读
  3. Springboot 中接口服务重试机制

    2024-01-12 20:16:06       26 阅读
  4. 博客随手记

    2024-01-12 20:16:06       36 阅读
  5. List、Set、Map有什么区别?

    2024-01-12 20:16:06       27 阅读
  6. 【CS4495】Computer Vision

    2024-01-12 20:16:06       24 阅读
  7. ORACLE之rman备份恢复及故障处理

    2024-01-12 20:16:06       35 阅读