在自然图像中生成模拟数据,用于本加利文本本地化
Sourav Saha1, Md Easin Arafat2, Md Aminul Haque Palash3,4
1Department of Computer Science and Engineering, United International University, United City, Madani Avenue, Badda, Dhaka 1212, Bangladesh.
Data in brief
|October 12, 2023
概括
本研究介绍了一种新的场景文本编辑系统,用于基于视觉的应用程序,创建现实的图像修改. 开发的数据集有助于研究人员评估数字图像编辑和内容创建的动态特性.
科学领域:
- 计算机视觉 计算机视觉
- 数字图像处理 数字图像处理
- 人工智能的人工智能
背景情况:
- 基于视觉的应用程序中的文本对于传递信息至关重要.
- 场景文本编辑系统修改图像中的文本,同时保持视觉完整性.
- 在编辑过程中保持背景上下文和字体风格是具有挑战性的.
研究的目的:
- 介绍一个用于场景文本编辑的系统.
- 引入一个全面的数据集来评估图像中的文本编辑.
- 促进研究数字图像编辑的动态特征.
主要方法:
- 该系统使用诸如2D模拟文本,文本图像,掩盖和风格图像等组件.
- 创建了一个数据集,包含各种背景图像,字体和文本内容.
- 开发了一个由49000个随机生成图像组成的合成数据集.
主要成果:
- 该系统解决了场景文本编辑方面的挑战.
- 为研究人员和从业人员提供了丰富的数据集.
- 该数据集可以评估图像编辑中的动态特征.
结论:
- 开发的数据集是推动场景文本编辑研究的宝贵资源.
- 该系统和数据集支持数字图像编辑,广告和内容开发中的应用.
- 数据集的公开可访问性促进了该领域的进一步创新.
相关概念视频
Improving Translational Accuracy
2.6K
2.6K
Sampling Theorem
354
In signal processing, the analysis of continuous-time signals, denoted as x(t), often involves sampling techniques to convert these signals into discrete-time signals. This process is essential for digital representation and manipulation. A critical component in sampling is the train of impulses, characterized by the sampling interval and the sampling frequency. The relationship between these parameters and the original signal's properties dictates the success of the sampling process.
354


