检测并重构固定格式文档中的东亚布局特征
摘要:
提供了东亚布局特征的检测和东亚布局特征的重构。固定格式文档中的垂直书写的文本被检测并旋转以供布局分析。在布局分析之后,经旋转的文本被旋转回去并在流格式文档中重构。当多个字符水平地被书写在文本的垂直行中时,垂直重叠文本串被检测,并分派作为垂直中的水平文本,并被重建为流格式文档中的垂直中的水平文本。文本的行被分析以寻找ruby行的属性,并被分派作为与ruby基础行中的对应文本相关联的ruby文本,并在流格式文档中被重建为ruby文本。在固定格式文档中的文本被分析用于特定东亚语言的检测,使得该语言的字体在流格式文档中被指定。
公开/授权文献
0/0