外包一个小活儿,需要将 word 的 docx 文档的文字识别出来。

2021 年 3 月 6 日
 buptrobin
要求:
用 Python
能把章节号也给识别出来,即
原来的格式有 1,1.2 之类的,转换出来的文字也要有。
1720 次点击
所在节点    外包
9 条回复
musi
2021 年 3 月 6 日
怎么联系
gulumogu
2021 年 3 月 6 日
联系方式发一下
ilucyx
2021 年 3 月 6 日
@buptrobin 联系我 telegram `@lwbroxjq`
antpi
2021 年 3 月 6 日
YW50eDIwMDYwMQ==
buptrobin
2021 年 3 月 7 日
PDF 如果能准确率高的也行。
就是文字都能识别,而且,章节号也能识别出来,也能知道是章节号。
buptrobin
2021 年 3 月 7 日
@gulumogu YnVwdHJvYmlu
buptrobin
2021 年 3 月 7 日
@musi YnVwdHJvYmlu
bruceche11
2021 年 3 月 10 日
还需要吗?
buptrobin
2021 年 8 月 3 日
@bruceche11 需要 wx:YnVwdHJvYmlu

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/759108

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX