想提取 word 97 到 2003 的.doc 文件的文本内容,但看了一圈只找到依赖于 antiword 、apache poi 、libreoffce 或者直接用 win32com 调用 msoffice 之类,有没有只需要装模块( windows 下离线使用)不用额外装其他软件的解决方法? 搜索了一下看见有一个 olefile 模块,但是需要自己研究 word 文件的文件结构,看了一下资料不但全英文还相当复杂搞不来。。。
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.