自动化工具word文档批量转html

发布时间:2025-01-03 06:20

将笔记转化为PPT或Word文档方便分享 #生活技巧# #学习技巧# #笔记整理策略#

企业有很多的科室,科室的每个人或多或少都会写一些文档,有些文档领导需要浏览,解决的办法是将编辑的文档打印出来,供领导浏览,或是为了节约企业成本,文档就在人与人这间或部门之间copy过来,copy过去。如果员工或领导不善于管理文档,就会造成有很多的版本,或者是在以后无法轻松的找到相关的文档。

所以企业专门找到一个人(文档管理员),让这个人负责文档的管理。而文档的管理的方式有两种形式,第一种是doc形式的(即word文档),第二种是分享形式的

对于第一种文档管理方式,只涉及到这个文档管理员,收集各部门的文档,将部门规划成一种如下图的形式:

然后在部门中再规划人员,如下图:

通过第一种形式,那么文档的管理也就解决了。只保存最新文档,对文档进行汇总等,如果领导需要什么文档的话,只需要让文档管理员打印并呈送就可以了。

但是领导或职员需要什么文档?领导也不是一台机器,没有过目不忘的本领,并不知道公司有什么文档?如果文档中有错字有谁来发现?所以为了解决这几个问题,需要实现文档的分享,也就是第二种文档管理方式。

解决思路是在局域网中建立一个网站,企业中的任何一个人都可以浏览公司的文档。通过这个网站,企业中的任何一个人也都知道本企业有什么文档,寻找资料也会方便些。

网站也很简单,只需要实现目录结构上的复制,部门对应部门,人员对应人员。再把doc转换成html,文档名称对应页面名称。然后再自动生成网站首页,这个网站也就做完了。

技术实现:
在这里只是大体介绍一下,如果需要了解技术详细的话,可以下载下面的源代码。

1.给定需要转换的目录(包含word文档的目录)和输出目录
2.读取目录中的所有word文档
3.将所有的word文章转换成Html文件,并将html文件保存到输出目录下对应的目录(即部门对应部门,人员对应人员),代码如下

public void ToHtml(string filePath) { this.FilePath = filePath; Word.Application word = new Word.Application(); Type wordType = word.GetType(); Word.Documents docs = word.Documents; Type docsType = docs.GetType(); Word.Document doc = (Word.Document)docsType.InvokeMember("Open", System.Reflection.BindingFlags.InvokeMethod, null, docs, new Object[] { (object)FilePath, true, true }); //打开word文档 Type docType = doc.GetType(); CreateDirectory(TargetDirectoryPath); //源目录对应目标目录 string strSaveFileName = TargetFilePath; //转换成目标文件路径 object saveFileName = (object)strSaveFileName; //另存为html,关闭文档并退出 docType.InvokeMember("SaveAs", System.Reflection.BindingFlags.InvokeMethod, null, doc, new object[] { saveFileName, Word.WdSaveFormat.wdFormatFilteredHTML }); docType.InvokeMember("Close", System.Reflection.BindingFlags.InvokeMethod, null, doc, null); wordType.InvokeMember("Quit", System.Reflection.BindingFlags.InvokeMethod, null, word, null); }

word转为html后,测试页面样式:

4.生成首页,并将首页保存到输出目录下。为使首页结构清晰,使用了jquery插件treeview。

public string ToHtmlStructure(DirectoryInfo directory) { FileInfo[] files = null; DirectoryInfo[] subDirs = null; files = directory.GetFiles("*.*"); _sb.AppendLine(AddUl()); foreach (FileInfo fi in files) { string relativelinks = Uri.EscapeUriString(fi.FullName.Replace(string.Format(@"{0}\", DirectoryPath), "").Replace('\', '/')); _sb.AppendLine(string.Format("<li><a href='{0}' target='_blank'>{1}</a></li>",relativelinks, fi.Name)); } subDirs = directory.GetDirectories(); foreach (DirectoryInfo dirInfo in subDirs) { _sb.AppendLine("<li>"); _sb.AppendLine(dirInfo.Name); ToHtmlStructure(dirInfo); _sb.AppendLine("</li>"); } _sb.AppendLine("</ul>"); return _sb.ToString(); }

生成的首页显示大体如下(非企业的文档,而是自己的文档):

开发环境:win7+vs2010+office2007

测试环境:win7+office2007

总结:
在开发这个工具时,最主要的还是word转html。而我使用的方式是com方法调用word的open,saveas,close和quit。这种方式会在word的最近浏览记录中留下信息,如下:

并且html的生成完全由word控制,生成的html的样式也完全由word控制。有的文章转换为html后,显得html内容不美观。我测试了一下,安装不同的office版本,office2003(无法转换高版本的文档),office2007,office2010,版本越高,转换后的html样式越好。

我也在网上寻找了word转html的控制方式(包括国内的、国外的),发现如果想完全控制转换,似乎是不可能的。当然也有doc转换工具,如google doc。不知道我这个观点对不对?

源代码下载:源码Convertor.rar

<script type="text/javascript"> </script><script type="text/javascript" src="http://pagead2.googlesyndication.com/pagead/show_ads.js"></script>

网址:自动化工具word文档批量转html https://www.yuejiaxmz.com/news/view/633226

相关内容

批量处理Word文档图片的终极指南
JS文档和Demo自动化生成工具
【转载】[VBS]去除WORD文档限制编辑
批量生成Word合同
Python办公自动化:解锁高效工作流程,掌握文档处理的艺术
如何通过Word文档AI生成PPT,提升工作效率的实用技巧
如何将Word文档设置为清洁版(word文档怎么设置成清洁版)
优化工作流程的自动化与数字化转型.docx
日程计划表Word文档
AI写作助手:海量模板,一键定制个性化文档

随便看看