企业有不少的科室,科室的每一个人或多或少都会写一些文档,有些文档领导须要浏览,解决的办法是将编辑的文档打印出来,供领导浏览,或是为了节约企业成本,文档就在人与人这间或部门之间copy过来,copy过去。若是员工或领导不善于管理文档,就会形成有不少的版本,或者是在之后没法轻松的找到相关的文档。html
因此企业专门找到一我的(文档管理员),让这我的负责文档的管理。而文档的管理的方式有两种形式,第一种是doc形式的(即word文档),第二种是分享形式的。jquery
对于第一种文档管理方式,只涉及到这个文档管理员,收集各部门的文档,将部门规划成一种以下图的形式:jquery插件
而后在部门中再规划人员,以下图:工具
经过第一种形式,那么文档的管理也就解决了。只保存最新文档,对文档进行汇总等,若是领导须要什么文档的话,只须要让文档管理员打印并呈送就能够了。测试
可是领导或职员须要什么文档?领导也不是一台机器,没有过目不忘的本领,并不知道公司有什么文档?若是文档中有错字有谁来发现?因此为了解决这几个问题,须要实现文档的分享,也就是第二种文档管理方式。网站
解决思路是在局域网中创建一个网站,企业中的任何一我的均可以浏览公司的文档。经过这个网站,企业中的任何一我的也都知道本企业有什么文档,寻找资料也会方便些。ui
网站也很简单,只须要实现目录结构上的复制,部门对应部门,人员对应人员。再把doc转换成html,文档名称对应页面名称。而后再自动生成网站首页,这个网站也就作完了。this
技术实现:
在这里只是大致介绍一下,若是须要了解技术详细的话,能够下载下面的源代码。google
1.给定须要转换的目录(包含word文档的目录)和输出目录
2.读取目录中的全部word文档
3.将全部的word文章转换成Html文件,并将html文件保存到输出目录下对应的目录(即部门对应部门,人员对应人员),代码以下spa
public void ToHtml(string filePath) { this.FilePath = filePath; Word.Application word = new Word.Application(); Type wordType = word.GetType(); Word.Documents docs = word.Documents; Type docsType = docs.GetType(); Word.Document doc = (Word.Document)docsType.InvokeMember("Open", System.Reflection.BindingFlags.InvokeMethod, null, docs, new Object[] { (object)FilePath, true, true }); //打开word文档 Type docType = doc.GetType(); CreateDirectory(TargetDirectoryPath); //源目录对应目标目录 string strSaveFileName = TargetFilePath; //转换成目标文件路径 object saveFileName = (object)strSaveFileName; //另存为html,关闭文档并退出 docType.InvokeMember("SaveAs", System.Reflection.BindingFlags.InvokeMethod, null, doc, new object[] { saveFileName, Word.WdSaveFormat.wdFormatFilteredHTML }); docType.InvokeMember("Close", System.Reflection.BindingFlags.InvokeMethod, null, doc, null); wordType.InvokeMember("Quit", System.Reflection.BindingFlags.InvokeMethod, null, word, null); }
word转为html后,测试页面样式:
4.生成首页,并将首页保存到输出目录下。为使首页结构清晰,使用了jquery插件treeview。
public string ToHtmlStructure(DirectoryInfo directory) { FileInfo[] files = null; DirectoryInfo[] subDirs = null; files = directory.GetFiles("*.*"); _sb.AppendLine(AddUl()); foreach (FileInfo fi in files) { string relativelinks = Uri.EscapeUriString(fi.FullName.Replace(string.Format(@"{0}\", DirectoryPath), "").Replace('\', '/')); _sb.AppendLine(string.Format("<li><a href='{0}' target='_blank'>{1}</a></li>",relativelinks, fi.Name)); } subDirs = directory.GetDirectories(); foreach (DirectoryInfo dirInfo in subDirs) { _sb.AppendLine("<li>"); _sb.AppendLine(dirInfo.Name); ToHtmlStructure(dirInfo); _sb.AppendLine("</li>"); } _sb.AppendLine("</ul>"); return _sb.ToString(); }
生成的首页显示大致以下(非企业的文档,而是本身的文档):
开发环境:win7+vs2010+office2007
测试环境:win7+office2007
总结:
在开发这个工具时,最主要的仍是word转html。而我使用的方式是com方法调用word的open,saveas,close和quit。这种方式会在word的最近浏览记录中留下信息,以下:
而且html的生成彻底由word控制,生成的html的样式也彻底由word控制。有的文章转换为html后,显得html内容不美观。我测试了一下,安装不一样的office版本,office2003(没法转换高版本的文档),office2007,office2010,版本越高,转换后的html样式越好。
我也在网上寻找了word转html的控制方式(包括国内的、国外的),发现若是想彻底控制转换,彷佛是不可能的。固然也有doc转换工具,如google doc。不知道我这个观点对不对?
源代码下载:源码Convertor.rar