chtml导出word文档

1.如何将html文件转换为word文件

第一步、打开网页后单击浏览器菜单栏的“文件”-->另存为，然后选择“网页，全部htm,html”格式；（如下图）：第二步、我们打开Word，然后选择Word菜单栏的“文件”-->打开，找到刚才保存文件的地方，选择打开（如：我这里打开“《Excel2003如何合并单元格》”这个页面）：步骤三、打开以后我们删除一些不需要的地方，比如：顶部和底部的，那些对于我们来说都没什么用，我们要主要就是要内容。

然后打开菜单栏的“表格”-->转换-->表格转换为文本，将一些文档中的表格一一去掉。最后步、修改了一下效果跟先前那个比起来是不是要好得多呀？我们将修改好的文档“另存为”或者“保存”普通的（.doc）格式就可以了。

2.怎样把html文件转换成word格式

首先，将 HTML 文件双击打开：

1. 在网页中， Ctrl-A, Ctrl-C，打开 word, Ctrl-V

2. 如果你用的 IE，在同一台机子又装了 Office，那你可以留意一下右键，或者上下左右的按钮，当中应该有个键是 "传送到 Word" （也有传送到 Excel ）的

3. 如果你只是想把网页撷取起来展示予人，那你可以考虑装个 Foxit, Primo PDF 之类的 "pdf 印表机" （这方法会是失真最少的）

3.如何利用openoffice读取word文档,并输出在页面上（HTML）

将Word转Html的原理是这样的：1、客户上传Word文档到服务器2、服务器调用OpenOffice程序打开上传的Word文档3、OpenOffice将Word文档另存为Html格式4、Over至此可见，这要求服务器端安装OpenOffice软件，其实也可以是MS Office，不过OpenOffice的优势是跨平台，你懂的。

恩，说明一下，本文的测试基于 MS Win7 Ultimate X64 系统。下面就是规规矩矩的实现。

1、下载OpenOffice,2、下载Jodconverter 这是一个开启OpenOffice进行格式转化的第三方jar包。3、泡杯热茶，等待下载。

4、安装OpenOffice，安装结束后，调用cmd，启动OpenOffice的一项服务：C:\Program Files (x86)\OpenOffice.org 3\program>soffice -headless -accept="socket,port=8100;urp;"5、打开eclipse6、喝杯热茶，等待eclipse打开。7、新建eclipse项目，导入Jodconverter/lib 下得jar包。

* commons-io * jodconverter * juh * jurt * ridl * slf4j-api * slf4j-jdk14 * unoil * xstream 8、Coding。查看代码package com.mzule.doc2html.util;import java.io.BufferedReader;import java.io.File;import java.io.FileInputStream;import java.io.FileNotFoundException;import java.io.IOException;import java.io.InputStreamReader;import java.net.ConnectException;import java.util.Date;import java.util.regex.Matcher;import java.util.regex.Pattern;import com.artofsolving.jodconverter.DocumentConverter;import com.artofsolving.jodconverter.openoffice.connection.OpenOfficeConnection;import com.artofsolving.jodconverter.openoffice.connection.SocketOpenOfficeConnection;import com.artofsolving.jodconverter.openoffice.converter.OpenOfficeDocumentConverter；/** * 将Word文档转换成html字符串的工具类 * * @author MZULE * */public class Doc2Html { public static void main(String[] args) { System.out .println(toHtmlString(new File("C:/test/test.doc"), "C:/test"））； } /** * 将word文档转换成html文档 * * @param docFile * 需要转换的word文档 * @param filepath * 转换之后html的存放路径 * @return 转换之后的html文件 */ public static File convert(File docFile, String filepath) { // 创建保存html的文件 File htmlFile = new File(filepath + "/" + new Date().getTime() + ".html"）； // 创建Openoffice连接 OpenOfficeConnection con = new SocketOpenOfficeConnection(8100); try { // 连接 con.connect(); } catch (ConnectException e) { System.out.println（"获取OpenOffice连接失败。

"）； e.printStackTrace（)； } // 创建转换器 DocumentConverter converter = new OpenOfficeDocumentConverter(con)； // 转换文档问html converter.convert(docFile, htmlFile)； // 关闭openoffice连接 con.disconnect(); return htmlFile； } /** * 将word转换成html文件，并且获取html文件代码。 * * @param docFile * 需要转换的文档 * @param filepath * 文档中图片的保存位置 * @return 转换成功的html代码 */ public static String toHtmlString(File docFile, String filepath) { // 转换word文档 File htmlFile = convert(docFile, filepath)； // 获取html文件流 StringBuffer htmlSb = new StringBuffer(); try { BufferedReader br = new BufferedReader(new InputStreamReader( new FileInputStream(htmlFile))); while (br.ready()) { htmlSb.append(br.readLine()); } br.close（)； // 删除临时文件 htmlFile.delete(); } catch (FileNotFoundException e) { e.printStackTrace(); } catch (IOException e) { e.printStackTrace(); } // HTML文件字符串 String htmlStr = htmlSb.toString（)； // 返回经过清洁的html文本 return clearFormat(htmlStr, filepath)； } /** * 清除一些不需要的html标记 * * @param htmlStr * 带有复杂html标记的html语句 * @return 去除了不需要html标记的语句 */ protected static String clearFormat(String htmlStr, String docImgPath) { // 获取body内容的正则 String bodyReg = "