把Word转为简洁html的若干方法 清理 拷贝 word 垃圾 代码 ,word 转 html
来源:互联网 发布:知乎实现梦想后 编辑:程序博客网 时间:2024/05/01 20:53
把Word转为简洁html的若干方法 - 网页设计专栏
word可以直接另存为 htm,但即使是 另存为 html 也会有大量的废代码。以前我一般用 dreamweaver 的 clean up html 来处理,先处理 word 特有标签,然后删除一些 font,b,span 等。进一步,在 editplus 里面用正则进行处理,最后得到我想要的干净的html 代码。当然最完美的办法就是拷贝文字出来,自己用文本编辑器书写htm标签,:)
今天又看到lifehacker这几种word 2 clean htm方法:
1.使用这个HTML Tidy Library Project开源软件来处理。
2.微软官方站点也有个Office 2000 HTML Filter 2.0工具,可以用来处理掉word2000转html时出现的多余代码。
3.使用这个Word HTML Cleaner 在线工具来处理。只能处理word2000以下版本。
4.有人给出了正则表达式(其实,上面的各种软件也都是用正则来解决的)
删除不需要的标签
<[/]?(font|span|xml|[ovwxp]:w+)[^>]*?>
- replace any matches with the empty string
删除class,style...等不需要的属性
<([^>]*)(?:class|lang|style|size|face|[ovwxp]:w+)=(?:'[^']*'|""[^""]*""|[^>]+)([^>]*)>
- replace any matches with <$1$2>
详细解释在Clean Word HTML using Regular Expressions
- 把Word转为简洁html的若干方法 清理 拷贝 word 垃圾 代码 ,word 转 html
- 清除Word转html的垃圾代码
- 正则表达式去掉word转为html后的垃圾样式
- HTML转为word
- HTML转为word
- php实现将上传word文件转为html的方法
- 清理WORD生成的HTML的脚本
- .net 上传word 转为 html
- word转为html(poi)
- Word文件转为HTML文件
- word转html格式的方法
- 【word | html】word(doc | docx) 转 html
- java把word转html或txt
- java把word转html或txt
- php实现把html转word,doc
- Java把html转成word
- [转载]在HTML页面转为WORD保存
- javascript 将HTML转为 word,pdf
- 对等计算实践:基于 IP 多播的发现
- Java解析网络数据流的三种特殊方法
- JXTA开发以内容为中心的聊天软件项目
- 使用Java控制UDP协议
- JAVABean在Jsp中的作用范围(page,request,session,application)
- 把Word转为简洁html的若干方法 清理 拷贝 word 垃圾 代码 ,word 转 html
- 谈谈TCP和UDP的一些简单应用
- 如何用Java实现网络中国象棋室(二)
- 如何用Java实现网络中国象棋室(一)
- Java通讯程序一例
- Java Socket编程之四
- Java Socket编程之三
- Java Socket编程之五
- Java Socket编程之二