[python]word转pdf、doc转docx、word转html

程序员文章站 2022-04-09 22:22:33

...

python Word文件转换为pdf文件（doc/docx文件转化为pdf文件）

# -*- encoding: utf-8 -*-
import  os
from win32com import client
#pip instatll win32com
def doc2pdf(doc_name, pdf_name):
    """
    :word文件转pdf
    :param doc_name word文件名称
    :param pdf_name 转换后pdf文件名称
    """
    try:
        word = client.DispatchEx("Word.Application")
        if os.path.exists(pdf_name):
            os.remove(pdf_name)
        worddoc = word.Documents.Open(doc_name,ReadOnly = 1)
        worddoc.SaveAs(pdf_name, FileFormat = 17)
        worddoc.Close()
        return pdf_name
    except:
        return 1
if __name__=='__main__':
    doc_name = "f:/test.doc"
    ftp_name = "f:/test.pdf"
    doc2pdf(doc_name, ftp_name)

python doc转docx

from win32com import client
def doc2docx(doc_name,docx_name):
    """
    :doc转docx
    """
    try:
        # 首先将doc转换成docx
        word = client.Dispatch("Word.Application")
        doc = word.Documents.Open(doc_name)
        #使用参数16表示将doc转换成docx
        doc.SaveAs(docx_name,16)
        doc.Close()
        word.Quit()
    except:
        pass
if __name__ == '__main__':
    doc2docx(f:test.doc','f:/test.docx')

python docx转html

#coding:utf-8
import docx
from docx2html import convert
import HTMLParser
def  docx2html(docx_name,new_name):
    """
    :docx转html
    """
    try:
        #读取word内容
        doc = docx.Document(docx_name,new_name)
        data = doc.paragraphs[0].text
        # 转换成html
        html_parser = HTMLParser.HTMLParser()
        #使用docx2html模块将docx文件转成html串，随后你想干嘛都行
        html = convert(new_name)
        #docx2html模块将中文进行了转义，需要将生成的字符串重新转义
        return html_parser.enescape(html)
    except:
        pass
if __name__ == '__main__':
    docx2html('f:/test.docx','f:/test1.docx')

相关标签： python word 转换 pdf html

上一篇： python操作PDF文件（转文本、图片）

下一篇：永久解决VSCode终端中文乱码问题

[python]word转pdf、doc转docx、word转html

java 中 word 转pdf 博客分类： java word pdf jcomjavapdfdoc转pdf

java 博客分类： java—word2html word2htmlword转htmlword html

将Word/Excel/PPT转换成Html/PDF/图片博客分类：文档转换与阅读文档转换在线阅读word转htmlhtml转office文档查看

Java 将Word转为PDF、PNG、SVG、RTF、XPS、TXT、XML 博客分类： Java Word javaSpire.Doc免费Word控件Word转PDFWord转图片

关于java中实现word转pdf

java实现pdf文件转word

java 实现word文件转pdf文件

word 转PDF 文件

java word操作通过字符串生成word文件，读取word内容，word转pdf、html，pdf流输出展示到页面,file转 MultipartFile

实现pdf转word

[python]word转pdf、doc转docx、word转html

java 中 word 转pdf 博客分类： java word pdf jcomjavapdfdoc转pdf

java 博客分类： java—word2html word2htmlword转htmlword html

将Word/Excel/PPT转换成Html/PDF/图片 博客分类： 文档转换与阅读 文档转换在线阅读word转htmlhtml转office文档查看

Java 将Word转为PDF、PNG、SVG、RTF、XPS、TXT、XML 博客分类： Java Word javaSpire.Doc免费Word控件Word转PDFWord转图片

关于java中实现word转pdf

java实现pdf文件转word

java 实现word文件转pdf文件

word 转PDF 文件

java word操作 通过字符串生成word文件，读取word内容，word转pdf、html，pdf流输出展示到页面,file转 MultipartFile

实现pdf转word

将Word/Excel/PPT转换成Html/PDF/图片博客分类：文档转换与阅读文档转换在线阅读word转htmlhtml转office文档查看

java word操作通过字符串生成word文件，读取word内容，word转pdf、html，pdf流输出展示到页面,file转 MultipartFile