注册一亩三分地论坛,查看更多干货!
您需要 登录 才可以下载或查看附件。没有帐号?注册账号 
x
需要做这么件事情:
把有links的html或者xml文件转成docx输出
找到了docx这样一个包,例子里面有写普通文字,image等功能,但是link不值得如何弄进去,尝试用普通html href这样的写法,失败了。出来的docx里面没有link,有一段乱的东西。
另外还有一个paradocx,更加是什么说明都没有, dono how to use it
恩,我知道可以直接用WORD打开html,然后save as, 但是我需要用python BeautifulSoup处理其他方面,而不是手工处理。
searched stackoverflow and found two posts that seem promising
http://stackoverflow.com/questio ... cument-using-python
http://stackoverflow.com/questio ... iles-docx-xlsx-pptx
但是我读不懂人家的解释
还找到了一个html to pdf的工具,但是安装失败,documentation还很少,读不懂
http://pypi.python.org/pypi/xhtml2pdf/
Error msg:
Create virtualenv for the project. This can be inside the project directory, but cannot be under version control:
virtualenv --distribute xhtml2pdfenv
New python executable in xhtml2pdfenv\Scripts\python.exe
Traceback (most recent call last):
File "C:\Python27\Scripts\virtualenv-script.py", line 9, in <module>
load_entry_point('virtualenv==1.7.1.2', 'console_scripts', 'virtualenv')()
File "C:\Python27\lib\site-packages\virtualenv.py", line 928, in main
never_download=options.never_download)
File "C:\Python27\lib\site-packages\virtualenv.py", line 1029, in create_environment
site_packages=site_packages, clear=clear))
File "C:\Python27\lib\site-packages\virtualenv.py", line 1399, in install_python
proc_stdout = proc_stdout.strip().decode("utf-8")
File "C:\Python27\lib\encodings\utf_8.py", line 16, in decode
return codecs.utf_8_decode(input, errors, True)
UnicodeDecodeError: 'utf8' codec can't decode byte 0xca in position 66: invalid continuation byte
|