目标:按照帮助手册中提供的指导(手册链接 https://www.yingdao.com/yddoc/language/zh-cn/%E5%B8%B8%E8%A7%81%E9%97%AE%E9%A2%98/%E7%BD%91%E9%A1%B5%E8%87%AA%E5%8A%A8%E5%8C%96%E5%B8%B8%E8%A7%81%E9%97%AE%E9%A2%98/%E7%BD%91%E9%A1%B5%E5%9B%BE%E6%96%87%E4%BF%9D%E5%AD%98%E4%B8%BAdocx%E6%96%87%E6%A1%A3.html?keywords=%E4%BF%9D%E5%AD%98%E6%96%87%E4%BB%B6 ),将 http://www.sinopecgroup.com/group/news_center/gsyw.shtml 网页的新闻详细内容逐条保存为本地doc文件。
过程:
代码:import pypandoc
pypandoc.convert_text(
web_element_attribute,
to="docx",
format="html",
outputfile=r"d:\临时\中石化动态\题目_web_loop_element.get_text().docx",
sandbox=False)
问题:1.调试的时候点击元素(web)没有反应,不弹出新闻的详情页面。
2.如何修改python代码才能按照各个新闻标题保存doc文件