溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

Python如何將爬取的圖片寫入world文檔

發(fā)布時間:2021-07-26 11:34:54 來源:億速云 閱讀:140 作者:小新 欄目:開發(fā)技術

小編給大家分享一下Python如何將爬取的圖片寫入world文檔,相信大部分人都還不怎么了解,因此分享這篇文章給大家參考一下,希望大家閱讀完這篇文章后大有收獲,下面讓我們一起去了解一下吧!

無論是爬取文字還是圖片,都可以游刃有余的做到,但是爬蟲所爬取的內容往往不是單獨的圖片或者文字,于是我就想是否可以將圖文保存至world文檔里,一開始使用了如下方法保存圖片:

 with open('123.doc','wb')as file:
  file.write(response.content)
  file.close()

結果就是,world文檔里出現了一堆亂碼,此法不同,我就開始另尋他法,找了很久也沒有找到,只找到了關于Python操作world的方法。

于是我就開始了新的思路:使用原來的方法將圖片保存下來,再將圖片添加到world文檔里,最后將圖片刪除。這里使用的是python-dox庫,代碼如下:

import requests
from bs4 import BeautifulSoup
import os
import docx
from docx import Document
from docx.shared import Inches

url = 'https://www.qiushibaike.com/article/119757360'
html = requests.get(url).content
soup = BeautifulSoup(html,'html.parser')
wen = soup.find('div',{"class":"content"}).text
img = str(soup.find('div',{"class":"thumb"})).split('src="')[1].split('"/')[0]
tu = 'https:' + img
img_name = img.split('/')[-1]

#保存圖片至本地
with open(img_name,'wb')as f:
 response = requests.get(tu).content
 f.write(response)
 f.close()

document = Document()
document.add_paragraph(wen)#向文檔里添加文字
document.add_picture(img_name)#向文檔里添加圖片
document.save('tuwen.doc')#保存文檔
os.remove(img_name)#刪除保存在本地的圖片

最后,還是實現了將圖文保存在了world文檔里,盡管方法有些笨……

以上是“Python如何將爬取的圖片寫入world文檔”這篇文章的所有內容,感謝各位的閱讀!相信大家都有了一定的了解,希望分享的內容對大家有所幫助,如果還想學習更多知識,歡迎關注億速云行業(yè)資訊頻道!

向AI問一下細節(jié)

免責聲明:本站發(fā)布的內容(圖片、視頻和文字)以原創(chuàng)、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI