国产成人精品18p,天天干成人网,无码专区狠狠躁天天躁,美女脱精光隐私扒开免费观看

Python中怎么PDF文件提取數據

發(fā)布時(shí)間：2021-07-10 17:40 來(lái)源：億速云閱讀：0 作者：Leah 欄目：編程語(yǔ)言歡迎投稿：712375056

這篇文章將為大家詳細講解有關(guān)Python中怎么PDF文件提取數據，文章內容質(zhì)量較高，因此小編分享給大家做個(gè)參考，希望大家閱讀完這篇文章后對相關(guān)知識有一定的了解。

示例：使用Python從PDF文件中提取一個(gè)表格

a) 將表復制到Excel并保存為table_1_raw.csv

數據以一維格式存儲，必須進(jìn)行重塑、清理和轉換。

b) 導入必要的庫

import pandas as pd import numpy as np

c) 導入原始數據，重新定義數據

df=pd.read_csv("table_1_raw.csv", header=None) df.values.shape df2=pd.DataFrame(df.values.reshape(25,10)) column_names=df2[0:1].values[0] df3=df2[1:] df3.columns = df2[0:1].values[0] df3.head()

d) 使用字符串處理工具進(jìn)行數據糾纏

我們從上面的表格中注意到，x5、x6和x7列是用百分比表示的，所以我們需要去掉percent(%)符號：

df4['x5']=list(map(lambda x: x[:-1], df4['x5'].values)) df4['x6']=list(map(lambda x: x[:-1], df4['x6'].values)) df4['x7']=list(map(lambda x: x[:-1], df4['x7'].values))

e) 將數據轉換為數字形式

我們注意到列x5、x6和x7的列值數據類(lèi)型為string，因此我們需要將它們轉換為數值數據，如下所示：

df4['x5']=[float(x) for x in df4['x5'].values] df4['x6']=[float(x) for x in df4['x6'].values] df4['x7']=[float(x) for x in df4['x7'].values]

f) 查看轉換數據的最終形式

df4.head(n=5)

g) 導出最終數據到一個(gè)csv文件

df4.to_csv('table_1_final.csv',index=False)

免責聲明：本站發(fā)布的內容（圖片、視頻和文字）以原創(chuàng )、來(lái)自本網(wǎng)站內容采集于網(wǎng)絡(luò )互聯(lián)網(wǎng)轉載等其它媒體和分享為主，內容觀(guān)點(diǎn)不代表本網(wǎng)站立場(chǎng)，如侵犯了原作者的版權，請告知一經(jīng)查實(shí)，將立刻刪除涉嫌侵權內容，聯(lián)系我們QQ:712375056，同時(shí)歡迎投稿傳遞力量。

上一篇新聞：
上一篇：Python中怎么實(shí)現文本分析
下一篇新聞：
下一篇：Python中怎么利用網(wǎng)絡(luò )爬蟲(chóng)獲取招聘信息

優(yōu)惠

云主機8折虛擬主機6折

紅包可用于（云服務(wù)器、高防服務(wù)器、裸金屬服務(wù)器、高防IP、云數據庫、CDN加速）購買(mǎi)和續費

領(lǐng)取優(yōu)惠卷

Copyright ? 2009-2022 56dr.com. All Rights Reserved. 特網(wǎng)科技特網(wǎng)云版權所有　特網(wǎng)科技　粵ICP備16109289號

域名注冊服務(wù)機構:阿里云計算有限公司（萬(wàn)網(wǎng)）域名服務(wù)機構：煙臺帝思普網(wǎng)絡(luò )科技有限公司（DNSPod） CDN服務(wù)：阿里云計算有限公司百度云中國互聯(lián)網(wǎng)舉報中心增值電信業(yè)務(wù)經(jīng)營(yíng)許可證B2

建議您使用Chrome、Firefox、Edge、IE10及以上版本和360等主流瀏覽器瀏覽本網(wǎng)站

QQ咨詢(xún)
請選擇客服進(jìn)行咨詢(xún)
微信咨詢(xún)
電話(huà)咨詢(xún)
請選擇客服進(jìn)行咨詢(xún)
- 0756-2113031
備案
工單
TOP

午夜夫妻试看120国产| 女人高潮抽搐30分钟| AAAAAA级特色特黄的毛片| 北条麻妃在线一区二区| 开心五月丁香花综合网| 国产精品久久久久电影院 |