導航:首頁 > 數據行情 > 爬蟲爬取股票歷史交易數據

爬蟲爬取股票歷史交易數據

發布時間：2023-11-30 20:43:41

⑴ 如何用python 爬蟲抓取金融數據

獲取數據是數據分析中必不可少的一部分，而網路爬蟲是是獲取數據的一個重要渠道之一。鑒於此，我拾起了Python這把利器，開啟了網路爬蟲之路。

本篇使用的版本為python3.5，意在抓取證券之星上當天所有A股數據。程序主要分為三個部分：網頁源碼的獲取、所需內容的提取、所得結果的整理。

一、網頁源碼的獲取

很多人喜歡用python爬蟲的原因之一就是它容易上手。只需以下幾行代碼既可抓取大部分網頁的源碼。

為了減少干擾，我先用正則表達式從整個頁面源碼中匹配出以上的主體部分，然後從主體部分中匹配出每隻股票的信息。代碼如下。

pattern=re.compile('<tbody[sS]*</tbody>')
body=re.findall(pattern,str(content)) #匹配<tbody和</tbody>之間的所有代碼pattern=re.compile('>(.*?)<')
stock_page=re.findall(pattern,body[0]) #匹配>和<之間的所有信息

其中compile方法為編譯匹配模式，findall方法用此匹配模式去匹配出所需信息，並以列表的方式返回。正則表達式的語法還挺多的，下面我只羅列所用到符號的含義。

語法說明

. 匹配任意除換行符「」外的字元

* 匹配前一個字元0次或無限次

？匹配前一個字元0次或一次

s 空白字元：[<空格> fv]

S 非空白字元：[^s]

[...] 字元集，對應的位置可以是字元集中任意字元

(...) 被括起來的表達式將作為分組，裡面一般為我們所需提取的內容

正則表達式的語法挺多的，也許有大牛隻要一句正則表達式就可提取我想提取的內容。在提取股票主體部分代碼時發現有人用xpath表達式提取顯得更簡潔一些，看來頁面解析也有很長的一段路要走。

三、所得結果的整理

通過非貪婪模式(.*?)匹配>和<之間的所有數據，會匹配出一些空白字元出來，所以我們採用如下代碼把空白字元移除。

stock_last=stock_total[:] #stock_total：匹配出的股票數據for data in stock_total: #stock_last：整理後的股票數據
if data=='':
stock_last.remove('')

最後，我們可以列印幾列數據看下效果，代碼如下

print('代碼',' ','簡稱',' ',' ','最新價',' ','漲跌幅',' ','漲跌額',' ','5分鍾漲幅')for i in range(0,len(stock_last),13): #網頁總共有13列數據
print(stock_last[i],' ',stock_last[i+1],' ',' ',stock_last[i+2],' ',' ',stock_last[i+3],' ',' ',stock_last[i+4],' ',' ',stock_last[i+5])

⑵ 如何快速取得股票交易歷史數據

以同花順股票軟體為例：首先切換到要下載數據的股票K線形態，按「F1」進入「日線某某股票歷史成交」，點擊滑鼠右鍵->數據導出->導出所有數據->在「請選擇導出的類型」中選擇excel或txt,,只有這二種格式可以選擇；選取好後點擊下一步，在「導入導出對話框模板」中選擇你要的項目（如最高價、最低價，開盤價等，默認是全選），點下一步，完成。默認保存路徑在桌面上。

⑶ 爬取股票信息是網路爬蟲的應用場景嗎

網路爬蟲可以用來爬取股票信息，因為股票信息可以在互聯網上搜索並獲取，網路爬蟲可以自動收集這些信息。網路爬蟲是一種自動地抓取互聯網信息的程序，能夠按照指定的規則自動地抓取網站上的信息，是一種常見的數據抓取技術。

⑷ 如何用爬蟲抓取股市數據並生成分析報表

1. 關於數據採集
股票數據是一種標准化的結構數據，是可以通過API介面訪問的（不過一般要通過渠道，開放的API有一定的局限性）。也可以通過爬蟲軟體進行採集，但是爬蟲軟體採集數據不能保證實時性，根據數據量和採集周期，可能要延遲幾十秒到幾分鍾不等。我們總結了一套專業的爬蟲技術解決方案(Ruby + Sidekiq)。能夠很快實現這個採集，也可以後台可視化調度任務。

2. 關於展現
網路股票數據的展現，網頁端直接通過HTML5技術就已經足夠，如果對界面要求高一點，可以採用集成前端框架，如Bootstrap；如果針對移動端開發，可以使用Ionic框架。

3. 關於觸發事件
如果是採用Ruby on Rails的開發框架的話，倒是很方便了，有如sidekiq, whenever這樣子的Gem直接實現任務管理和事件觸發。

⑸ 如何利用python抓取美股數據

一准備環境

1 安裝tushare模塊包。

pip install tushare

二注冊tushare賬號，獲取token（目前tushare pro版本必須有token值才能正常訪問）

訪問https://tushare.pro/register?reg=380388 tushare官網進行注冊，然後記錄token值備用。

三開始python編程

Python代碼：

import tushare as ts

#設置token

token='你自己的token'

pro = ts.pro_api(token)

#獲取002242.SZ日行數據

pa=pro.daily(ts_code='002242.SZ', start_date='20200701',end_date='20200716')

# 列印獲取數據

print(pa)

運行程序，可見如下列印，002242.SZ最近兩周的數據都在這里了。

⑹ Python 爬取同花順行業板塊日K線數據

最近一直想研究一下行業k線，找了很久，在同花順找到了獲取的url
比如，881129 通信設備板塊
http://d.10jqka.com.cn/v4/line/bk_881129/01/last.js 獲取日k線數據但是需要cookie不然只能訪問一次
（利用Google瀏覽器的右擊頁面檢查--Network 可以看到頁面請求的url）

⑺ 如何使用Python獲取股票分時成交數據

可以使用爬蟲來爬取數據，在寫個處理邏輯進行數據的整理。你可以詳細說明下你的需求，要爬取的網站等等。
希望我的回答對你有幫助

閱讀全文

與爬蟲爬取股票歷史交易數據相關的資料

熱點內容

股票賬戶內有80股的怎麼賣發布：2025-04-29 18:21:06 瀏覽：803

a股長期投資股票發布：2025-04-29 18:19:27 瀏覽：268

天津中星資產上市股票代碼發布：2025-04-29 18:15:01 瀏覽：50

哪個股票app可自己編輯公式發布：2025-04-29 18:14:16 瀏覽：551

資金轉不了股票裡面發布：2025-04-29 17:57:06 瀏覽：17

股票的資產負債率是高好還是低好發布：2025-04-29 17:49:27 瀏覽：340

新綸科技發行股票發布：2025-04-29 17:35:07 瀏覽：938

現買股票賺錢發布：2025-04-29 17:13:22 瀏覽：697

指南針股票軟體首頁打不開發布：2025-04-29 17:08:00 瀏覽：694

巴菲特投資的中國公司有哪些股票發布：2025-04-29 16:56:08 瀏覽：638

新中國第一支股票叫什麼發布：2025-04-29 16:50:50 瀏覽：459

我國公司發行股票的影響嗎發布：2025-04-29 16:35:46 瀏覽：972

股票質押式回購交易對股價影響發布：2025-04-29 16:31:54 瀏覽：624

證券結構化信託產品單一股票發布：2025-04-29 16:31:52 瀏覽：382

土耳其崩盤會影響股票嗎發布：2025-04-29 16:23:23 瀏覽：645

天箭科技股票前景分析發布：2025-04-29 16:18:56 瀏覽：501

中國茅台股票什麼時候發行的發布：2025-04-29 16:08:00 瀏覽：998

上市公司股票價格影響因素分析發布：2025-04-29 16:05:41 瀏覽：242

券商股對股票的影響發布：2025-04-29 15:56:24 瀏覽：55

邁得醫療這個股票發布：2025-04-29 15:55:59 瀏覽：21