首页 > 解决方案 > 如何压缩熊猫数据框,其中行是月份,我试图将它们压缩成年?

问题描述

所以我有一个数据框

https://docs.google.com/spreadsheets/d/19ssG8bvkZKVDR6V5yU9fZVRJbJNfTTEYmWqLwmDwBa0/edit#gid=0

这是我的代码给出的输出。

这是代码:

from yahoofinancials import YahooFinancials
import pandas as pd
import datetime as datetime

df = pd.read_excel('C:/Users/User/Downloads/Div Tickers.xlsx', sheet_name='Sheet1')

tickers_list = df['Ticker'].tolist()
data = pd.DataFrame(columns=tickers_list)


yahoo_financials_ecommerce = YahooFinancials(data)

ecommerce_income_statement_data = yahoo_financials_ecommerce.get_financial_stmts('annual', 'income')

data = ecommerce_income_statement_data['incomeStatementHistory']

df_dict = dict()

for ticker in tickers_list:

    df_dict[ticker] = pd.concat([pd.DataFrame(data[ticker][x]) for x in range(len(data[ticker]))],
               sort=False, join='outer', axis=1)

df = pd.concat(df_dict, sort=True)

df_l = pd.DataFrame(df.stack())
df_l.reset_index(inplace=True)
df_l.columns = ['ticker', 'financials', 'date', 'value']

df_w = df_l.pivot_table(index=['date.year', 'financials'], columns='ticker', values='value')


export_excel = df_w.to_excel(r'C:/Users/User/Downloads/Income Statement Histories.xlsx', sheet_name="Sheet1", index= True)

我将如何将几个月压缩为几年,以便数据可以与去年同期相比?

标签: pythonpandasdataframefinance

解决方案


不确定,因为您没有向我们提供任何数据,但您可以使用以下代码将日期时间列更改为年份。第一位只是生成一些小数据:

from datetime import datetime, timedelta
from random import randint

df = pd.DataFrame({
    'dates': [datetime.today() - timedelta(randint(0, 1000)) for _ in range(50)]
})

print(df.head())

                       dates
0 2019-09-02 21:01:46.702300
1 2019-11-03 21:01:46.702329
2 2019-04-01 21:01:46.702338
3 2019-03-04 21:01:46.702345
4 2019-03-28 21:01:46.702351

重要的部分

df.dates.dt.to_period('Y')

0     2018
1     2018
2     2019
3     2018
4     2019
5     2020

推荐阅读