现在买基金的人很多,我用Python写了个快速追踪基金的收益情况!所以说没有它做不了的事!

这个过程,阳哥写了一个自定义函数,如下:

# 获取单个基金的信息

def get_fund(fund_code,df_fund_info):

# 获取基金经理信息,以及开始管理该基金的日期

df_manager = pro.fund_manager(ts_code=fund_code)

df_manager = df_manager[df_manager[‘end_date’].isna()]

df_manager = df_manager.sort_values(‘begin_date’,ascending=True).head(1)

begin_date = df_manager[‘begin_date’].values[0] # 开始管理该基金的日期

df_manager = df_manager[[‘ts_code’, ‘name’, ‘gender’,‘begin_date’]]

df_manager.columns = [‘fund_code’, ‘manager_name’, ‘gender’,‘begin_date’]

# 合并

df_fund = pd.merge(df_manager,df_fund_info,how=‘left’,on=‘fund_code’)

return df_fund

假如你想获取易方达中小盘基金的信息,可以基于上面的自定义函数 get_fund ,使用如下的代码:

# 110011.OF,易方达中小盘

df_fund = get_fund(‘110011.OF’,df_fund_info)

df_fund

获取的信息如下:

图片

计算基金规模和收益情况

接下来,咱们还需要获取两个信息,基金规模和基金近几年的收益情况。

基金规模,可以从一个角度来观察该基金在市场上的受欢迎度,一般来说,规模较大的基金,说明该基金过往的表现应该还是可以的。不过这里也有两点需要注意:

  1. 基金过往业绩并不代表未来依然会如此;

  2. 基金规模小,并不一定说明该基金未来表现会不好。

除了基金规模,另一个咱们经常关注的,也是基金营销机构经常拿出来宣传的,就是基金的过往收益情况。

基金规模的计算公式如下:

基金规模亿元基金份额数量基金单位净值

在 tushare 中 基金份额数量由函数 fund_share 来获取,基金单位净值(unit_nav)数据由函数 fund_nav 来获取。

此外,在计算基金的过往年度收益时,也是基于其累计净值(accum_nav)来实现的。

因此,阳哥将基金规模获取过程和基金近几年收益情况计算合并在一个自定义函数里,代码如下:

# 获取单支基金的年度收益,基金规模等信息

def get_returns(fund_code,start_year):

df_fund_nav = pro.fund_nav(ts_code=fund_code)

df_fund_nav[‘date’] = pd.to_datetime(df_fund_nav[‘end_date’])

df_fund_nav = df_fund_nav.set_index(‘date’).sort_index()

years = df_fund_nav[‘accum_nav’].resample(‘AS’).sum().to_period(‘A’)

# 获取年度数据,类型为 pandas 的 period

years = years.index.tolist()

# 有些基金的开始日期晚于2018年,需要对齐列,补空白

year_list = [yr.year for yr in years if yr.year>=start_year]

# 将 period 时间数据转为 string 的年度数据

years = [str(yr.year) for yr in years]

df_yrs_index = pd.DataFrame()

for yr in years:

df_yr_index = df_fund_nav.loc[yr].tail(1)

df_yrs_index = df_yrs_index.append(df_yr_index)

df_yrs = df_fund_nav.head(1).append(df_yrs_index)

# 计算每年的收益率,即涨跌幅度

df_yrs[‘returns’] = df_yrs[‘accum_nav’].pct_change()

# 删除收益率为 NA 的行 (第1天有数据记录的日期)

df_yrs = df_yrs.dropna(subset=[‘returns’])

# 筛选自开始年份以来的数据

df_yrs = df_yrs.loc[str(start_year):]

df_yrs = df_yrs.reset_index()

df_yrs[‘year’] = df_yrs[‘date’].dt.year

# 透视表

df_yr_returns = pd.pivot_table(

df_yrs, index=[‘ts_code’],

values=[‘returns’], columns=[‘year’], fill_value=“”

)

# 将多层索引转变为单层索引

df_yr_returns = df_yr_returns[‘returns’]

df_yr_returns = df_yr_returns.reset_index()

df_yr_returns.columns.name = None

df_yr_returns = df_yr_returns.rename(columns={‘ts_code’:‘fund_code’})

# 基金份额

df_fund_share = pro.fund_share(ts_code=fund_code).head(1)

df_fund_share.columns = [‘fund_code’, ‘fd_share_date’, ‘fd_share’, ‘fund_type’, ‘market’]

# fd_share,单位是 万份

fd_share_date = df_fund_share[‘fd_share_date’].values[0] # 份额对应的日期

# 份额日期的净值数据

df_ann_nav = df_fund_nav.loc[fd_share_date:fd_share_date].sort_values(‘update_flag’,ascending=False).head(1)

df_ann_nav = df_ann_nav[[‘ts_code’, ‘accum_nav’,‘unit_nav’]]

df_ann_nav.columns = [‘fund_code’, ‘accum_nav’,‘unit_nav’]

# 计算基金规模,amount,单位:亿元

df_fund_amount = pd.merge(df_fund_share,df_ann_nav,how=‘left’,on=‘fund_code’)

df_fund_amount[‘amount’] = df_fund_amount[‘fd_share’] * df_fund_amount[‘unit_nav’]/10000

df_fund_amount = df_fund_amount[[‘fund_code’,‘amount’,‘fd_share_date’]]

# 合并数据

df_yr_returns = pd.merge(df_fund_amount,df_yr_returns,how=‘left’,on=‘fund_code’)

for yr in year_list:

if yr not in df_yr_returns.columns.tolist():

df_yr_returns[yr]=np.nan

return df_yr_returns

假如你想获取易方达中小盘基金的2018年以来的收益情况信息,可以基于上面的自定义函数 get_returns ,使用如下的代码:

df_return = get_returns(‘110011.OF’,2018)

df_return

获取的信息如下:

同时获取多只基金的信息

上面已经实现了获取单只基金所需要的信息,接下来,咱们需要拼接之前获取的信息。

同时,我们一般会同时关注多只基金,因此同时获取多只基金的信息,也是基本必备的需求。

实现的代码如下:

# 获取多只基金的信息

def get_data_fund(df_fund_info,fund_code_short,code_exception,start_year):

df_filter_info = pd.DataFrame()

for code in fund_code_short:

df_tmp = df_fund_info[df_fund_info[‘fund_code’].str.contains(code)].head(1)

df_filter_info = df_filter_info.append(df_tmp)

df_filter_info = df_filter_info.reset_index(drop=True)

fund_codes = df_filter_info[‘fund_code’].tolist()

# fund_codes

df = pd.DataFrame()

for code in fund_codes:

if code in code_exception:

code_update = code[:-2]+‘OF’

code_short = code[:-3]

df_fund = get_fund(code_update,df_fund_info)

df_fund[‘fund_code’] = code

df_fund = df_fund[[‘fund_code’,‘manager_name’,‘gender’,‘begin_date’]]

df_fund = df_fund.dropna(axis=1) # 删除含 NaN 的列

test_m = df_fund_info[df_fund_info[‘fund_code’].str.contains(code_short)]

df_fund = pd.merge(df_fund,test_m,how=‘left’,on=‘fund_code’)

else:

df_fund = get_fund(code,df_fund_info)

df_return = get_returns(code,start_year)

df_fund_merge = pd.merge(df_fund,df_return,how=‘left’,on=‘fund_code’)

df = df.append(df_fund_merge)

df = df.reset_index(drop=True)

df = df.rename(columns={

‘fund_code’:‘基金代码’,‘manager_name’:‘基金经理’,

‘gender’:‘性别’,‘begin_date’:‘上任日期’,

‘fund_name’:‘基金名称’,‘management’:‘基金公司’,

‘m_fee’:‘管理费’,‘c_fee’:‘托管费’,

‘found_date’:‘成立时间’,‘amount’:‘基金规模(亿元)’,

‘fd_share_date’:‘规模对应日期’

})

# 调整列的排序

cols = df.columns.tolist()

col_1 = cols[:4]

col_2 = cols[4:5]

col_3 = cols[5:]

cols = col_2 + col_1 + col_3

df = df[cols]

return df

上面的自定义函数 get_data_fund 中,存在一些特列,我也进行了调整。

这个特列,主要是有一类基金,叫做LOF基金,场内和场外的数字代码是一样的,比如谢治宇的兴全合润基金,在tushare中,场内的完整代码是163406.SZ,场外的完整代码是163406.OF,对于LOF基金,我们只需要获取一个的信息即可。

同时,由于LOF基金获取信息是基金基础信息和基金经理信息用的代码有些区别,需要分开应用。因此,需要在上面的函数 get_data_fund 中进行区别,并且引入一个 code_exception 参数。

在上面的函数 get_data_fund 中,还对最后显示的列的顺序也进行了调整,该过程的实现的详细内容,可以在下面的链接中来了解:

基于自定义函数 get_data_fund,设置好函数所需要的参数后,就可以获取多只基金的信息了,具体参数如下:

# 需要获取的基金代码简称列表

fund_code_short = [‘000772’, ‘003095’,‘166005’,‘320007’,

‘163406’,‘260101’,‘161005’,‘162605’,

‘163402’,‘005827’,‘110022’,‘110011’,

‘164908’,‘000800’,‘590008’,

‘360007’,‘118001’,

‘519736’,‘007119’,‘002190’,‘005911’,

‘001938’,‘166002’,‘377240’

]

# [‘200011’,‘690003’,‘200010’,]

# 特列:LOF 基金,基金经理和管理费等费用所用的代码两处不一致,需要调整

# 输入的是 LOF 基金在场内的完整代码

code_exception = [‘163406.SZ’,‘160632.SZ’,‘160222.SZ’,‘159843.SZ’,‘515920.SH’]

# 设置基金收益开始的年份

start_year = 2018

# 设置基金收益截止的年份

end_year = 2021

year_list = list(range(start_year,end_year+1))

df_fund_final = get_data_fund(df_fund_info,fund_code_short,code_exception,start_year)

df_fund_final

得到的结果如下:

图片

Pandas 中,可以通过 Style 对表格样式进行设置,对收益情况进行红涨绿跌的设置。

代码如下:

def color_returns(val):

if val >=0:

最后

不知道你们用的什么环境,我一般都是用的Python3.6环境和pycharm解释器,没有软件,或者没有资料,没人解答问题,都可以免费领取(包括今天的代码),过几天我还会做个视频教程出来,有需要也可以领取~

给大家准备的学习资料包括但不限于:

Python 环境、pycharm编辑器/永久激活/翻译插件

python 零基础视频教程

Python 界面开发实战教程

Python 爬虫实战教程

Python 数据分析实战教程

python 游戏开发实战教程

Python 电子书100本

Python 学习路线规划

网上学习资料一大堆,但如果学到的知识不成体系,遇到问题时只是浅尝辄止,不再深入研究,那么很难做到真正的技术提升。

需要这份系统化学习资料的朋友,可以戳这里无偿获取

一个人可以走的很快,但一群人才能走的更远!不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人,都欢迎加入我们的的圈子(技术交流、学习资源、职场吐槽、大厂内推、面试辅导),让我们一起学习成长!

  • 18
    点赞
  • 13
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值