数据名称:上市公司客户优质程度
时间范围:2001—2025年
数据层级:上市公司—年度面板
核心指标:前五大客户中上市公司数量、占比及是否拥有优质客户
识别变量:stkcd、year
文件格式:DTA、XLSX、Python、Stata do
本目录包含原始数据、基本信息、计算结果及配套代码,数据用于上市公司相关实证研究。
二、原始数据与基本信息合并
上市公司客户优质程度原始数据.dta:原始计算数据文件,主要字段为 证券代码、证券简称、stkcd、year、客户排名、客户名称、客户是否上市公司、客户公司股票代码。
上市公司客户优质程度原始数据.xlsx:原始计算数据文件,主要字段为 证券代码、证券简称、stkcd、year、客户排名、客户名称、客户是否上市公司、客户公司股票代码、行业代码、行业名称、所属省份、所属省份代码。
行业代码/上市公司基本信息数据.dta:公司静态基本信息,主要用于按stkcd合并证券代码、简称、行业、上市日期、注册资本、成立日期和退市日期。
三、计算说明
【前五大客户中上市公司的数量】为同一stkcd-year内客户是否上市公司等于Y的观测数量。
【前五大客户中上市公司的数量占比】=前五大客户中上市公司的数量/5。
【是否拥有优质客户】前五大客户中上市公司数量大于0时取1,否则取0。
四、结果数据文件
共有 3 套结果数据文件(每套同时提供 .dta 与 .xlsx)。样本筛选步骤如下:
(1) 按原始代码完成指标计算并处理必要缺失观测;
(2) 未剔除金融ST未缩尾版本保留金融行业及ST/PT样本,剔除版本删除金融行业、ST/PT样本;
(3) 缩尾版本对核心连续指标按年份进行1%和99%缩尾。
编号 文件名称 说明
1 计算结果剔除金融ST未缩尾版本.dta 结果数据;对应同名xlsx文件。
2 计算结果剔除金融ST缩尾版本.dta 结果数据;对应同名xlsx文件。
3 计算结果未剔除金融ST未缩尾版本.dta 结果数据;对应同名xlsx文件。
五、变量说明
序号 变量名称 变量类型 变量说明
1 stkcd float 公司数字识别码
2 year float 年度
3 前五大客户中上市公司的数量 float 年度前五大客户中上市公司数量
4 前五大客户中上市公司的数量占比 float 上述数量除以5
5 是否拥有优质客户 float 至少拥有一家上市公司客户时为1
6 证券代码 str 证券代码
7 证券中文简称 str 基本信息中的证券中文简称
8 上市日期 str 首次上市日期
9 股票类型 str 股票类型
10 ABH股交叉码 str A/B/H股交叉代码
11 公司名称 str 公司全称
12 公司中文简称 str 公司中文简称
13 公司英文名称 str 公司英文名称
14 行业名称D str 行业小类名称
15 行业代码D str 行业小类代码
16 行业名称C str 行业中类名称
17 行业代码C str 行业中类代码
18 行业名称B str 行业大类名称
19 行业代码B str 行业大类代码
20 行业名称A str 行业门类名称
21 行业代码A str 行业门类代码
22 注册资本 float 注册资本
23 成立日期 str 公司成立日期
24 退市日期 str 退市日期
25 证券简称 str 证券简称
26 行业代码 str 行业分类代码
27 行业名称 str 行业分类名称
六、代码文件
文件名称 语言 说明
上市公司客户优质程度数据计算代码.do Stata 核心指标计算。
上市公司客户优质程度数据计算代码.py Python 核心指标计算。
上市公司客户优质程度数据评估代码.do Stata 独立运行的数据质量评估。
上市公司客户优质程度数据评估代码.py Python 独立运行的数据质量评估。
七、数据质量评估
评估结果存放于 数据质量评估报告_20260902 文件夹,运行日志为 评估日志_YYYYMMDD.log。
1 数据分布分析:描述统计、缺失率和字符频数。
2 分布图:直方图、箱线图、核密度图、散点矩阵及时间趋势图。
3 异常值检验:IQR、Z-score及异常占比。
4 逻辑合理性验证:面板连续性、重复键和取值范围。
5 稳健性测试:不同处理版本对比。
总评估结论表.csv汇总变量级判定。
八、参考文献
[1] 参考文献 - 企业数字化转型与商业信用供给_祁怀锦.pdf
上市公司客户优质程度2001-2025年含do-python代码和excel-dta格式数据.zip
(43.29 MB, 需要: RMB 32 元)


雷达卡



京公网安备 11010802022788号







