京公网安备 11010802034615号
经营许可证编号:京B2-20210330
量化投资股票配对交易策略改进
本节依然以北京银行和华夏银行在2011年的股价走势作为比较配对交易策略的基础。
1)标准配对交易策略
标准交易模型在设置一个建仓阈值时建仓,然后等价差回到均值0处时再平仓,针对价差可能发生突变的情形,加入了一个止损策略:判断价差的绝对值是否大于3。因为从统计上讲,如果配对的两只股票保持协整关系,那么它们的价差绝对值大于3的概率小于0.3%。一旦出现价差绝对值大于3的情况,即可认为股票对原有的协整关系被破坏,应立即止损。
2)改进策略1:延后开仓策略
针对标准配对交易策略的不足,可以采用如下改进方式:等价差突破闹值后,反向回归穿越阐值时再建仓,称这种策略为延后开仓策略。延后开仓的好处在于一方面可以更加准确地判断出价差向均值回归的趋势;另一方面当价差出现单边走强的情形时,延后开仓策略不会发出建仓信号,从而可以避免一部分损失,提升配对交易的收益。
3)改进策略2:延后开仓+提前平仓策略
标准配对交易策略和改进策略1都是等价差回归到均值附近时再平仓,而实际交易中经常会发现价差虽然在向均值的方向回归,但没有回归到均值,而是在离均值一定距离处又掉头远离均值。为捕捉前期价差回归阶段的收益,可以采取提前平仓的策略,和延后开仓策略一起构成改进策略2,如图6-7所示。这里设置了两个阈值δ1和δ2,分别为建仓阈值和平仓阈值,配对交易在δ2而非均值处平仓。
图6-7 配对交易:延后开仓+提前平仓策略
4)3个策略模拟结果
我们使用以上基本配对交易及其两个改进策略,对北京银行和华夏银行2011年年度股价波动情况进行了回溯交易模拟。从图6-7中可以看出,2011年的大部分时间,北京银行和华夏银行的股价比围绕着以0.9为轴,正负5个百分点的波动区间运动。设定区间建仓阈值δ1为0.5,平仓阈值δ2为0.1,分别采用以上3种策略的收益率情况如表6-8所示。
表6-8 标准策略、延后开仓、提前平仓策略实证结果
通过该交易模型的模拟结果可以发现,延后开仓策略在股价比波动不是特别剧烈的情况下,尤其是只在一个阔值范围内反复波动的情况下,并不能有效增加收益。但是模拟结果只是后验结论,在真实股票波动套利过程中,阈值是预先设定的,股价走势图是后验结果,该策略在波动区间大于两个阈值的情况下能够有效增加套利收益。
提前平仓策略对于把握短期波动是有效的,但是实证和理论均表明,提前平仓策略对收益率增加的影响是负面的,尤其是当δ1/δ2>5时,人为增加了套利者判断的因素,对于模型执行的稳定性影响效果负面。
另一个影响收益率的重要因素是阈值δ1的选取。阈值δ1越小,触发交易的频率越高,在不考虑头寸因素的前提下,理论收益率越高。但是考虑到头寸因素,并非阈值δ1越小,总的资金收益率越高,因为要把总头寸分成若千等分头寸,在提高交易频率的同时,降低了总头寸的绝对收益。因此,总收益率与阈值δ1之间存在一个最优化问题。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据驱动决策的体系中,数据分析按照分析目的可分为描述性分析、诊断性分析、预测性分析与指导性分析四大类型。其中,诊断性分 ...
2026-09-01网络请求是Python爬虫开发、接口测试、数据拉取的核心基础功能,Python生态中主要依靠 urllib 和 requests 两大库实现HTTP请求操 ...
2026-09-01 很多数据分析师面对业务问题时,常常感到“知道要分析,却不知道用什么方法”。其实,数据分析并非无章可循——从三大基础范 ...
2026-09-01在数据库设计与业务数据维护中,自增ID是数据表最常用的主键字段,用于唯一标识每一条业务数据,正常状态下ID应保持连续递增。但 ...
2026-08-31在数理统计、数据分析、经济测算与日常量化评估中,平均值是刻画数据集中趋势、反映整体水平的基础核心指标。在实际应用中,最常 ...
2026-08-31在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-08-31在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28SQL是数据分析领域最基础、最核心的工具,承担着取数、清洗、统计、分层、归因的全流程工作。不同于单纯的语法练习,实战化SQL数 ...
2026-08-28 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-08-28随着新零售模式的快速普及,零售行业从传统的“货品驱动”全面转向“用户驱动”。门店交易数据、线上消费记录、浏览轨迹、复购频 ...
2026-08-27在数据分析、爬虫采集、接口开发、数据归档等场景中,JSON与CSV是两种使用率最高的数据存储格式。JSON为键值对结构化格式,适配 ...
2026-08-27 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-08-27在数据分析工作中,时间序列是最常见的数据类型之一,订单时间、日志时间、交易时段、统计周期等数据均离不开时间处理。原始数据 ...
2026-08-26在数据分析与数据预处理工作中,原始数据普遍存在录入错误、系统故障、偶然极值等问题,极易产生异常数据。异常数据会严重干扰数 ...
2026-08-26 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-08-26在数理统计与数据分析领域,多因素方差分析与线性回归模型是研究变量关系、因素影响、数据差异规律的两大核心工具。二者均属于经 ...
2026-08-25数据分析的核心价值不在于数据计算与图表制作,而在于清晰、精准、有逻辑地输出结论、支撑业务决策。日常数据分析报告普遍存在结 ...
2026-08-25 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-08-25平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24