京公网安备 11010802034615号
经营许可证编号:京B2-20210330
分形理论在量化投资中的汇率预测应用
随着全球金融一体化的发展及国际间的资本流动加快的影响,国际金融市场变得越来越复杂,竟争日趋橄烈,而反映它变化的汇率越来越被人们所重视,因此对它所进行的研究也成为近几年十分热门的话题。
最新的研究指出,汇率变化是一个具有非线性特征的变化过程,而分形理论又线性理论中比较常用的理论之一同时,分形理论中的思维角度和计算方法都给金融问题提供了十分有效的解决方案,而对于汇率的研究也是这一领域中的一个重要分支,可见用分形理论来研究汇率问题是十分恰当的。
1、R/S分析方法简述
R/S分析(The Rescaled Range Analysis,重标极差分析)最初是由水纹专家H.E.Hurst在1951年提出来的,是最著名的分形分析方法之一。该方法主要通过R/S计算出该序列的H值,并根据H值来判断该序列的性质。
1)计算重标极差(R/S)
设一个时间序列Pt,观测次数为m,将其转换为长度为M=m-1的常用对数比率时间序列:Xt=lnPt-lnPt-1。将这个长度为M的时间序列{Xt}分成A个长度为N(2≤N≤L,L表示最长子区间的长度)的相邻子区间,使得A×N=M。用Iα代表每个子区间,其中α=1,2,…,A;将每个Iα上的Xt记为Xk,其中k = 1,2,…,N。设Ia上的{Xt}的均值为Xα,则有如下计算公式:
(1)
(2)
(3)
(4)
式(1)~(4)中:
N—子区间,Iα的长度。
Dk,α—子区间Ia的累积离差。
RI,a—子区间Ia的极差。
SI,α—第α个区间Ia的标准差。
(R/S)N—重标极差。
2)估计平均循环长度
所谓平均循环长度,指的就是时间序列具有“长期记忆”特性的长度。根据Peters(1994)的研究,可以借助V统计量来估计序列的平均循环长度,其计算公式为:
(5)
3)计算Hurst指数
因为(R/S)N=C×N H,所以将此式两边取对数得:
(6)
然后就将平均循环长度内的值及其相应的N值代入上式,用OLS求解H值。
4)计算R/S期望值
彼得斯(Peters)给出了高斯型序列的R/S期望值的计算公式:
(7)
将E(R/S) N和log N代入式(8),用OLS可得高斯型序列的H指数期望值E( H):
(8)
5)通过H值判断序列走势
Hurst指数和相应的时间序列分为3种类型:
(1)当H=0.5时,时间序列是随机游走的。序列中不同时间的值是随机的和不相关的,即现在不会影响将来。
(2)当0≤H≤0.5时,这是一种反持久性的时间序列,常被称为均值回复。如果一个序列在前一时期是向上走的,那么它在下一个时期多半是向下走的,反之亦然。这种反持久性的强度依赖于H离零有多近,越接近于零,这种时间序列就具有比随机序列更强的突变性或易变性。
(3)当0.5≤H≤1时,表明序列具有持续性,存在长期记忆性的特征。即前一个时期序列是向上(下)走的,那下一个时期将多半继续是向上(下)走的。趋势增为的强度或持久性随H接近于1而增加。
6)根据V(R/S)与V(E(R/S))统计量图
选出统计量的走势由上升转为下降或是保持不变的点,而这个点正是序列的长期记忆过程消失的临界点,这个点对应的N就是序列的平均循环长度。但如果图像中这样的临界点不是唯一的时候,可根据假设检验来选择出真正的临界点,具体计算如下:
(9)
(10)
(11)
其中,
其中,T为样本中所有的观测数目。在实际应用中,R2要达到多大才算模型通过了检验,没有绝对的标准,而是要根据实际情况而定,它只是说明所得到的一元线性回归方程的拟合程度。T检验是判断x变量是否是显著的,如果结果判断出x是不显著的,则可在已建立好的模型中去除这个变量;如果判断出x是显著的,那么在模型中就应保留该变量。对于多元线性回归模型,方程的总体线性关系是显著的,并不能说明每个解释变最对被解释变最的影响都是显著的,必须对每个解释变量进行显著性检验,以决定是否作为解释变量被保留在模型中。
由于Hurst指数遵循正态分布,因此需要将它为标准正态分布(即S统计量),然后选择一个置信度,通过假设检验来判断序列是否遵循随机游走。如果S统计量在域中,表明序列遵循随机游走,R/S分析结果是显著的,该点即真正的转折点;若不在域中,则表明序列并未显著偏离随机游走,R/S分析结果不显著。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据驱动决策的体系中,数据分析按照分析目的可分为描述性分析、诊断性分析、预测性分析与指导性分析四大类型。其中,诊断性分 ...
2026-09-01网络请求是Python爬虫开发、接口测试、数据拉取的核心基础功能,Python生态中主要依靠 urllib 和 requests 两大库实现HTTP请求操 ...
2026-09-01 很多数据分析师面对业务问题时,常常感到“知道要分析,却不知道用什么方法”。其实,数据分析并非无章可循——从三大基础范 ...
2026-09-01在数据库设计与业务数据维护中,自增ID是数据表最常用的主键字段,用于唯一标识每一条业务数据,正常状态下ID应保持连续递增。但 ...
2026-08-31在数理统计、数据分析、经济测算与日常量化评估中,平均值是刻画数据集中趋势、反映整体水平的基础核心指标。在实际应用中,最常 ...
2026-08-31在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-08-31在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28SQL是数据分析领域最基础、最核心的工具,承担着取数、清洗、统计、分层、归因的全流程工作。不同于单纯的语法练习,实战化SQL数 ...
2026-08-28 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-08-28随着新零售模式的快速普及,零售行业从传统的“货品驱动”全面转向“用户驱动”。门店交易数据、线上消费记录、浏览轨迹、复购频 ...
2026-08-27在数据分析、爬虫采集、接口开发、数据归档等场景中,JSON与CSV是两种使用率最高的数据存储格式。JSON为键值对结构化格式,适配 ...
2026-08-27 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-08-27在数据分析工作中,时间序列是最常见的数据类型之一,订单时间、日志时间、交易时段、统计周期等数据均离不开时间处理。原始数据 ...
2026-08-26在数据分析与数据预处理工作中,原始数据普遍存在录入错误、系统故障、偶然极值等问题,极易产生异常数据。异常数据会严重干扰数 ...
2026-08-26 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-08-26在数理统计与数据分析领域,多因素方差分析与线性回归模型是研究变量关系、因素影响、数据差异规律的两大核心工具。二者均属于经 ...
2026-08-25数据分析的核心价值不在于数据计算与图表制作,而在于清晰、精准、有逻辑地输出结论、支撑业务决策。日常数据分析报告普遍存在结 ...
2026-08-25 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-08-25平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24