京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据能否终结老鼠仓时代
维克托·迈尔舍恩伯格在他的《大数据时代》一书中写道:“大数据时代最大的转变就是,放弃对因果关系的渴求,而取而代之关注相关关系。也就是说只要知道‘是什么’,而不需要知道‘为什么’。”
颇有些戏谑的是,“大数据”在中国证券市场上的应用,并不是在投资交易领域的应用,而是以“捕鼠”为开端,博时基金的马乐第一个被“捕鼠神器”逮住。
交易所在掌握了“大数据”利器后,意味着海量的交易数据被持续的跟踪和分析,用以发现“相关关系”。那么,基金经理“老鼠仓”时代是否就此宣告终结?
至少可以确定的是,以往案例中传统的、明目张胆的老鼠仓行为将在大数据面前无所遁形,并且会很快被侦测出来,这将大大提高老鼠仓的操作难度,减少老鼠仓行为的发生。但就此断言大数据将终结一切老鼠仓,亦为时尚早。
解密交易所“大数据”
一般而言,“大数据”是指不用随机分析法(抽样调查)这样的捷径,而采用“所有数据”的方法,对海量数据进行分析。“大数据”具有“4V”特点:Volume(大量)、Velocity(高速)、Variety(多样)、Value(价值)。
据悉,沪深交易所的大数据监测系统从建立到完善,已经有几年的时间。即在国内“大数据”概念还不太为人所知的时候,交易所已经走在前列,从国外引进了大数据技术。但由于这样的监测系统并不对外开放,所以在“马乐案”前,业界知之甚少。
即使到目前,交易所掌握的大数据工具,其模型和运作(计算)方式也依然只能被勾画出一个轮廓。相关信息显示,在交易所依法设立的证券交易监控系统中,上交所异动指标分为4大类、72项,敏感信息分为3级共11大类、154项;深交所则建立了9大报警指标体系,合计204个具体项目。
深交所总经理宋丽萍在2013年3月间的一次公开发言中亦透露,交易所有“几十人的监控室,设置了200多个指标用于监测估算”,这在相当程度上印证了上述监控系统参数设置的真实性。
马乐是如何“现形”的?
交易所的大数据工具昼夜不知疲倦的对海量交易数据进行分析和比对,这改变了以往发现老鼠仓“现形”的模式——在“前大数据时代”,大部分老鼠仓是通过“举报”被发现,交易所处于较为被动的角色。但进入“大数据时代”后,交易所则是通过主动的数据挖掘来发现老鼠仓。
马乐案即是交易所主动挖掘的结果。
深交所监管部门在日常监控时发现一个10亿元账户重仓的小盘股和马乐掌管的“博时精选”高度重合。进一步追查发现,一个3000万的账户亦是如此,交易所随即上报证监会并立案。
有数据分析专家向记者解析,交易所挖掘的数据就是交易数据,因此非常容易采集,这是很适合应用大数据工具的。在数据引用后,就进入“数据索引”或称“模型搭建”的阶段,通常将四个因素,即价格、成交量、时间、空间进行量化分析,整个数据处理过程是自动的,包括“自动关联、自动聚类、自动分类、自动重排”的快速计算。
具体而言,马乐“老鼠仓”的操作中,其频繁进出中小板和创业板个股,很容易被系统监测到与博时精选的“关联性”,系统也会自动将其账户归类。因此交易所只要进一步分析这些操作的时间差,就不难将“老鼠仓”抓获。
而到了这一阶段,交易数据层面的证据也已经相当确凿,再辅之对账户资金来源的调查,“老鼠仓”行为根本没有任何辩驳的空间。
老鼠仓时代已经终结了吗?
大数据工具的出现,意味着老鼠仓时代的终结吗?
从基金经理行为层面分析,老鼠仓此前之所以频繁发生,很重要的原因在于这种行为本身的违法成本过于低廉,在“低风险、高收益”的情况下,基金经理面临巨大的诱惑,有足够的动力进行违法违规行为。而大数据工具的存在,使得“老鼠仓”行为被发现的概率极大提高,导致违法成本巨幅增加,其震慑力不言而喻。
但就此断言“老鼠仓”时代已经终结,则或许过于绝对。
与真正意义上需要借助于“云计算”的“大数据”处理不同的是,目前业界所称的交易所“大数据”是对交易所一系列监察系统口语化的统称。有数据分析专家指,从这个层面上来说,交易所“大数据”实际上是一整套监测模型,其数据架构方式、数据计算比对的逻辑过程等是模型的核心,这套系统对传统的老鼠仓模式几乎是可以做到“见血封喉”,但不排除将来出现更“智慧”的违法者,“绕道”系统监测的领域,或者以更复杂的交易模式来躲过系统的监测,也未可知。因此只能说,大数据终结了以往“老鼠仓”的“草莽”时代,再以传统手法行事已行不通,但“后大数据时代”的猫鼠之战,或许只是刚刚开始。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05