京公网安备 11010802034615号
经营许可证编号:京B2-20210330
在 DATA 步中用此语句对正创建的数据集中的变量给出新名字。 12.WINDOW 语句(窗口语句) 格式为∶WINDOW 窗口名 [选择项] [域……] [GROUP=组[域……]]……; 此语句可用来在显示管理、 交互行方式或非交互方式中创建用户使用的窗口。 这些窗口 可用来显示文字说明或接受输入的数据。 它们同样有命令行和信息行, 而且窗口名字也 出现 在窗口的左上角,在这些窗口内同样可以使用窗口命令和功能键。窗口选择项包括∶ ①COLOR=颜色 用来指明窗口的背景颜色。有下列关键词表明所选的颜色∶ WHITE(白) BLACK(黑) GREEN(绿) MAGENTA(洋红) RED(红) YELLOW(黄) CYSAN(青 兰) GRAY(灰) BLUE(蓝) BROWN(棕) PINK(粉红) ORANGE(桔黄)。 ②ROWS=规定窗口的行数; ③COLUMNS=规定窗口的列数; ④IROW=指明所显示窗口 的初始 行号;⑤ICOLUMN=指明所显示窗口的初始列号;⑥KEYS=指明包含该窗口功能键定义 的文件名。 下面举一个例子展示 WINDOW 语句和 DISPLAY 语句的结合使用方法。 DATA abc; DISPLAY star; WINDOW star COLOR=YELLOW OUTPUT; #5 @10 'Enter the number of the Programs' x=.; #7 @10 'd2p7.PRG ------ 7' STOP; #8 @10 'd2p8.PRG ------ 8' DATA a; SET abc; #9 @10 'Number' @20 x PROTECT=NO IF x=7 THEN %INCLUDE 'a:d2p7.prg'; #10 @10 'Press Enter to continue'; RUN; (程序的第1部分) (程序的第2部分) 此程序提交执行后,创建一个名为 star 的窗口,显示第3~
7行上单引号内的信息, 光 标停在 number 之后等待用户输入一个需要运行的程序编号。 若输入数字7后回车, 将 A 盘上 的程序 d2p7.prg 调入 SAS 系统并运行此程序。若用户希望将 d2p7.prg 调到 PGM 窗口 等修改后再 提交给 SAS 系统执行,需对倒数第2行进行如下修改∶ IF x=7 THEN DM "INCLUDE 'a:d2p7.prg' "; Ⅴ.用在 PROC 步的语句 1.PROC 语句(过程语句) 格式为∶PROC 过程名 [选择项]; 如∶PROC MEANS DATA=aa MAXDEC=3 MEAN; 2.VAR 语句(变量语句) 格式为∶VAR 变量名; 如∶VAR a b c; VAR x1-x10 y; 3.MODEL 语句(模型语句) 格式为∶MODEL 因变量=自变量/[选择项]; 如∶MODEL y=a b x1 x2; 4.WEIGHT 语句(权数语句) 格式为∶WEIGHT 变量名; 常用在这样的一些分析中∶同每个观测有联系的方差不等, 且权数变量的值与方差之倒 数成比例。 5.FREQ 语句(频数语句) 格式为∶FREQ 变量名;
变量为数值型的, 它的值表示这个观测出现的频数。 注意∶WEIGHT 变量给出的是观测 的 相应权数。 6.ID 语句 格式为∶ID 变量名; 其作用是识别观测,相当于用 1,2,3,……来给观测编号。 7.WHERE 语句 格式为∶WHERE 表达式; 在 SAS 系统引入观测到 PROC 步之前从一个 SAS 数据集中选择符合特殊条件的观测。 如∶ PROC PRINT DATA=nc; WHERE county IN ( 'Wake', 'Franklin', 'Dare' ); RUN; 此过程步输出关于 Wake、Franklin 和 Dare 县的观测。 8.CLASS 语句(分类语句) 格式为∶CLASS 变量名; 如∶CLASS a b c; 该语句被一些 SAS 过程用来识别分类变量,以便进行统计分析。 9.BY 语句 格式为∶BY 变量名; 如∶BY a b c; 当用户希望分组处理数据集时,应该将 SORT 过程和 BY 语句结合起来定义数据集被分 类的 次序。如∶PROC SORT; BY a b c; RUN; PROC MEANS; BY a b c; RUN; 若 a、b、c 分别有 2、3、4 个水平,且各水平组合下都有两次以上重复试验数据,则 上面 两个过程步提交执行后,将把整个数据集拆成 24 个子集分别求各变量的均数、标准差 等统计 量的值。 10.OUTPUT 语句(输出语句) 格式为∶OUTPUT [OUT=SAS 数据集名] [关键词=与关键词联系的输出变量名]……; 如∶ PROC MEANS; VAR x; OUTPUT OUT=aaa MEAN=meanx STD=sx; RUN; 这里,aaa 为将要输出的 SAS 数据集名,MEAN、STD 为 MEANS 过程中允许写的选择 项中的关键词 ,meanx、sx 是希望在输出结果中用这两个变量分别表示变量 x 的均数宏准差。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
指标体系是企业数字化分析、业务监控、经营决策的核心基础框架,是将零散数据转化为可衡量、可对比、可落地业务价值的关键体系。 ...
2026-10-08随着市场竞争日趋饱和,同质化低价竞争逐渐陷入内卷僵局,传统以价格、渠道、促销为核心的营销模式边际效益持续递减。在此背景下 ...
2026-10-08 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-10-08你有没有想过,手机里点外卖、刷社交软件、转一笔账,背后到底是谁在替你"记着账"? 答案其实很简单:数据库,以及跟它对话的那 ...
2026-10-07CDA数据分析师 出品 作者:李诗怡 一、数据分析四大思维 1. 对比思维:没有对比就没有分析 核心观点:单独一个数字没有意义,有 ...
2026-10-05Kimball 是方法,星型模型是它产出的形状。 很多人把"Kimball vs 星型模型"当成一道选择题——这本身就是个误会:Kimball 是动词 ...
2026-10-05写在开头 老板在微信上甩来一句: "帮我看下为什么销量跌了。" ” 你回工位,打开 SQL,开始写。查订单表、拉近三个月、按 ...
2026-10-03CDA数据分析师 出品 作者:李诗怡 1. 事实表 vs 维度表 对比维度 事实表 维度表 核心问题 记录“业务发生了什么事” 描述 ...
2026-10-02做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24