京公网安备 11010802034615号
经营许可证编号:京B2-20210330
在 DATA 步中用此语句对正创建的数据集中的变量给出新名字。 12.WINDOW 语句(窗口语句) 格式为∶WINDOW 窗口名 [选择项] [域……] [GROUP=组[域……]]……; 此语句可用来在显示管理、 交互行方式或非交互方式中创建用户使用的窗口。 这些窗口 可用来显示文字说明或接受输入的数据。 它们同样有命令行和信息行, 而且窗口名字也 出现 在窗口的左上角,在这些窗口内同样可以使用窗口命令和功能键。窗口选择项包括∶ ①COLOR=颜色 用来指明窗口的背景颜色。有下列关键词表明所选的颜色∶ WHITE(白) BLACK(黑) GREEN(绿) MAGENTA(洋红) RED(红) YELLOW(黄) CYSAN(青 兰) GRAY(灰) BLUE(蓝) BROWN(棕) PINK(粉红) ORANGE(桔黄)。 ②ROWS=规定窗口的行数; ③COLUMNS=规定窗口的列数; ④IROW=指明所显示窗口 的初始 行号;⑤ICOLUMN=指明所显示窗口的初始列号;⑥KEYS=指明包含该窗口功能键定义 的文件名。 下面举一个例子展示 WINDOW 语句和 DISPLAY 语句的结合使用方法。 DATA abc; DISPLAY star; WINDOW star COLOR=YELLOW OUTPUT; #5 @10 'Enter the number of the Programs' x=.; #7 @10 'd2p7.PRG ------ 7' STOP; #8 @10 'd2p8.PRG ------ 8' DATA a; SET abc; #9 @10 'Number' @20 x PROTECT=NO IF x=7 THEN %INCLUDE 'a:d2p7.prg'; #10 @10 'Press Enter to continue'; RUN; (程序的第1部分) (程序的第2部分) 此程序提交执行后,创建一个名为 star 的窗口,显示第3~
7行上单引号内的信息, 光 标停在 number 之后等待用户输入一个需要运行的程序编号。 若输入数字7后回车, 将 A 盘上 的程序 d2p7.prg 调入 SAS 系统并运行此程序。若用户希望将 d2p7.prg 调到 PGM 窗口 等修改后再 提交给 SAS 系统执行,需对倒数第2行进行如下修改∶ IF x=7 THEN DM "INCLUDE 'a:d2p7.prg' "; Ⅴ.用在 PROC 步的语句 1.PROC 语句(过程语句) 格式为∶PROC 过程名 [选择项]; 如∶PROC MEANS DATA=aa MAXDEC=3 MEAN; 2.VAR 语句(变量语句) 格式为∶VAR 变量名; 如∶VAR a b c; VAR x1-x10 y; 3.MODEL 语句(模型语句) 格式为∶MODEL 因变量=自变量/[选择项]; 如∶MODEL y=a b x1 x2; 4.WEIGHT 语句(权数语句) 格式为∶WEIGHT 变量名; 常用在这样的一些分析中∶同每个观测有联系的方差不等, 且权数变量的值与方差之倒 数成比例。 5.FREQ 语句(频数语句) 格式为∶FREQ 变量名;
变量为数值型的, 它的值表示这个观测出现的频数。 注意∶WEIGHT 变量给出的是观测 的 相应权数。 6.ID 语句 格式为∶ID 变量名; 其作用是识别观测,相当于用 1,2,3,……来给观测编号。 7.WHERE 语句 格式为∶WHERE 表达式; 在 SAS 系统引入观测到 PROC 步之前从一个 SAS 数据集中选择符合特殊条件的观测。 如∶ PROC PRINT DATA=nc; WHERE county IN ( 'Wake', 'Franklin', 'Dare' ); RUN; 此过程步输出关于 Wake、Franklin 和 Dare 县的观测。 8.CLASS 语句(分类语句) 格式为∶CLASS 变量名; 如∶CLASS a b c; 该语句被一些 SAS 过程用来识别分类变量,以便进行统计分析。 9.BY 语句 格式为∶BY 变量名; 如∶BY a b c; 当用户希望分组处理数据集时,应该将 SORT 过程和 BY 语句结合起来定义数据集被分 类的 次序。如∶PROC SORT; BY a b c; RUN; PROC MEANS; BY a b c; RUN; 若 a、b、c 分别有 2、3、4 个水平,且各水平组合下都有两次以上重复试验数据,则 上面 两个过程步提交执行后,将把整个数据集拆成 24 个子集分别求各变量的均数、标准差 等统计 量的值。 10.OUTPUT 语句(输出语句) 格式为∶OUTPUT [OUT=SAS 数据集名] [关键词=与关键词联系的输出变量名]……; 如∶ PROC MEANS; VAR x; OUTPUT OUT=aaa MEAN=meanx STD=sx; RUN; 这里,aaa 为将要输出的 SAS 数据集名,MEAN、STD 为 MEANS 过程中允许写的选择 项中的关键词 ,meanx、sx 是希望在输出结果中用这两个变量分别表示变量 x 的均数宏准差。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-08-24 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19在零售行业大数据分析与精细化运营领域,纸尿裤旁摆放啤酒是最经典、最具代表性的商业案例。两种看似毫无关联的商品,一个是婴幼 ...
2026-08-19 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-08-19在数据分析、业务监控、质量检测与风险管控工作中,数据波动性是衡量数据稳定性、业务健康度、结果可信度的核心依据。数据波动代 ...
2026-08-18很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当导致 ...
2026-08-18在数据分析、业务评价、产品评级、用户分层与综合决策场景中,单一指标往往无法全面、客观地评价事物整体水平。现实中的评价对象 ...
2026-08-18在数理统计、假设检验、数据分析与机器学习领域中,卡方分布(χ²分布)是继正态分布、t分布之后最重要的连续型概率分布之一。 ...
2026-08-17在Python数据清洗、文本校验、账号密码规则校验、脏数据过滤、字符串规整化处理中,正则表达式是最高效、最常用的文本匹配工具。 ...
2026-08-17 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-08-17手游行业具备用户迭代快、竞争激烈、用户粘性易流失的典型特征。随着新游持续上线、玩家审美升级、玩法疲劳等问题出现,存量用户 ...
2026-08-14在数字化产品运营、商业数据分析、业务增长管理中,零散的指标统计无法支撑系统性的业务决策。单一的点击率、转化率、销量数据只 ...
2026-08-14 很多数据分析师每天都在写SQL,但当被问到“数据查询语言(DQL)的本质是什么”“SELECT语句中各子句的书写顺序与实际执行顺 ...
2026-08-14在数据库数据分析、数据清洗、报表统计与业务查询场景中,日期时间是最高频、最核心的基础字段。数据库中存储的日期格式多样,包 ...
2026-08-13