• •      •    660 浏览    •   2022-12-19 08:54:25

    2.2 变化率 

    变化率是描述原值变化快慢的衍生序列。 通俗地看,变化率可以简单地用时间序列原值在单位时间内的变化差值来表示,变化率C可以这样计算: ci=(xi-xi-l)/l 当l=1时就是原值的差分序列, ..
  • •      •    659 浏览    •   2022-10-17 08:24:43

    9.8 用制表符作为分隔符拆分字符串 

    用制表符作为分隔符,将字符串拆分为字符串序列。 把日志文件整理成结构化数据(以 USERID,UNAME,IP,TIME,URL,BROWSER,LOCATION, MODULE 为字段的序表 ..
  • •      •    2 回帖   658 浏览    •   2023-09-13 09:37:03

    一个月内连续三天涨停的股票 

    问题 下面是某证券交易所一个月内的日收盘价记录,其中 CODE 列为股票代码,DT 为日期,CL 为收盘价。 [图片] 试找出这个月内曾连续三天涨停的股票。为避免四舍五入产生的误差,涨停的比率 ..
  • •      •    657 浏览    •   2023-01-01 08:15:32

    4.2 多维联合 

    4.2.1 数据标准化 多维时间序列中各维度的量纲可能不同,计算距离前需要将各维度标准化到同样的量纲条件下,这种将不同量纲的数据转换成统一量纲的数据转换方法称为数据标准化。统计学有很多种数据标 ..
  • •      •    656 浏览    •   2023-11-21 13:17:29

    9.7 简单数据去重 

    有如下数据: [图片] 去除其中的重复数据: =spl('=?1.id()',A2:A17)   [图片] https://c.raqsoft.com.cn/article/164930182 ..
  • •      •    2 回帖   653 浏览    •   2023-08-31 08:52:34

    万年历 

    问题 请给出未来指定的某年(如 2020)的全年日历。使用字符串输出,仿照常见日历的格式,按年月分隔,包含日期和星期信息。 思路 大致思路:循环十二个月,首先计算月标题和星期标题添加到万年历, ..
  • •      •    2 回帖   651 浏览    •   2023-11-22 22:07:21

    15.3 字符串拆分 - 多字符分隔 

    有多字符分隔的串,按分隔符“and”把原串拆分成多个串 [图片] 代码: =spl('=?1.split(''and'')',A1) 函数 split 将字符串拆分为序列,参数 'and' 作 ..
  • •      •    651 浏览    •   2023-11-20 17:30:17

    4.21 汇总文件 - 相同行列 

    业务上有时候需要在合并多个 Excel 的同时汇总数据,比如: Apple.xlsx [图片] Bread.xlsx [图片] Pork.xlsx [图片] 现需要将 Amount 汇总起来, ..
  • •      •    648 浏览    •   2024-06-11 09:00:07

    7.3 预测 

    有了初始化类心,将其传入kmeans方法中,就能得到各生产路线的类心。当有新的收率数据Y需要确定类别(生产路线)时,只需确定Y中每个成员到哪个类心最近,该成员就属于哪一类。 过程如下: 预测数 ..
  • •      •    648 浏览    •   2022-07-10 23:38:52

    8.2 OBV(能量潮) 

    OBV 指标又称为能量潮,也叫成交量净额指标,是通过累计每日的需求量和供给量并予以数字化,制成趋势线,然后配合证券价格趋势图,从价格变动与成交量增减的关系,来推测市场气氛的一种技术指标。 OB ..
  • •      •    648 浏览    •   2023-11-21 12:56:30

    6.11 筛选时用到分类汇总值 

    现有分类产品销售额汇总表如下所示: [图片] 请找出销售额大于所在分类平均销售额的产品: =spl('=E(?1).group(CategoryName).(a=~.avg(ProductSa ..
  • •      •    647 浏览    •   2024-06-12 08:59:40

    7.4 层次 kmeans 聚类 

    有工业经验表明,重要度高的出料划分生产路线时所起的作用更大,为了体现这一作用,我们尝试了层次kmeans聚类,即按出料的重要度分层次进行kmeans聚类,过程如下: 1. 将所有出料数据X在初 ..
  • •      •    646 浏览    •   2023-01-19 21:25:29

    伪自变量的识别 

    在建模数据中经常遇到这样一种变量,其本身是受因变量影响的(即它不但不是因变量的影响因素,反而因变量是它的影响因素),若该变量被作为自变量添加入模型,则会造成其他自变量不能进入模型。同时,由于这 ..
  • •      •    646 浏览    •   2022-09-25 08:52:50

    偏最小二乘法拟合 

    偏最小二乘回归提供一种多对多线性回归建模方法,特别当两组变量的个数很多,且都存在多重相关性,而观测数据的样本量又较少时,用偏最小二乘法回归建立的模型具有传统的经典回归分析等方法多没有的有点。 ..
  • •      •    646 浏览    •   2023-11-21 12:54:09

    6.6 查找满足条件的行 

    有 2022 年 1 月的日销售额统计表如下所示: [图片] 找出日销售额大于 1000 的日销售数据: =spl('=E(?1).select(Sales>1000)',A1:B32) ..
  • •      •    644 浏览    •   2022-10-08 23:24:05

    分类变量平滑化 

    使用A.smooth(T)或P.smooth(cn, T)函数,可以将变量做平滑化处理,经过平滑化处理后可以消除映射成整数后数值大小的影响。 例如还是上一小节中的“Ticket”变量,对其做平 ..
  • •      •    3 回帖   643 浏览    •   2023-11-21 13:08:53

    7.15 生成分类内编号 

    有如下学生数据: [图片] 给所有学生编学号,要求 班级编号 + 班级内的序号,其中班级内的序号两位数(在 C1 中计算): =spl('=E(?1).group(Class).(~.(Cla ..
  • •      •    3 回帖   642 浏览    •   2023-09-28 08:45:48

    为报表显示将数据分栏输出 

    问题 这应该算是一个报表处理需求,举这个例子的目的是为了说明集算器灵活自由的运算系统,即使对于很不规则的报表处理需求,往往也能胜任。 问题很简单,将下面的 Names 表改成 3 列显示,分别 ..
  • •      •    2 回帖   641 浏览    •   2023-09-26 19:04:33

    向量的索引 

    在SPL中可以通过位置引用向量元素 A 1 [7,9,6,23,56,1] 2 =A1(3) 3 =A1.to(2) 4 =A1.to(3,5) 5 =A1.to(3,) 6 =A1.m(-2 ..
  • •      •    640 浏览    •   2022-10-17 23:17:52

    自动纠偏函数 

    纠偏,就是通过各种数学转换,使得变量的分布呈现或者近似正态分布,模型的拟合常常会有明显的提升。在SPL提供了自动纠偏函数,可以根据数据特点选择合适的纠偏变换进行纠偏。 A.corskew()和 ..
  • •      •    639 浏览    •   2023-01-16 21:55:45

    使用相关系数选择变量 

    相关系数是度量两个变量之间相关程度的统计量,常用的有Pearson相关系数和Spearman相关系数,两者值均在[-1,1]之间分布,当其值为0时两个变量不想关,当其值为1或-1时,表示两个变 ..
  • •      •    639 浏览    •   2022-07-24 10:54:45

    1.14 分组:组内筛选前 N 名 / 后 N 名 

    使用 group() 函数分组,将分组子集保留下来,再对分组子集进行聚合运算。这种运算方式的优点是分组子集可以保留下来,如果需要对分组子集重复使用,或者进行一些复杂的运算,可以采用此方式。 在 ..
  • •      •    639 浏览    •   2022-06-15 09:39:15

    4.2 CCI 顺势指标 

    CCI 指标是美国股市技术分析家唐纳德·蓝伯特 (Donald Lambert) 于 20 世纪 80 年代提出的,专门测量股价、外汇或者贵金属交易是否已超出常态分布范围。波动于正无穷大和负无 ..
  • •      •    638 浏览    •   2022-10-27 21:19:28

    K-means 聚类填补 

    K-means聚类又称为快速聚类,是一种需要事先确定类别个数的聚类方法。使用K-means聚类可以将全部样本分成若干个组,如果假定包含缺失值的变量在不同分组具有不同的取值,则可以使用该变量非缺 ..
  • •      •    638 浏览    •   2022-07-01 09:01:29

    6.1 相对市场波动率 

    过去 N 日, 股票相对市场指数的收益波动率, 相对收益波动率越大, 股票相对全市场越容易走出不同走势。 计算方法: 相对市场波动率 =(股票涨幅 - 市场涨幅)的 N 日标准差 * sqrt ..
关注乾学院公众号