kdb q介绍

Q起源

Kx systems公司的创始人之一Arthur Whitney在2003年研发了列式数据库KDB和它的操作语言q。q也可以写成Q。设计之初,q语言要做到简洁,高效和富表达性。

q的起源受到多种语言的启示。包括APL、LISP和函数式编程。

APL是一个向量语言,所以Q也具有向量语言的一些特点:

  • 处理大批量数据时非常快
  • 处理数据的基本单元 - 列表

Q不只于此,q在处理关系型数据时也非常快。q支持SQL 92标准,并在这个基础上加上了一些特有的sql特性和丰富的内置函数。

LISP语言处理的数据是通过list这种形式,q同样是通过list的形式。另外q还拥有许多函数式编程的特点。虽然q并不完全是一个函数式编程语言,但函数编程之于q,相当于面向对象之于Java/C#。

Q特点

Q设计的时候,考虑到现有数据处理系统的弊端。事实上我们现在涉及数据处理的系统,面临着非常复杂的数据转化过程。例如:

  • 从对象转到数据库表
  • 从对象转到网络传输模型(xml)
  • 各种各样的类

。q的出现能够较好的解决这些问题。Q的设计思想与之前所学的大部分语言是如此的不同,以至于我们在这里有必要让大家先调整好思维方式再去查看语法细节。如果用一句话来描述q的特点,它是.....。许多各种各样的特点

  • 内存内的数据库:理解KDB的一种方式就是KDB是一个内存数据库,但拥有磁盘可持久化能力。
  • 解释性语言 :开发周期更短
  • 列表是有顺序的 :不同于数据库中的行,因为列表有序,所以数据表也有序
  • 从右往左解析 
  • 面向表
  • 面向列:关系型数据库按行处理数据和存储数据,kdb是按列存数据,对数据进行运算也是直接作用在列向量上。
  • 强类型
  • Null值拥有特殊含义 
  • 内置I/O的支持 

数学复习课

q语言和数据的相关性太紧密了,以至于我在这里有必要复习一下一些基本的数据函数知识。实际上,绝大部分的q结构和操作都可以理解为方法映射。

对于一个函数,其输入值组成的域称为domain,值域称为range。通常我们有两种方式来描述算法/方法。一是公式法,可以写成

f(x) = x2 

另外一个是图形表示

I O
0 0
1 1
2 4
3 9

 其中I是输入,O是输出。  

根据函数参数数量的不同,我们又将函数分成几类:

  • monadic:只有一个参数
  • dyadic:有两个参数
  • nildic:没有参数

如果一个g的值域是f的domain,那么这个函数组合可以写成f(g(x))。

(在下文中,我们称数学函数为map/mapping,称q方法为function。

简单操作

从官方网站下载试用版本后,解压相应的文件到安装目录,例如在windows上推荐解压到c盘。

然后打开命令窗口,切换到如下目录,并执行q。

变量: 与其他语言相似,变量也是用于存储和表示数据的地方。在q中,变量的声明和赋值在一个语句中完成。变量的赋值符,并不是=,而是:q变量必须以字母开头,可包含字母,_和数字。 

命名规则推荐:

          使用动词表示操作符和方法,使用名词表示数据 

          使用较为简洁的名字。Use contexts for namespacing.

q的专业编写人员总是会省略掉很多不必要的空格。但这并不一定是强制的要求,我们可以在提高可读性的情况下,加入一些空格。比较推荐加空格的地方包括,逗号,分号和juxpositon后面。

注释

在q里面,语言的注释是通过/来完成的。另外注释符和表达式之间需要一个空格来分割。

变量类型

q的变量其实并不带类型信息。类型信息附属在变量的那种之上。

语言解析顺序

初次使用q的人,肯定会被他的解析顺序所迷惑。例如下面这样的表达式,对于其他语言的使用者来说肯定是前所未闻的:

q) 1+a:43

44

q将表达式从右向左解析。所以这个表达式可以理解为 将43赋值给a,再将a加上1,最后向console 打印结果。在q中,表达式是允许一个刚刚被赋值的变量参与运算的。


Atoms

All data is ultimately built from atoms, so we begin with atoms.An atom is an irreducible value with a specific data type.

the following table collects all important information for q data type and atoms:

type size char type num type notation null value
boolean 1 b 1 1b 0b
byte 1 x 4 0x26 0x00
short 2 h 5 42h 0Nh
int 4 i 6 42 0N
long 8 j 7 42j 0Nj
real 4 e 8 4.2e 0Ne
float 8 f 9 4.2 0n
char 1 c 10 "z" " "
symbol * s 11 ‘zaphod `
month 4 m 13 2006.07m 0Nm
date 4 d 14 2006.07.21 0Nd
datetime 4 z 15 2006.07.21T09:13:39 0Nz
minute 4 u 17 23:59 0Nu
second 4 v 18 23:59:59 0Nv
time 4 t 19 09:01:02:042 0Nt
enumeration

* `u$v
dictionary

99 `a`b`c!!10 20 30
table

98 ([] c1:ab`c; c2:10 20 30)


Integer data

int => 123

short=> 234h (h is compulsory)

long => -23423j (j is compulsory)

Type promotion is performed automatically in q primitive operations. However, if a specific integer type is required in a list and a narrower type is presented . then an error will be prompt.


floating point data

float => pi:3.23423 or pi:1f

real => 1.23423e

we can user scientific notation for both float and real.

By default, the q console displays only seven decimal digits of accuracy for float and real . we can change this by \P 12

binary data

boolean => bit:0b

byte => by:0x2a

charactor:

char => ch:"q" or ch:"\n"

symbol => s1:`q

note that symbol is the smallest unit of the data, can't be reduced.


本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/352612.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

mysql多大_洞悉MySQL底层架构:游走在缓冲与磁盘之间

提起MySQL,其实网上已经有一大把教程了,为什么我还要写这篇文章呢,大概是因为网上很多网站都是比较零散,而且描述不够直观,不能系统对MySQL相关知识有一个系统的学习,导致不能形成知识体系。为此我撰写了这…

odps新手上路之安装Eclipse开发环境

只看楼主更多操作楼主 发表于: 2014-11-07—本帖被 亮伟 执行取消精华操作(2014-11-27)—准备工作:登录阿里云官网,开通odps服务。创建一个odps的project。安装odps的客户端,具体的方法见 传送门下载Eclipse并解压缩。建议到官网上下载。作…

mfc对话框在不同计算机上显示不全

出现MFC对话框在不同计算机上显示不全的或者显示大小不一样的活可以调整电脑的分辨率也可以在创建对话框时根据分辨率来调整控件。

c++二进制转十进制_二进制,八进制,十进制,十六进制转换详解~

点 击 上 方 蓝 字 关 注 我 们 哦 ^-^本文思维导图:1.数制:用一组固定的数字和一套统一的规则来表示数目的方法称为数制。进位计数制的要素:①、数码:用来表示进制数的元素。二进制:0,1。八进制:0,1,2,3,4…

复习第三章多态

第三章 多态 本章需要掌握的东西 掌握多态的优势和应用场合答:多态的优势可以减少代码量,更加清晰明了。,应用场合为,一个事物需要做多种事情的时候需要用到多态。 2.掌握父类和子类之间的类型转换 答:父类引用转向子…

java堆 数据结构 堆_Java中的紧凑堆外结构/组合

java堆 数据结构 堆在上一篇文章中,我详细介绍了代码对主内存的访问方式的含义。 从那时起,我就在Java中可以做什么以实现更可预测的内存布局提出了很多疑问。 有些模式可以使用数组支持的结构来应用,我将在另一篇文章中讨论。 这篇文章将探讨…

Unix环境高级编程学习笔记(七) 多线程

线程概述 线程(thread)技术早在60年代就被提出,但真正应用多线程到操作系统中去,是在80年代中期,solaris是这方面的佼佼者。传统的Unix也支持线程的概念,但是在一个进程(process)中只…

testflight开发者已将您从测试计划中移除_使用 TestFlight 测?试 App

目前市面上对于iOS开发的签名样式大致分为三种: a、企业签 依赖于苹果企业级开发者账号b、超级签 依赖于苹果个人开发者账号c、tf签 TestFlight Beta 版测试让您可以分发您 App 的 Beta 版构建版本给测试员并收集反馈。您可以在您的 App Store Connect 帐户中一次为…

MFC操作ini文件方法

转自:http://blog.csdn.net/rayborn1105/article/details/8192142 一个不错的接口:http://blog.csdn.net/qq575787460/article/details/8185339 在我们的程序设计中经常需要对一些参数进行配置,配置好后还要在下一次启动仍然有效,…

Java 8流中的数据库CRUD操作

在开始使用新工具时要克服的最大障碍是让您着手处理小事情。 到目前为止,您可能对新的Java 8 Stream API的工作方式充满信心,但是您可能尚未将其用于数据库查询。 为了帮助您开始使用Stream API创建,修改和读取SQL数据库,我整理了…

网络时间同步

linux yum install ntp ntpdate -y 时间同步命令:ntpdate time.windows.com 开机启动: chkconfig ntpd on 查看开机启动:chkconfig --list ntpd ntpd 0:off 1:off 2:on 3:on 4:on 5:on 6:off 转载于:https://www.cnblogs.com/…

java 权限url权限_SpringBootSecurity学习(11)网页版登录之URL动态权限

动态权限前面讨论用户登录认证的时候,根据用户名查询用户会将用户拥有的角色一起查询出来,自动实现判断当前登录用户拥有哪些角色。可以说用户与角色之间的动态配置和判断security做的非常不错。不过在配置方法级别的权限的时候,使用注解虽然…

线程使用

嵌入式中线程应用还是看需求,一般不常用(在不会使用的情况下)一、编译有线程的应用程序需要编译时指定编译lib库 ( -l pthread) 如:gcc main.c -o main -l pthread 才能编译通过。二、线程使用。1、线程运行…

C++ MFC string转Cstring为什么会乱码

前段时间学习mfc编了一个小程序,其中涉及到CString 与string的转换的时候感觉特别蛋疼,因此再此总结一下经验。希望能够对大家能有所帮助 通常有两种字符集模式 unicode字符集 和 ascii字符集,其中unicode有多种编码方式。utf8, …

metaq原理简介

1. 前言 本文档旨在描述RocketMQ的多个关键特性的实现原理,并对消息中间件遇到的各种问题进行总结,阐述RocketMQ如何解决这些问题。文中主要引用了JMS规范与CORBA Notification规范,规范为我们设计系统指明了方向,但是仍有不少问题…

3d展示网页开发_超实用:一篇文章带你了解市面上主流通用的3D模型格式

说到格式,相信大家都不陌生。随着互联网的普及,我们几乎每天都会和不同的格式打交道,文本的TXT、图片的JPG、视频的MP4,就连压缩包也有不同的格式。通俗来说,你可以把“格式”理解成基于同一规范的技术表征&#xff0c…

java三件套_Java开发人员应该知道的三件事

java三件套对于那些长期关注JavaOne 2012会议的读者来说,这是一篇有趣的文章。 我最近对Java冠军Heinz Kabutz的采访引起了我的注意; 包括他的Java内存难题程序,从Java内存管理的角度来看,这很有启发性。 采访中有一个特别的部分吸…

Python 的变量作用域和 LEGB 原则

在 Python 程序中创建、改变或查找变量名时,都是在一个保存变量名的地方进行中,那个地方我们称之为命名空间。作用域这个术语也称之为命名空间。 具体地说,在代码中变量名被赋值(Python 中变量声明即赋值,global 声明的…

让MessageBox在最前面弹出来的信息在

nt MessageBox( HWND hWnd, // handle of owner window LPCTSTR lpText, // address of text in message box LPCTSTR lpCaption, // address of title of message box UINT uType // style of message box ); 在uType参数中设置MB_SYSTEMMODAL就能让MessageBox在最前面 消息框…

Confluence 6 管理协同编辑 - 关于 Synchrony

协同编辑能够让项目小组中的协同合作达到下一个高度。这个页面对相关协同编辑中的问题进行了讨论,能够提供给你所有希望了解的内容。 进入 Collaborative editing 页面来获得项目小组是如何进行实时的协同工作的,这些协同工作包括在软件需求,…