| 傳回型別 |
函數 |
說明 |
| int |
length(string A) |
返回字串的長度 |
| string |
reverse(string A) |
返回倒序字串 |
| string |
concat(string A, string B…) |
串連多個字串,合并為一個字串,可以接受任意數量的輸入字串 |
| string |
concat_ws(string SEP, string A, string B…) |
連結多個字串,字串之間以指定的分隔字元分開。 |
| string |
substr(string A, int start) substring(string A, int start) |
從文本字串中指定的起始位置後的字元。 |
| string |
substr(string A, int start, int len) substring(string A, int start, int len) |
從文本字串中指定的位置指定長度的字元。 |
| string |
upper(string A) ucase(string A) |
將文本字串轉換成字母全部大寫形式 |
| string |
lower(string A) lcase(string A) |
將文本字串轉換成字母全部小寫形式 |
| string |
trim(string A) |
刪除字串兩端的空格,字元之間的空格保留 |
| string |
ltrim(string A) |
刪除字串左邊的空格,其他的空格保留 |
| string |
rtrim(string A) |
刪除字串右邊的空格,其他的空格保留 |
| string |
regexp_replace(string A, string B, string C) |
字串A中的B字元被C字元替代 |
| string |
regexp_extract(string subject, string pattern, int index) |
通過下標返回Regex指定的部分。regexp_extract(‘foothebar’, ‘foo(.*?)(bar)’, 2) returns ‘bar.’ |
| string |
parse_url(string urlString, string partToExtract [, string keyToExtract]) |
返回URL指定的部分。parse_url(‘http://facebook.com/path1/p.php?k1=v1&k2=v2#Ref1′, ‘HOST’) 返回:’facebook.com’ |
| string |
get_json_object(string json_string, string path) |
select a.timestamp, get_json_object(a.appevents, ‘$.eventid’), get_json_object(a.appenvets, ‘$.eventname’) from log a; |
| string |
space(int n) |
返回指定數量的空格 |
| string |
repeat(string str, int n) |
重複N次字串 |
| int |
ascii(string str) |
返回字串中首字元的數字值 |
| string |
lpad(string str, int len, string pad) |
返回指定長度的字串,給定字串長度小於指定長度時,由指定字元從左側填補。 |
| string |
rpad(string str, int len, string pad) |
返回指定長度的字串,給定字串長度小於指定長度時,由指定字元從右側填補。 |
| array |
split(string str, string pat) |
將字串轉換為數組。 |
| int |
find_in_set(string str, string strList) |
返回字串str第一次在strlist出現的位置。如果任一參數為NULL,返回NULL;如果第一個參數包含逗號,返回0。 |
| array<array<string>> |
sentences(string str, string lang, string locale) |
將字串中內容按語句分組,每個單詞間以逗號分隔,最後返回數組。 例如sentences(‘Hello there! How are you?’) 返回:( (“Hello”, “there”), (“How”, “are”, “you”) ) |
| array<struct<string,double>> |
ngrams(array<array<string>>, int N, int K, int pf) |
SELECT ngrams(sentences(lower(tweet)), 2, 100 [, 1000]) FROM twitter; |
| array<struct<string,double>> |
context_ngrams(array<array<string>>, array<string>, int K, int pf) |
SELECT context_ngrams(sentences(lower(tweet)), array(null,null), 100, [, 1000]) FROM twitter; |