Time of Update: 2014-10-17
標籤:sql 編譯 解析 分布式 大資料基於簡單sql語句的sql解析原理及在大資料中的應用 李萬鴻 通常sql文法解析都是以lex、yacc進行分析為基礎的,是逐個字元進行分析,效能不高,如果基於沒有子查詢的sql語句進行解析,則速度會提高許多,在此對其原理加以說明。
Time of Update: 2014-10-07
標籤:blog http os 使用 ar strong 資料 sp 2014 本篇文章主要是繼續上一篇Microsoft決策樹分析演算法後,採用另外一種分析演算法對目標顧客群體的挖掘,同樣的利
Time of Update: 2014-12-15
標籤:kaggle 機器學習 資料採礦 python 大資料競賽平台——Kaggle
Time of Update: 2014-12-13
標籤:大資料技術大會 machine learning 機器學習 感知計算 深度學習 1、落地、跨界、效率、領導見面就談大資料;2、大資料成為主流產業需要5到10年;3、資料是表象,實質是問題;4、Doug Cutting:Fuel for change:data, EDH, Style catches
Time of Update: 2014-10-30
標籤:splunk 大資料 機器大資料 大資料中90%的資料屬於機器資料。除了來自於伺服器、儲存、網路中的傳統IT資料以外,來自移動互連網、物聯網中的大量非結構化資料也都屬於機器資料。相比資料庫資料,機器大資料具有數量大、增長速度快、複雜性高、多樣化等特點,但是價值密度略低。 Splunk就是一家專註於處理機器資料的公司。在成為大資料領域第一家上市公司後,Splunk一直受到整個業界的關注。儘
Time of Update: 2014-10-11
標籤:style blog http os 使用 ar java strong 資料 1、資料視覺效果(全彩)面對龐雜的大資料,可視化提供了良好的解讀角度與方法,是大資料分析與應用的利器。本書首
Time of Update: 2014-10-08
標籤:雲端運算 spark 大資料 spark技術 spark熱點 spark互動問答 “決勝雲端運算大資料時代”Spark亞太地區研究院100期公益大講堂
Time of Update: 2014-10-08
標籤:spark技術 雲端運算 spark教程 大資料 spark熱點 “決勝雲端運算大資料時代”
Time of Update: 2014-10-04
標籤:des style http io os 使用 ar java for 作者按:本文根據去年11月份CSDN舉辦的“大資料技術大會”演講材料整理,最初發表於2012
Time of Update: 2014-10-02
標籤:style blog http color io os ar for sp 題目連結:http://acm.hdu.edu.cn/showproblem.php?pid=5047解題報告:
Time of Update: 2014-09-28
標籤:style os 使用 ar strong 資料 sp on c “決勝雲端運算大資料時代”Spark亞太地區研究院100期公益大講堂
Time of Update: 2014-09-24
標籤:雲端運算 spark 大資料 spark技術 spark熱點 spark互動問答 “決勝雲端運算大資料時代”Spark亞太地區研究院100期公益大講堂
Time of Update: 2014-09-24
標籤:style color 使用 ar for 資料 sp on c “決勝雲端運算大資料時代” Spark亞太地區研究院100期公益大講堂 【第13期互動問答分享】
Time of Update: 2014-07-26
標籤:style blog http color 使用 os 資料 io 公司一個資料抓取的程式,資料量極大,讀取資料的用IDataReader的Read方法來進行資料處理,在測試的時候我想跑一部分資料後跳出迴圈,即break;
Time of Update: 2018-12-05
該程式是針對非常龐大的資料庫開發的,沒有用迴圈用途: 對過萬條資料的資料庫欄位內容批量替換代碼:<%'//資料庫連接 Dim BeeYee_DbName,Connstr,Conn,intSn1 Dim Content,Num,intSn,intIdNo,strCodea,strCodec,Rs,strSql Server.ScriptTimeOut = 800 BeeYee_DbName="transfer"
Time of Update: 2018-12-05
最近剛看了新的一期《程式員》雜誌的一篇大資料的文章,總結的特別好,為了方便我去尋找所有將裡面的內容再次精簡後寫下來。在這篇文章裡主要是幾個方面:資料轉送、資料存放區、資料計算、資料展現、資料開發平台、資料應用市場我之前對資料的總結在:資料存放區、資料管理、資料計算 資料轉送包括:即時同步、批量同步。一般常用方式採用時間軸。資料存放區包括:核心級分布式儲存、使用者級分布式檔案儲存體、業務級資料存放區。前兩個類別其實很好理解,最後一個是有分類的,包括:列式資料庫儲存、文檔資料庫儲存、K/V型資料庫儲
Time of Update: 2018-12-05
最近遇到一個資料量大引起的問題, 目前資料量大約8M條資料。以後還將以每天近萬的資料增加。 因此考慮MsSqlServer的分區表特性。原先的表設計相當於表名為UserEventId(bigint),UserId(nvarchar(250)), EventId(nvarchar(250)), column1, column2, column3.此表相當於一張系統所有業務的索引表, 記錄了某使用者在此系統中所有的業務行為。應用場合:每當該使用者在該系統中發生一筆業務,
Time of Update: 2018-12-08
顯示資料,一般有兩種選擇:ListView和DataGrid,對於後者,其翻頁功能比較容易實現,那麼對於ListView的翻頁呢,似乎不太好實現。痛點主要在於ListView沒有提供翻頁的功能,另外具體的ListView中一頁可以顯示多少資料不好計算,因為一個ListView,如果你顯示的資料不能填充整個ListView,那麼看起來不是很美觀。今天圍繞這兩個問題,我來給出我的做法。1.計算ListView顯示的最大記錄條數(一頁,無捲軸,對於橫向捲軸未計算在內)///
Time of Update: 2018-12-06
1 class uint128 2 { 3 public: 4 unsigned long long h; 5 unsigned long long l; 6 7 uint128(){h=0;l=0;} 8 9 void operator+= (unsigned long long l1) 10 { 11 unsigne
Time of Update: 2018-12-07
這一講主要深入使用HDFS命令列工具操作Hadoop分布式叢集,主要是通過實驗的配置hdfs-site.xml檔案的心跳來測試replication具體的工作和流程。通過HDFS的心跳來測試replication具體的工作機制和流程的PDF版本請猛擊這裡。 王家林的“雲端運算分布式大資料Hadoop實戰高手之路”之完整發布目錄 雲端運算分布式大資料實戰技術Hadoop交流群:312494188,每天都會在群中發布雲端運算實戰性資料,歡迎大家加入! 在王家林