Time of Update: 2018-12-03
=============hadoop-0.12.2-core 版本===========================MyMap.java map方法把文字檔單詞輸出到中間過程output中,格式:<key,value>handoop 1Bye 1handoop 1World 1public class MyMap extends MapReduceBase implements Mapper {Text t = new Text();private final
Time of Update: 2018-12-03
要素模型(Feature)要素是GeoTools中的核心術語,它是描述地理空間資料對象的基本單位,它描述了一個現實世界中的客觀地理實體,如:一條河流、一座橋樑都可以理解為要素。柵格資料柵格資料是從上向下拍攝的地球照片,使用離散單中繼存放區其值,圖片的每個像素點都有一個指定值伺服器本身儲存,傳輸速度快,伺服器壓力小,多為png,jpg,gif
Time of Update: 2018-12-03
一、Heritrix 和Nutch 的區別Heritrix 是個 "archival crawler" (1)用來擷取完整的、精確的、網站內容的深度複製。包括擷取映像以及其他非常值內容。抓取並儲存相關的內容。對內容來者不拒,不對頁面進行內容上的修改。(2)重新爬行對相同的URL不針對先前的進行替換。爬蟲通過Web使用者介面啟動、監控、調整,允許彈性的定義要擷取的URL。Nutch
Time of Update: 2018-12-03
一、Geotools The Open Source Java GIS Toolkithttp://geotools.org/ Geotools官方網站http://docs.geotools.org/latest/javadocs/ Geotools API線上文檔http://docs.codehaus.org/display/GEOTDOC/Home Geotools使用者指南http://repo.opengeo.org
Time of Update: 2018-12-03
一、前期準備匯入 spring.jar ,commons-logging.jar ,log4j-1.2.14.jar ,aspectjrt.jar ,aspectjweaver.jar 二、定義AOP切面類public class SecurityHandler {public void check(){System.out.println("==許可權檢查");}} 三、定義業務介面public interface UserManager {public void addUser();} 四、
Time of Update: 2018-12-03
(1)、圖的定義:圖由V(G) 和E(G) 組成,記為G=(V,E)(2)、圖的分類連通圖 任意兩個頂點都相互可以到達的無向圖強連通圖 任意兩個頂點間都是互相可以到達的有向圖非連通圖 至少兩個頂點間是相互不可到達的圖完全圖 圖中n 個頂點與其它n-1個頂點之間都有邊 (3)、圖的兩種儲存結構 (a)、鄰接表 (b)、鄰接矩陣 鄰接矩陣(Adjacency
Time of Update: 2018-12-03
在B-定義:每個節點有m個子女和m-1個鍵。每個節點的索引值是按從小到大排序前i個子女的鍵比第i個鍵小後m-1個子女的鍵比第i個鍵大m路尋找方法:首先把根結點取來,在根結點所包含的關鍵字K1,…,kj尋找給定的關鍵字(可用順序尋找或二分尋找法),若找到等於給定值的關鍵字,則尋找成功;否則,一定可以確定要查的關鍵字在某個Ki或Ki+1之間,於是取Pi所指的結點繼續尋找,直到找到,或指標Pi為空白時尋找失敗。 B 樹結構圖
Time of Update: 2018-12-03
深度優先遍曆步驟:(1),訪問一個鄰接的未訪問頂點,標記它,並且把它放入棧中。(2),當不能執行規則1時,如果棧不為空白,從棧中彈出一個頂點,重複執行規則1。(3),如果規則1和規則2都不能執行時整個搜尋結束。廣度優先遍曆步驟:(1)、訪問一個未來訪問的鄰接點(如果存在),這個鄰接點必須是當前頂點的鄰接點,標記它,並且把它插入到隊列中。(2)、如果不能執行規則1,那麼從隊列頭取一個頂點(如果存在),並事它成為當前頂點(3)、如果不能執行規則1和規則2,則搜尋結束。Graph_adjMat.jav
Time of Update: 2018-12-03
B+樹是B-樹的變體,也是一種多路搜尋樹: 1.其定義基本與B-樹同,除了: 2.非葉子結點的子樹指標與關鍵字個數相同; 3.非葉子結點的子樹指標P[i],指向關鍵字值屬於[K[i], K[i+1])的子樹(B-樹是開區間); 5.為所有葉子結點增加一個鏈指標; 6.所有關鍵字都在葉子結點出現;B+樹的內部節點只是快速存取資料的索引,這部分稱為索引集,葉子是一個順序連結(資料鏈表),構成一個循序集合
Time of Update: 2018-12-03
最小產生樹:E = V - 1無權圖的最小產生樹不必關心邊的長度,而是要找到最少數量的邊。最小產生樹於搜尋演算法幾乎是相同的,同樣可以給予深度優先搜尋和廣度優先搜尋。DFS演算法訪問所有的頂點,但只訪問一次,絕不會兩次訪問同一個頂點。當看到某條邊將要到達一個已訪問的頂點,它就不會走這條邊。因此DFS演算法走過整個圖的路徑必定是最小產生樹。對dfs演算法的改進,只是在else 裡面輸出了當前頂點 public void mst(){ Stack<Integer> stack =
Time of Update: 2018-12-03
B* 樹,除根節點以外,所有節點至少是三分之二是滿的,。B*樹的分裂:當一個結點滿時,如果它的下一個兄弟結點未滿,那麼將一部分資料移到兄弟結點中,再在原結點插入關鍵字,最後修改父結點中兄弟結點的關鍵字(因為兄弟結點的關鍵字範圍改變了);如果兄弟也滿了,則在原結點與兄弟結點之間增加新結點,並各複製1/3的資料到新結點,最後在父結點增加新結點的指標; 所以,B*樹分配新結點的機率比B+樹要低,空間使用率更高; 分裂過程:插入6以後 如果兄弟也滿了的情況: 插入4以後 小結
Time of Update: 2018-12-03
一、應用<class> 標籤的<dynamc-insert> 和<dynamic-update> 屬性 問題:沒有使用<dynamc-insert> 和<dynamic-update> 屬性,update或者insert 發起的hql 預設會更新所有的欄位。 比如:Book book = hibernateDao.load(id); book.setName("chen");
Time of Update: 2018-12-03
vc中怎麼使用SendMessage自訂訊息函數:SendMessage的基本結構如下:SendMessage( HWND hWnd, //訊息傳遞的目標視窗或線程的控制代碼。 UINT Msg, //訊息類別(這裡可以是一些系統訊息,也可以是自己定義,下文具體介紹,) WPARAM wParam, //參數1 (WPARAM 其實是與UINT是同種類型的, //在vc編譯器中右鍵有個“轉到WPARAM的定義”的選項可以查看。 LPARAM lParam); //
Time of Update: 2018-12-03
1、初始化一個Configuration執行個體設定抓取工作配置;2、設定一些預設抓取工作參數,比如進程數threads、抓取深度depth、抓取網頁數量topN;3、建立抓取工作抓取到的網頁檔案的存放目錄(crawldb、linkdb、segments、indexes、index),用來存放原生網頁,以及網頁解析出的常值內容及其其它相關資料;4、在抓取工作及其索引過程中,這通過初始化一些實現了這些操作的類的執行個體來完成的,例如:Injector、Generator、Fetcher、Parse
Time of Update: 2018-12-03
(1) 將URL集合進行格式化和過濾,消除其中的非法URL,並設定URL狀態(UNFETCHED),按照一定方法進行初始化分值;(2) 將URL進行合并,消除重複的URL入口;(3) 將URL及其狀態、分值存入crawldb資料庫,與原資料庫中重複的則刪除舊的,更換新的。inject方法public void inject(Path crawlDb, Path urlDir) throws IOException { //建立臨時目錄 Path tempDir = new Path(
Time of Update: 2018-12-03
(1) Quartz 一個簡單列子import org.quartz.CronTrigger;import org.quartz.JobDetail;import org.quartz.Scheduler;import org.quartz.SchedulerException;import org.quartz.SchedulerFactory;import org.quartz.Trigger;import org.quartz.TriggerUtils;import org.quartz.
Time of Update: 2018-12-03
設計簡單的檔案迭代器,從檔案中依次讀入每行的字串。package com.mapbar.tools;import java.io.BufferedReader;import java.io.File;import java.io.FileInputStream;import java.io.InputStreamReader;import java.util.Iterator;/** * * Class FileIterator.java * * Description 檔案迭代器 * *
Time of Update: 2018-12-03
(1)、有向圖,邊是有方向的。鄰接矩陣表示方法上下三角形是不對稱的。在添加一條邊是只需要一條語句, //添加一個邊 public void addEdge(int start,int end){ adjMat[start][end] = 1; }(2)、有向圖的演算法-拓撲排序有向圖的應用,某些項目或者事件必須按照特定的順序排序或發生。比如大學課程安排,要想得到學位需要必修那些課程。每年的課程都按先後關係排序,全部必修完畢,最後才能答辯,拿到學位。拓撲排序的步驟:(1)、
Time of Update: 2018-12-03
作者:智慧的魚 摘要:本文詳細的解析了AVI檔案的儲存結構,介紹了微軟提供的用來操作AVI檔案的一組API使用方法,並通過例子代碼,示範了如何將一組靜態Bmp圖片合成一個avi視頻檔案以及如何將一個avi視頻檔案解析儲存為一系列的bmp影像檔。 關鍵詞:avi檔案 bmp映像 vc AVI是音訊視訊交錯格式(Audio Video Interleaved)的英文縮寫,它是Microsoft公司開發的一種符合RIFF檔案規格的數字音頻與視頻檔案格式,原先用於Microsoft
Time of Update: 2018-12-03
演算法設計:Prim演算法從頂點開始著手。從一個頂點開始,然後放入到樹的集合中,然後重複做如下事情: (1)、找最新的頂點到其他頂點的所有邊,這些頂點不能在樹的集合中,把這些放入優先順序隊列。 (2)、找到權值最小的邊把它和它所到達的頂點放入樹的集合中。重複上述操作直到所有的頂點都在樹中,程式結束。Graph_mstw.javapackage com.mapbar.structure;/** * * Class Graph_mstw.java * * Description