Time of Update: 2018-12-03
由於項目需要做許可權管理的功能,最先想到的是spring security,它是個功能強大的安全管理架構,不過它的複雜性和學習曲線之曲折讓人生畏,轉而尋求其它解決方案,知道另外一個項目組的人使用shiro做許可權管理後就瞭解了下這個架構,發現比spring
Time of Update: 2018-12-03
spring3.0以上版本鼓勵使用注釋的方式編寫程式,之前一直不知道xml設定檔裡面的${}引用的屬性如何通過註解的方式進行注入,網上搜尋發現使用@Value("${屬性名稱}")的方式可以擷取得到,不過前提是spring容器裡面要有這些屬性,於是添加配置<bean class="org.springframework.beans.factory.config.PropertyPlaceholderConfigurer"> <property
Time of Update: 2018-12-03
Time of Update: 2018-12-03
3.3計算相對頻率 讓我們在之前講到的pairs和stripes演算法的基礎上繼續在大型資料集上構建重現矩陣M。回憶在這個大的n×n矩陣中華,當n=|V|(詞典大小),元素mij包含單詞wi與wj在具體語境下共同出現的次數。無約束的計數的缺點是它沒有考慮到實際上有些詞會比其它詞更加頻繁地出現。單詞wi可能比wj出現的次數多因為其中一個可能是常用詞。一個簡單的解決方案是把無約束的計數轉變為相對頻率,f(wj |wi)。那怎樣統計在有wi的上下文中出現的wj頻率?可以用下面的公式計算: f(wj
Time of Update: 2018-12-03
1.安裝配置JDK,自己找教程 2.修改cassandra目錄下的conf/log4j-server.properties修改系統記錄檔的存放位置,例:linux下log4j.appender.R.File=/var/cassandra/log/system.logwindows下log4j.appender.R.File=F:/cassandra/log/system.log 3.修改cassandra目錄下的conf/cassandra.yaml 修改資料庫資料檔案的存放位置data_fil
Time of Update: 2018-12-03
MMOFPS——大型多人網路第一人稱視角射擊遊戲。這類遊戲通常會提供一個可供團隊戰鬥的大範圍的情境或者題材。隨著技術的不斷髮展,遊戲資料也不斷的在完善,在遊戲中也加入了類似於RPG的經驗值,用來升級玩家操縱角色的能力或者武器的能力。目前國內的“目標軟體”公司正在開發一款名為《鐵甲前傳》的MMOFPS,希望這次國產遊戲不要再帶給小生和廣大玩家一個新的“血獅事件”了。
Time of Update: 2018-12-03
錯誤1.由linux下允許開啟的最大檔案數量引起錯誤訊息:java.io.IOException: background merge hit exception: _0:C500->_0 _1:C500->_0 _2:C500->_..... [optimize] at org.apache.lucene.index.IndexWriter.optimize(IndexWriter.java:2310) at
Time of Update: 2018-12-03
bigdesk是elasticsearch的一個叢集監控工具,可以通過它來查看es叢集的各種狀態,如:cpu、記憶體使用量情況,索引資料、搜尋情況,http串連數等。項目git地址: https://github.com/lukas-vlcek/bigdesk。和head一樣,它也是個獨立的網頁程式,使用方式和head一樣。外掛程式安裝運行:1.bin/plugin -install lukas-vlcek/bigdesk2.運行es3.開啟http://localhost:9200/_plug
Time of Update: 2018-12-03
當使用svn時,有時會碰到svn死掉的問題,然後再使用snv時會說 svn: 工作複本“某某某某”已經鎖定 svn: 運行“svn cleanup 某某某某”刪除鎖定 (輸入“svn help cleanup”得到用法) 運行“svn cleanup 某某某某”。SVN又報告一個錯誤 svn: 在目錄“某某某某”中 svn: 處理命令 “modify-wcprop” 於 “某某某某” 出錯 svn: “.gitattributes” 尚未納入版本控制 遇到這種情況,在相應的目錄中,
Time of Update: 2018-12-03
elasticsearch使用google開源的依賴注入架構guice,這個項目號稱比spring快100倍,具體效能沒有測試過,不過由於其代碼比較簡潔,比spring快很有可能,是不是快那麼多就不知道了。先介紹下guice的基本使用方法。elasticsearch是直接把guice的源碼放到自己的包內(es把很多開源項目的代碼都直接整合到自己項目中,省得依賴一堆的jar包,也使es的jar包達到差不多10M),在org.elasticsearch.common.inject目錄下。Guice主
Time of Update: 2018-12-03
本文是我在整合中文分詞paoding時積累的經驗,單獨成一篇文章來重點介紹,重點需要瞭解的有下面幾個檔案,a)外掛程式目錄及外掛程式檔案build.xml,plugin.xml b)nutch-0.9/src/plugin/build.xml c)WEB-INF/classes/nutch-site.xml 然後通過按照下面的方式來配置,執行ant package就可以搞定了,這裡用ant的方式來處理整個編譯發布過程。
Time of Update: 2018-12-03
bootstrps bagging boosting這幾個概念經常用到,轉載以備用:他們都屬於整合學習方法,(如:Bagging,Boosting,Stacking),將訓練的學習器整合在一起,原理來源於PAC學習模型(Probably Approximately
Time of Update: 2018-12-03
游標控制命令 命令 游標移動h或^h 向左移一個字元j或^j或^n 向下移一行k或^p 向上移一行l或空格 向右移一個字元G 移到檔案的最後一行nG 移到檔案的第n行w
Time of Update: 2018-12-03
MAP(Mean average precision):評價一個rank方法效能的一個指標,現在有很多query,首先看rank方法對各個query來說效能分別是怎麼樣的(也就是AP),再平均起來,就是MAP。AP怎麼算那?舉個例子,現有一個query,與之相關的文檔有4——D1,D2,D3,D4,用rank方法檢索後,D2,D3,D4的排序分別是1,3,5;D1沒有搜尋到。那麼AP = (0 + 1/1 + 2/3 + 3/5)/ 4。發現了麼,第一,相關的卻沒檢索到,AP貢獻為0;分母裡1,
Time of Update: 2018-12-03
之前虛擬機器安裝Fedora9的時候,只想用來做嵌入式開發用,因此很多組件都沒有安裝。後面隨著程式的不斷增大和演算法的不斷增加,英文注釋難以讓人看明白了(主要還是自己英文水平比較差),裝一個中文IME的需求就日益迫切了。網上找了很多東西,但都是需要上網安裝的,沒辦法,只好放棄。後來,一不小心點入了一個部落格,他是用iso鏡像安裝的^_^,遂學習之~~
Time of Update: 2018-12-03
先介紹一下我的交叉編譯環境,OS是Fedora9,交叉編譯器是arm-linux-gcc-4.3.3(arm-2009q1),其它,tslib-1.4、QT4.7.2,硬體平台Omap3530。 以前我的交叉編譯器使用的是arm-linux-gcc-4.3.2,聯合編譯QT4.7.2和tslib-1.4沒有任何問題。現在,我換成了arm-linux-gcc-4.3.3,再次聯合編譯時間,就出現問題了。過程如下: 1、安裝tslib-1.4 。
Time of Update: 2018-12-03
之前一直糾結makefile中“=”和“:=”的區別到底有什麼區別,因為給變數賦值時,兩個符號都在使用。網上搜了一下,有人給出瞭解答,但是本人愚鈍,看不懂什麼意思。幾尋無果之下,也就放下了。今天看一篇部落格,無意中發現作者對於這個問題做了很好的解答。解決問題之餘不免感歎,有時候給個例子不就清楚了嗎?為什麼非要說得那麼學術呢。^_^ 1、“=”
Time of Update: 2018-12-03
前面在寫lucene入門的時候,例子只能對txt文檔建立索引,不能對word,excel,pdf建立索引,要讀取這些文檔的內容,需要額外的jar包,好在apache這個開源組織好,提供了對這些文檔解析的開源jar包 索引和查詢,我就不再寫出來了,前面文章有,下面只將這三種文檔的讀取方法貼在下面 1.首先來看WORD文檔:這裡用的是poi,相關jar包(http://poi.apache.org/)可以到apache官網上去下載,然後加到工程中(以下所要用的jar包也是,不再重複說)。一個poi.
Time of Update: 2018-12-03
nutch抓取資料後,產生五個檔案夾:crawldb、index、indexs、linkdb和segments,這五個檔案夾具體存放什麼內容,前面文章裡有解釋,每個檔案夾下,最後就是data和index檔案看了一下將segment目錄匯出文本資料的源碼SegmentReader.java,發現要用到MapFile類,而MapFile類中又要用到SequenceFileMapFile.java類是建立data和index的類,它主要是用SequenceFile.java中的內部類和方法進行讀寫操作
Time of Update: 2018-12-03
最近在研究nutch,整理了一下關於讀取資源資料的命令。1.查看crawldb資料庫:bin/nutch readdb url/crawldb/ -stats 這個命令可以查看url地址總數和它的狀態及評分。 查看每個url地址的詳細內容,匯出資料:bin/nutch readdb url/crawldb/ -dump crawldb(匯出的地址) 查看具體的url,以163為例:bin/nutch readdb url/crawldb/ -url