Time of Update: 2018-12-03
春天裡的Spring(Spring 1.2 rc1 發布了) Spring 1.2 最近發布了. 主要的改進包括以下部分: 改變了單個spring.jar的發布情況,支援多個jar包發布。finer-grained distribution jar files, alongside the full spring.jarAOP Alliance 的介面現在包括在spring-aop.和 spring.jar 包中;增加了對XML bean 定義的改進; ("ref" and "value"
Time of Update: 2018-12-03
EJB 3.0 規範的變化可以大致分成2大部分:1、 使用了jdk1.5中提供的 annotation 機制的編程模型。在EJB2.1中採用一些介面和部署時的描述符來完成類似的功能。 EJB的 annotations 在EJB3中所有的企業Bean都是POJO(Plan old Java object)和一些相關的描述符。用描述符可以用來定義Bean需要實現的 介面、O/R 映射時需要的資訊、需要引用的資源等等。2、 提供了一個基於Hibernate的 O/R Mapping 工具, EJB
Time of Update: 2018-12-03
Sun和Apache Harmony的融合前景還不明朗 Stephen Shankland 在"Sun和Apache Harmony的融合前景還不明朗" 一文中寫道"很難說Sun決定發布Java標準版本的原始碼意味著將會和Harmony統一" 然而, Harmony的 license 模式和方法也提供給Sun一個絕好的機會來修正Java.
Time of Update: 2018-12-03
Time of Update: 2018-12-03
介紹3個REST架構 Bye Bye SOAP , Hello REST 題記最近需要ruby和java協同工作,本來想用 ruby java bridge 形式的方案實現,結果沒有成功。只好用老辦法通過 web service 調用方式了。你也知道 java 世界裡的 web service 可不像 visual studio 世界裡那樣易於配置和使用。幸好我的需求也不複雜用REST的方式完全可以滿足了。這兩天tss上介紹了Cetia4 REST
Time of Update: 2018-12-03
機器人 小叮咚的中文分詞終於跨出了第一步機器人 小叮咚的帳號:QQ: 443803193Msn: xiaodingdong21@hotmail.com 首頁: http://xiaodingdong.myshow.cn/index.asp網路上有很多演算法,借鑒了一下,然後自己用最普通得方法做了一個分詞現在還沒有和小叮咚整合,等效果比較滿意後,加入小叮咚得問答程式組件。原理是: 對 待解析得句子(長度N)做N次迴圈在每次迴圈中尋找從當前開始位置開始出現的最大片語(
Time of Update: 2018-12-03
HiveMind 和 Spring 從實現的功能上看有很大的部分是重疊的,都是用ICO控制翻轉、依賴注射等原理來實現相似的功能,從這一點上講兩者的指導精神是一致的。 存在的就是合理的。HiveMind 和 Spring 實現的方式和關注點卻大相徑庭。 HiveMind 是一個提供元件服務和配置的微核心,一個用於各種Java程式的基礎架構。這裡的Java程式可以是 Tapestry 應用,或者 一個基於 servlet 的web應用,還可以是 命令列工具、Swing 或者
Time of Update: 2018-12-03
我和Blog不得不說的故事 想用I,Blog作為這篇文章的題目,寫完後才發現,放到末尾更合適。 本想仿照最新大片 I,Robot 的名字來作為這篇Blog的題目,後來發現 Blog有很多草根習性(與劉一賜喝咖啡:誰是草根?),和大片 I,Robot 中的高科技品位不太對路。所以就起了名字:我和Blog不得不說的故事。不得不說有點煽情的意味,但都是寫我用Blog來的一些感受和見聞。 用Blog這麼久,慢慢的就積累了一點經驗,養成了一種書寫習慣,培養了一些感情。
Time of Update: 2018-12-03
說起Regex,說起來開心,用起來頭疼。比Perl的文法還要難受。 比如: 要匹配類似(a+(a+a)+(a))這樣的運算式,
Time of Update: 2018-12-03
小叮咚推出自訂報時服務了從上次 小叮咚 xiaodingdong21@hotmail.com 推出整點報時服務以來,廣受大家好評,現在小叮咚又推出 自訂 報時服務。使用方法如下:1、用你的msn帳號添加 xiaodingdong21@hotmail.com 2、使用如下命令添加自訂報時服務:callme a=meeting t =11:20:00 m=參加會議解釋如下: a=meeting meeting是這個服務的Id,一個人可以用上面的命令添加多項服務,用 等號 後面的字母區分;
Time of Update: 2018-12-03
以前翻譯總用trados,太專業,而我的風格很free,又是出於樂趣,因此就放棄了trados。現在好了我有了自己的web trados了。 題記LimpidLog 使用 java 的 java.lang.instrument.Instrumentation 來作為 Java 代理。 當你一個類註冊Log
Time of Update: 2018-12-03
JOSSO Single Sign-On 1.2 簡介 背景知識:身份認證系統包括:目錄服務,驗證和授權服務,認證服務,單點登陸服務,系統管理等模組。 JOSSO 是一個純Java基於J2EE的單點登陸驗證架構,主要用來提供集中式的平台無關的使用者驗證。 JOSSO 主要特色:1 100% Java,使用了 JAAS,WEB Services/SOAP,EJB, Struts, Servlet/JSP 標準技術;2
Time of Update: 2018-12-03
RSS的發展曆史簡單回顧 作者:田春峰 連結:http://blog.csdn.net/accesine960/archive/2005/03/05/312308.aspx RSS的第一個版本是 RSS 0.90 ,是 Natscape 大概在99年開發和設計的,主要用來建立一個整合各主要新聞網站內容的門戶。由於這項技術是利用W3C新一代的語義網技術RDF(Resource Description Framework)為基礎,這時 Natscape 把RSS稱為:“RDF
Time of Update: 2018-12-03
接過 能把幸福寫在臉上的 ada 的火把,繼續火種遊戲, 我的怪癖:1、早上起來讀新聞2、沒完沒了崇拜人3、火花總在大腦冒4、挑三撿四飲食好5、床頭讀書好夢來早上起來讀新聞:早上起床後上班前會“瘋狂”讀新聞,如饑似渴。這個習慣說了很多次要改,現在還持續著。說改因為我發現,早上剛上班的時候也是上級招呼最多的時候,所以現在剋制多了;沒完沒了崇拜人:從大學開始,就讀了很多本人物傳記,養成了崇拜人的習慣,名單可以列一大堆;畢業後又趕上軟體行業興起,互連網大潮,也算造星大潮,又讀了很多人的故事。童心未泯,
Time of Update: 2018-12-03
如何判斷一個圖是稀疏的還是稠密的 最近涉及了一些圖的演算法,發現用途蠻廣,比如:物流配送,中文分詞,甚至課程排列都可以用圖來表示和計算。無論哪種用途選擇一個合適的圖資料結構至關重要。 圖有兩種主要的表示方法:鄰接矩陣和鄰接表。 決定我們採用鄰接矩陣還是採用鄰接表來表示圖,需要判斷一個圖是稀疏圖還是稠密圖。鄰接矩陣和鄰接表表示圖所需的存貯空間和演算法時間度相差非常大,所以判斷一個圖是稀疏的還是稠密的非常重要。 判斷標準如下:
Time of Update: 2018-12-03
機器人小叮咚開始提供正點報時服務啦,快來加入吧 小叮咚機器人(?xiaodingdong21@hotmail.com ?)準備提供完全的報時和定時提醒服務。現在已經提供了正點報時服務。 以後準備擴充定時提醒和周期定時提醒的功能。 準備的文法如下: 定製報時服務: 提醒,2004-08-21 XX:XX:XX ,準備會議 提醒,?
Time of Update: 2018-12-03
基於最長詞匹配演算法變形的分詞系統( 文舫工作室貢獻 ) 這個分詞程式是文舫工作室貢獻出來的。 強烈推薦看看文舫工作室的開發日誌,他們的激情可以鼓勵很多人...... 自從小叮咚分詞程式發布後,很多軟體行業的朋友們都來信索取,因為定位的問題,所以小叮咚的分詞程式和 ICTCLAS的演算法完全不同的。 小叮咚的分詞程式的定位是為搜尋引擎服務的。可以參考:一種面向搜尋引擎的中文切分詞方法 ICTCLAS和基於最長詞匹配演算法變形的分詞系統
Time of Update: 2018-12-03
關於 貝葉斯 計算公式的一個問題 網路上流傳的關於反垃圾郵件的貝葉斯演算法大都和這篇類似。 但是裡面的公式和作者舉的例子卻有衝突的地方: 公式如下: A事件----郵件為垃圾郵件; t1,t2 …….tn代表TOKEN串 則P(A|ti)表示在郵件中出現TOKEN串ti時,該郵件為垃圾郵件的機率。 設 P1(ti)=(ti在hashtable_good中的值) P2(ti)=(ti在hashtable_ bad中的值) 則
Time of Update: 2018-12-03
小叮咚中文分詞在處理大量資料的時候碰到了記憶體流失的問題最近在測試小叮咚分詞應用於weblucene搜尋引擎的效果。我們使用的來源資料XML格式檔案大概1.2G。建立完成後的索引檔案對比如下:源檔案:1.2G小叮咚分詞產生的索引檔案:2217MB二元分詞產生的索引檔案:2618MB 兩者相差:401M更詳細的對比可以查看:中文分詞和二元分詞綜合對比下面是一份對索引檔案的對比,可以看出主要的差別在於項(term)資訊的差別。索引檔案清單(121M)小叮咚分詞(146M)二元分詞
Time of Update: 2018-12-03
如何構建一種面向 html 標籤的Regex文法? 在處理字串的過程中,Regex有著不可替代的位置。現在的電腦進階語言中都有相應的Regex支援包。 如果我們把一個網頁中 html 代碼當作一個有結構的字串,那麼如何用一種類似Regex的方式來提取想要的html標籤(tags)呢? 這裡先不考慮如何?,而先考慮如何用一種類Regex的方式來描述html標籤。 要取得一個html標籤(tag),需要知道該標籤的2類屬性: 1、標籤的位置; 2、標籤本身的屬性; 比如