隨筆-28  評論-51  文章-10  trackbacks-0
          從現在開始,開始我真正的研究計劃:聚類獲取有價值的信息。
          今天開始詳細了解了已有的資源和項目代碼,包含中文分詞,文檔向量化,現有的KA+K-MEANS聚類算法。但是據觀察,聚類效果上不是很滿意,主要是類簇的關鍵字抽取不夠準確,特征選擇尚未考慮,聚類精度需要提高。
          以下是現有系統的流程圖:明天開始到下周末,研究
          1.ka+k-means,其他k-means方法,找出系統不足點
          2.研究特征選擇方法,提高聚類前數據的質量




          posted on 2008-05-09 22:22 fullfocus 閱讀(645) 評論(2)  編輯  收藏 所屬分類: 聚類算法研究

          評論:
          # re: focus聚類研究系列一-----熟悉現有項目基礎(站在巨人的肩膀上) 2008-08-08 13:32 | zr
          請問這是什么系統啊,是對網頁的聚類嗎  回復  更多評論
            
          # re: focus聚類研究系列一-----熟悉現有項目基礎(站在巨人的肩膀上)[未登錄] 2010-06-10 16:31 | Bill
          怎么判斷關鍵詞抽取不夠精確呢?請樓主說說你的依據  回復  更多評論
            
          主站蜘蛛池模板: 蒲江县| 黄大仙区| 万全县| 丁青县| 云阳县| 喀喇沁旗| 梅河口市| 汕尾市| 丹巴县| 商洛市| 潼关县| 绥阳县| 鱼台县| 阜南县| 桦甸市| 甘泉县| 金川县| 利辛县| 中阳县| 达孜县| 临朐县| 汉阴县| 江西省| 陆良县| 崇仁县| 庄浪县| 师宗县| 青河县| 巴林左旗| 桦川县| 新蔡县| 达孜县| 定边县| 收藏| 铁岭市| 南和县| 阳城县| 鹿泉市| 嵩明县| 大埔县| 巢湖市|