隨筆-28  評(píng)論-51  文章-10  trackbacks-0
          從現(xiàn)在開始,開始我真正的研究計(jì)劃:聚類獲取有價(jià)值的信息。
          今天開始詳細(xì)了解了已有的資源和項(xiàng)目代碼,包含中文分詞,文檔向量化,現(xiàn)有的KA+K-MEANS聚類算法。但是據(jù)觀察,聚類效果上不是很滿意,主要是類簇的關(guān)鍵字抽取不夠準(zhǔn)確,特征選擇尚未考慮,聚類精度需要提高。
          以下是現(xiàn)有系統(tǒng)的流程圖:明天開始到下周末,研究
          1.ka+k-means,其他k-means方法,找出系統(tǒng)不足點(diǎn)
          2.研究特征選擇方法,提高聚類前數(shù)據(jù)的質(zhì)量




          posted on 2008-05-09 22:22 fullfocus 閱讀(653) 評(píng)論(2)  編輯  收藏 所屬分類: 聚類算法研究

          評(píng)論:
          # re: focus聚類研究系列一-----熟悉現(xiàn)有項(xiàng)目基礎(chǔ)(站在巨人的肩膀上) 2008-08-08 13:32 | zr
          請(qǐng)問這是什么系統(tǒng)啊,是對(duì)網(wǎng)頁的聚類嗎  回復(fù)  更多評(píng)論
            
          # re: focus聚類研究系列一-----熟悉現(xiàn)有項(xiàng)目基礎(chǔ)(站在巨人的肩膀上)[未登錄] 2010-06-10 16:31 | Bill
          怎么判斷關(guān)鍵詞抽取不夠精確呢?請(qǐng)樓主說說你的依據(jù)  回復(fù)  更多評(píng)論
            
          主站蜘蛛池模板: 湖北省| 吉木乃县| 神池县| 沙田区| 醴陵市| 浮山县| 衡阳市| 怀化市| 嘉禾县| 信阳市| 莱西市| 延寿县| 宽城| 施秉县| 尼玛县| 炎陵县| 临猗县| 宜兰县| 蓬溪县| 逊克县| 彭水| 封丘县| 临邑县| 西安市| 安溪县| 华坪县| 晋城| 大邑县| 合肥市| 韩城市| 方山县| 淳安县| 武冈市| 汨罗市| 施甸县| 百色市| 留坝县| 赤水市| 长葛市| 星子县| 天气|