一区二区三区在线-一区二区三区亚洲视频-一区二区三区亚洲-一区二区三区午夜-一区二区三区四区在线视频-一区二区三区四区在线免费观看

服務器之家:專注于服務器技術及軟件下載分享
分類導航

PHP教程|ASP.NET教程|Java教程|ASP教程|編程技術|正則表達式|C/C++|IOS|C#|Swift|Android|VB|R語言|JavaScript|易語言|vb.net|

服務器之家 - 編程語言 - Java教程 - Java基于余弦方法實現的計算相似度算法示例

Java基于余弦方法實現的計算相似度算法示例

2020-12-12 16:32damotiansheng Java教程

這篇文章主要介紹了Java基于余弦方法實現的計算相似度算法,簡單說明了余弦相似性的概念、原理并結合實例形式分析了java實現余弦相似性算法的相關操作技巧,需要的朋友可以參考下

本文實例講述了Java基于余弦方法實現的計算相似度算法。分享給大家供大家參考,具體如下:

(1)余弦相似性

通過測量兩個向量之間的角的余弦值來度量它們之間的相似性。0度角的余弦值是1,而其他任何角度的余弦值都不大于1;并且其最小值是-1。從而兩個向量之間的角度的余弦值確定兩個向量是否大致指向相同的方向。所以,它通常用于文件比較。

相關介紹可參考百度百科:余弦相似性

(2)算法實現的中未使用權重(IDF ---逆文檔頻率),使用詞項的出現次數作為向量空間的值。

?
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
import java.util.HashMap;
import java.util.Iterator;
import java.util.Map;
public class SimilarDegreeByCos
{
  /*
   * 計算兩個字符串(英文字符)的相似度,簡單的余弦計算,未添權重
   */
   public static double getSimilarDegree(String str1, String str2)
   {
    //創建向量空間模型,使用map實現,主鍵為詞項,值為長度為2的數組,存放著對應詞項在字符串中的出現次數
     Map<String, int[]> vectorSpace = new HashMap<String, int[]>();
     int[] itemCountArray = null;//為了避免頻繁產生局部變量,所以將itemCountArray聲明在此
     //以空格為分隔符,分解字符串
     String strArray[] = str1.split(" ");
     for(int i=0; i<strArray.length; ++i)
     {
       if(vectorSpace.containsKey(strArray[i]))
         ++(vectorSpace.get(strArray[i])[0]);
       else
       {
         itemCountArray = new int[2];
         itemCountArray[0] = 1;
         itemCountArray[1] = 0;
         vectorSpace.put(strArray[i], itemCountArray);
       }
     }
     strArray = str2.split(" ");
     for(int i=0; i<strArray.length; ++i)
     {
       if(vectorSpace.containsKey(strArray[i]))
         ++(vectorSpace.get(strArray[i])[1]);
       else
       {
         itemCountArray = new int[2];
         itemCountArray[0] = 0;
         itemCountArray[1] = 1;
         vectorSpace.put(strArray[i], itemCountArray);
       }
     }
     //計算相似度
     double vector1Modulo = 0.00;//向量1的模
     double vector2Modulo = 0.00;//向量2的模
     double vectorProduct = 0.00; //向量積
     Iterator iter = vectorSpace.entrySet().iterator();
     while(iter.hasNext())
     {
       Map.Entry entry = (Map.Entry)iter.next();
       itemCountArray = (int[])entry.getValue();
       vector1Modulo += itemCountArray[0]*itemCountArray[0];
       vector2Modulo += itemCountArray[1]*itemCountArray[1];
       vectorProduct += itemCountArray[0]*itemCountArray[1];
     }
     vector1Modulo = Math.sqrt(vector1Modulo);
     vector2Modulo = Math.sqrt(vector2Modulo);
     //返回相似度
    return (vectorProduct/(vector1Modulo*vector2Modulo));
   }
   /*
   *
   */
   public static void main(String args[])
   {
     String str1 = "gold silver truck";
     String str2 = "Shipment of gold damaged in a fire";
     String str3 = "Delivery of silver arrived in a silver truck";
     String str4 = "Shipment of gold arrived in a truck";
     String str5 = "gold gold gold gold gold gold";
     System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str2));
     System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str3));
     System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str4));
     System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str5));
   }
}

希望本文所述對大家java程序設計有所幫助。

延伸 · 閱讀

精彩推薦
主站蜘蛛池模板: 久久re这里精品在线视频7 | 欧美男同互吃gay老头 | 亚洲美女爱爱 | 公翁的舌尖研磨她的花蒂小说 | 女女宿舍互慰h文小说 | 欧美大陆日韩一区二区三区 | 奇米影视4444 | 天美影视传媒mv直接看 | 精品亚洲欧美中文字幕在线看 | 日本福利网 | 欧美军人男同69gay | 国产精品久久久久jk制服 | 免费看日韩 | 草馏社区最新1024 | 亚洲欧美日韩久久一区 | 国产麻豆剧果冻传媒观看免费视频 | 国产成人免费视频 | 国产精品香蕉在线观看不卡 | 嘿嘿午夜 | 精品人伦一区二区三区潘金莲 | 国产亚洲女在线精品 | 羞羞影院午夜男女爽爽影院网站 | 啪啪模拟器 | 国产成人咱精品视频免费网站 | 亚洲午夜精品久久久久久成年 | 日韩视频一区二区 | 国产免费视 | chinese456老年gay| 国产精品高清一区二区三区不卡 | 色老大在线 | 91制片厂果冻传媒杨柳作品 | juy799大岛优香在线观看 | 久久综合久久伊人 | 精品久久久久久久国产潘金莲 | 韩剧hd| 日韩伦理在线看 | 波多野结衣在线看 | 免费国产白棉袜踩踏区域 | 91庥豆果冻天美精东蜜桃传媒 | 大好硬好深好爽想要视频 | 99热都是精品 |