zoukankan      html  css  js  c++  java
  • 区分两个字符串的相似度

    public static void main(String[] args) {
    //要比较的两个字符串
    String str1 = "我去玩让他的给对方郭德纲的更多";
    String str2 = "我玩去的风格的的覆盖的的覆盖的地方g";
    long start = System.currentTimeMillis();
    levenshtein(str1.toLowerCase(),str2.toLowerCase());
    long end = System.currentTimeMillis();
    System.out.println(end - start);
    }

    /**
    *
    * @param str1
    * @param str2
    */
    public static void levenshtein(String str1,String str2) {
    //计算两个字符串的长度。
    int len1 = str1.length();
    int len2 = str2.length();
    //建立上面说的数组,比字符长度大一个空间
    int[][] dif = new int[len1 + 1][len2 + 1];
    //赋初值,步骤B。
    for (int a = 0; a <= len1; a++) {
    dif[a][0] = a;
    }
    for (int a = 0; a <= len2; a++) {
    dif[0][a] = a;
    }
    //计算两个字符是否一样,计算左上的值
    int temp;
    for (int i = 1; i <= len1; i++) {
    for (int j = 1; j <= len2; j++) {
    if (str1.charAt(i - 1) == str2.charAt(j - 1)) {
    temp = 0;
    } else {
    temp = 1;
    }
    //取三个值中最小的
    dif[i][j] = min(dif[i - 1][j - 1] + temp, dif[i][j - 1] + 1,
    dif[i - 1][j] + 1);
    }
    }
    System.out.println("字符串""+str1+""与""+str2+""的比较");
    //取数组右下角的值,同样不同位置代表不同字符串的比较
    System.out.println("差异步骤:"+dif[len1][len2]);
    //计算相似度
    float similarity =1 - (float) dif[len1][len2] / Math.max(str1.length(), str2.length());
    System.out.println("相似度:"+similarity);
    }

    //得到最小值
    private static int min(int... is) {
    int min = Integer.MAX_VALUE;
    for (int i : is) {
    if (min > i) {
    min = i;
    }
    }
    return min;
    }
  • 相关阅读:
    bzoj 2216 Lightning Conductor
    一些有趣的问题合集
    Codeforces 40E Number Table
    Codeforces 37D Lesson Timetable
    bzoj 4289 Tax
    bzoj 2844 albus就是要第一个出场
    bzoj 2115 Xor
    luogu 3790 文艺数学题
    bzoj 1420 Discrete Root
    Lucas定理学习笔记
  • 原文地址:https://www.cnblogs.com/liyiren/p/12467304.html
Copyright © 2011-2022 走看看