Java Counter示例

编程语言: Java

命名空间/包名称: edu.jhu.hlt.parma.util

类/类型: Counter

hotexamples.com的示例: 10

Java Counter - 已找到10个示例。这些是从开源项目中提取的最受好评的edu.jhu.hlt.parma.util.Counter现实Java示例。您可以评价示例，以帮助我们提高示例质量。

常用方法

显示隐藏

getCount(5)

keySet(5)

containsKey(2)

incrementCount(2)

totalCount(2)

setCount(1)

示例#1

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

 public double getCount(K token) {
   if (!lm.keySet().contains(token)) {
     System.err.println(lm.keySet().size());
     throw new RuntimeException("token not in keyset");
   }
   return lm.getCount(token);
 }

示例#2

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

  /**
   * GT smoothing with least squares interpolation. This follows the procedure in Jurafsky and
   * Martin sect. 4.5.3.
   */
  public void smoothAndNormalize() {
    Counter<Integer> cntCounter = new Counter<Integer>();
    for (K tok : lm.keySet()) {
      int cnt = (int) lm.getCount(tok);
      cntCounter.incrementCount(cnt);
    }

    final double[] coeffs = runLogSpaceRegression(cntCounter);

    UNK_PROB = cntCounter.getCount(1) / lm.totalCount();

    for (K tok : lm.keySet()) {
      double tokCnt = lm.getCount(tok);
      if (tokCnt <= unkCutoff) // Treat as unknown
      unkTokens.add(tok);
      if (tokCnt <= kCutoff) { // Smooth
        double cSmooth = katzEstimate(cntCounter, tokCnt, coeffs);
        lm.setCount(tok, cSmooth);
      }
    }

    // Normalize
    // Counters.normalize(lm);
    // MY COUNTER IS ALWAYS NORMALIZED AND AWESOME
  }

示例#3

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

  private double[] runLogSpaceRegression(Counter<Integer> cntCounter) {
    SimpleRegression reg = new SimpleRegression();

    for (int cnt : cntCounter.keySet()) {
      reg.addData(cnt, Math.log(cntCounter.getCount(cnt)));
    }

    // System.out.println(reg.getIntercept());
    // System.out.println(reg.getSlope());
    // System.out.println(regression.getSlopeStdErr());

    double[] coeffs = new double[] {reg.getIntercept(), reg.getSlope()};

    return coeffs;
  }

示例#4

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

  private double katzEstimate(Counter<Integer> cnt, double c, double[] coeffs) {
    double nC = cnt.getCount((int) c);
    double nC1 = cnt.getCount(((int) c) + 1);
    if (nC1 == 0.0) nC1 = Math.exp(coeffs[0] + (coeffs[1] * (c + 1.0)));

    double n1 = cnt.getCount(1);
    double nK1 = cnt.getCount(((int) kCutoff) + 1);
    if (nK1 == 0.0) nK1 = Math.exp(coeffs[0] + (coeffs[1] * (kCutoff + 1.0)));

    double kTerm = (kCutoff + 1.0) * (nK1 / n1);
    double cTerm = (c + 1.0) * (nC1 / nC);

    double cSmooth = (cTerm - (c * kTerm)) / (1.0 - kTerm);

    return cSmooth;
  }

示例#5

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

 public Set<K> getVocab() {
   return Collections.unmodifiableSet(lm.keySet());
 }

示例#6

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

 public boolean contains(K token) {
   return lm.containsKey(token);
 }

示例#7

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

 public int vocabSize() {
   return lm.keySet().size();
 }

示例#8

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

 public double totalMass() {
   return lm.totalCount();
 }

示例#9

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

 public double getProb(K token) {
   if (unkTokens.contains(token) || !lm.containsKey(token)) return UNK_PROB;
   return lm.getCount(token);
 }

示例#10

0

显示文件

文件： UnigramLM.java 项目： hltcoe/parma

 public void incrementCount(K token) {
   lm.incrementCount(token);
 }