AllyHub
Content Creation

テキスト類似度チェッカー

2つのテキストは、互いに関連のない3つの方法で類似することがあります。1つの数値はそれらを平均して、何も教えてくれないものにしてしまいます。

下にテキストを入力してください

テキスト類似度チェッカーでできること

「類似」は1つの事柄ではありません。だからこそ、それを1つの数値で表してもほとんど役に立ってきませんでした。以下では、入力されるもの、切り分ける3種類の重複、そしてスコアの代わりに返ってくるものを説明します。

2つのテキストでも20でも

2つを貼り付けるか、フォルダを渡してすべてを互いに比較させてください。文書、ページ、下書き、翻訳もすべて同じ方法で入力できます。

3種類の「同じ」

同じ文言、別の言葉で述べられた同じ主張、そして異なる内容で同じ形。それぞれの重複にはどれに当たるかがラベル付けされます。この3つはあなたのテキストについてまったく異なることを意味するからです。

スコアではなく位置を特定

代わりに場所のリストが得られます。この段落とあの段落、この見出しとあの見出し、というように、ペアに対する数値ではなく位置が示されます。位置は、行動に移せるものです。

AllyHubで2つのテキストを比較する方法

2つの文書から、どこが同じことを言っているかの正確なリストまでの3ステップ。

01

両方を渡す

貼り付けるかファイルを添付してください。特定の目的がある場合は、何を確認したいのかを伝えてください。

02

自動で並べ合わせる

2つのテキストをセクションごとに照合し、重複を見つけ、それぞれを文言・意味・構造に分類し、各文書のどこにあるかを示します。

03

重複ごとに判断する

問題ない重複もあれば、そうでないものもあり、どちらか分かるのはあなただけです。実行をプレイブックとして保存すれば、どちらかの側が変わった後に同じ比較を再実行できます。

AllyHubのテキスト類似度チェッカーを選ぶ理由

パーセンテージとは、3つの異なる問いを1つの数値で代用しているものです。

1つの数値、3つの問い

類似度60%というのは、両者が文の半分をそのまま共有しているということかもしれず、まったく別の言葉で同じ主張をしているということかもしれず、あるいはどちらもテンプレートに従っているということかもしれません。これらは3つの異なる対応を必要とし、その数値はどれに当たるかを教えてくれません。

Extract More Than Text

差分では不十分

文字レベルの比較は、打ち直されたものは捉えますが、言い換えられたものはすべて見逃します。2人が同じことについて書くとき、重要なことのほとんどはそこにあります。2つの段落はほとんど単語を共有しなくても、同じ段落であり得ます。それは差分が構造上見ることができないケースです。

Bulk Extraction, Any Scale

重複は欠陥ではない

多くの繰り返しは正しいものです。用語はドキュメントセット全体で同一でなければならず、契約ごとに異なる法的条項は利点ではなく問題であり、ハウススタイルはページ同士を意図的に似せます。ここでは類似を減らすべきものとして扱うことはありません。

From Extraction to Action

後で再実行

これの有用な形は一度きりではなく、どちらかの側が変わるたびに実行されるチェックです。何が許容できる重複かは一度設定すればあなたのものです。あなたのAllyHubは二度とゼロから始めることはないので、再実行のたびに速くなります。

Workflows That Compound

AllyHubのテキスト類似度チェッカーを使うのは誰か

ページを区別し続けるコンテンツチーム、文書の2つのバージョンを比較する人、原文と照合する翻訳者、そしてナレッジベース。

ページを区別し続ける

4人が2年かけて書いた40ページ、そのうち少なくとも6ページはひっそりと同じ主張をしています。誰も気づきません。誰も40ページを続けて読まないからです。そして、そのうち2ページにたどり着いた読者は気づきます。

文書の2つのバージョン

新しい契約書が届き、変更は軽微だと言われました。それが本当かどうかを知るには両方を読む必要があり、重要な違いはたいてい、古い文言に見えるように言い換えられたものです。

原文との照合

翻訳されたページは流暢でも、条項が欠けていることがあります。そしてその流暢さこそが、それを見つけにくくします。2つをセクションごとに並べ合わせることで、欠落が明らかになります。

ナレッジベース

同じ質問に答える2つのヘルプ記事は1つより悪いものです。検索が両方を返し、それぞれが異なる形で少しずつ古くなっているからです。そのペアを見つけるのが難しい部分で、統合するのは難しくありません。

テキスト類似度チェッカーに関するFAQ

何を比較するのか、何ではないのか、3種類がどう違うのか、そして再実行について。

テキスト類似度チェッカーとは何ですか?

テキストを比較し、どこが一致するかを報告するツールです。ほとんどは単一のパーセンテージを報告しますが、それはいくつかの無関係な類似の種類を1つの数値に圧縮し、どれを見ているのかをあなた自身が判断しなければならなくします。

これは盗用チェッカーですか?

いいえ。ウェブと何かを比較することはなく、独自性の数値を出すこともなく、告発を裏付けるために作られたものでもありません。これは、あなたがすでに持っているテキストを比較し、どこでどのように重複しているかを伝えるものです。盗用サービスが必要な場合、これはそうではなく、その代わりにもなりません。

AllyHubのテキスト類似度チェッカーは無料ですか?

はい、一度に1つの比較であれば無料です。フォルダ同士の比較、より長い文書、そして許容できる重複の定義を保存して以降の実行に適用することは有料プランに含まれます。

3種類の違いは何ですか?

同じ文言とは、文が同じであり、それが意図的だったかどうかが問われるという意味です。同じ意味とは、言葉は違っても主張が重複しているという意味で、これが人々が見逃すものです。同じ構造とは、両方が共通の形に従っているという意味で、たいていはテンプレートであり、通常は問題ありません。

AllyHubは他のテキスト類似度チェッカーとどう違いますか?

ほとんどは数値とハイライトされた文書を返します。ここでは、すべての重複に位置と種類が付され、何もデフォルトで欠陥として提示されることはなく、あなたが許容できると判断したものが、次にどちらかの側が変わったときに適用されます。