文書を要約する
文章を貼り付けるかファイルを置くと、数文で返します。モデルは端末に取り込まれてその場で動き、文書はこのタブから出ません。
ここに文書を置いてください
TXT · MD · HTML · PDF — または下に文章を貼り付け
ボタンを押すとランタイムとモデルを約 249 MB 取得します。 一度だけ取得してブラウザが保持します — 次の文書はすぐ始まります。
モデルは小さめです。大筋は合いますが細部は外すことがあります。大事なところは文書で直接ご確認ください。
私の文書はどこへ行きますか?
どこへも行きません。このタブの中で読み、アップロードはしません。ここではそれが特に重要です。人がいちばん要約したい文書、つまり契約書や診断書、未発表の原稿こそ、他人のサーバーに貼り付けてはいけない文書だからです。
なぜこの道具だけグラフィックカードが要るのですか?
それなしで動く道がないからです。このモデルのONNX版は、プロセッサ用ランタイムに実装が存在しない演算を使うため、セッションすら開きません。プロセッサで動く最も近いモデルも実測しました。毎秒0.9トークン、短い文書ひとつに4分近くかかります。そんなものを出すくらいなら、できないと言うほうを選びました。
要約の質はどうですか?
文書の骨組みはよく捉え、細部は当てになりません。3億5千万パラメータのモデルです。タブで取り込んで動かせるほど小さく、事実を間違えるほど小さいのです。実測では、NADPHを存在しない化学名に展開したことがありました。要約は文書の代わりではなく、文書の地図だと考えてください。
どのファイルが使えますか?
プレーンテキスト、Markdown、HTML、PDFです。PDFは本物の文字層があるものだけ開けます。スキャンしたページは文字の写真なので、取り出せるものがありません。文字が見つからないと出たら、まず画像・PDFからテキストへの道具を通し、その結果をここに貼り付けてください。
別の言語に要約できますか?
できません。決める前に試しました。要約はつねに文書が書かれている言語で返ります。韓国語へ移すよう指示すると存在しない語を作って崩れ、逆方向では指示を無視します。6言語のうち2つで壊れる言語選択を付けるくらいなら、付けないほうがましです。
なぜ上限と下限があるのですか?
トークンは英語なら短い単語ひとつ、日本語や韓国語なら1音節ほどにあたります。だから同じ分量でも言語によって数え方が大きく違います。約200トークンを下回ると、モデルは要約をやめて作り話を始めます。空欄を与えたところ、存在しない公衆衛生キャンペーンの要約を自信たっぷりに出しました。16,000トークンを超えるとグラフィックメモリが足りません。どちらも実測値で、前半だけを黙って要約する代わりに断ります。
どのモデルで、ライセンスは何ですか?
Liquid AI の LFM2.5-350M を ONNX に変換したものです。同じ実文書で候補を4つ実測して選びました。原文をそのまま返さず、実際に要約した唯一のモデルでした。ライセンスは LFM Open License v1.0 です。コピーレフトではありませんが、商用利用は年間売上1000万ドル未満という条件が付いています。このサイトはその線からはるかに遠く、隠すよりここに書いておきます。重みはブラウザが Hugging Face から直接取得します。私たちが保管したり再配布したりすることはありません。