문서를 요약합니다
글을 붙여 넣거나 파일을 놓으면 몇 문장으로 돌려줍니다. 모델은 기기로 내려받아 그 자리에서 돌고, 문서는 이 탭을 벗어나지 않습니다.
문서를 여기에 놓으세요
TXT · MD · HTML · PDF — 또는 아래에 글을 붙여 넣으세요
버튼을 누르면 런타임과 모델 약 249 MB 를 받습니다. 한 번만 받고 브라우저가 갖고 있습니다 — 다음 문서는 바로 시작합니다.
모델이 작습니다. 큰 줄기는 맞히고 세부는 틀릴 수 있습니다. 중요한 것은 문서에서 직접 확인하십시오.
제 문서는 어디로 갑니까?
어디로도 가지 않습니다. 이 탭 안에서 읽고 업로드하지 않습니다. 여기서는 그것이 특히 중요합니다 — 사람들이 가장 요약하고 싶어 하는 문서(계약서, 진단서, 공개 전 원고)가 바로 남의 서버에 붙여 넣으면 안 되는 문서이기 때문입니다.
왜 이 도구만 그래픽 카드를 요구합니까?
그래픽 카드 없이 도는 길이 없기 때문입니다. 이 모델의 ONNX 판은 프로세서 런타임에 구현이 아예 없는 연산을 쓰기 때문에 세션조차 열리지 않습니다. 프로세서에서 도는 가장 가까운 모델도 재 봤습니다 — 초당 0.9토큰, 짧은 문서 하나에 4분 가까이 걸립니다. 그런 것을 내놓느니 안 된다고 말하는 쪽을 택했습니다.
요약이 얼마나 정확합니까?
문서의 얼개는 잘 잡고 세부는 못 믿습니다. 3억 5천만 개짜리 모델입니다 — 탭에서 받아 돌릴 만큼 작고, 사실을 틀릴 만큼 작습니다. 실측에서 NADPH 를 존재하지 않는 화학 이름으로 풀어 쓴 적이 있습니다. 요약은 문서를 대신 읽어 주는 것이 아니라 문서의 지도라고 생각하십시오.
어떤 파일을 넣을 수 있습니까?
일반 텍스트, 마크다운, HTML, PDF 입니다. PDF 는 진짜 글자층이 있어야 열립니다 — 스캔한 쪽은 글자의 사진이라 꺼낼 것이 없습니다. 글자를 찾지 못했다는 말이 나오면 먼저 이미지·PDF → 텍스트 도구로 돌리고 그 결과를 여기에 붙여 넣으십시오.
다른 언어로 요약해 줄 수 있습니까?
못 합니다. 정하기 전에 재 봤습니다. 요약은 언제나 문서가 쓰인 언어로 돌아옵니다. 한국어로 옮기라고 하면 없는 낱말을 만들며 무너지고, 반대 방향으로는 지시를 무시합니다. 여섯 언어 중 둘에서 망가지는 언어 선택을 붙이는 것보다 아예 안 붙이는 쪽이 낫습니다.
왜 상한과 하한이 있습니까?
토큰은 영어로는 짧은 낱말 하나쯤, 한국어나 일본어로는 한 음절쯤입니다. 그래서 같은 분량도 언어마다 아주 다르게 세어집니다. 200토큰 아래에서는 모델이 요약을 멈추고 지어내기 시작합니다 — 빈 칸을 주었더니 있지도 않은 공중보건 캠페인의 요약을 자신 있게 내놓았습니다. 16,000토큰 위에서는 그래픽 메모리가 모자랍니다. 둘 다 실측한 값이고, 앞부분만 조용히 요약하는 대신 거부합니다.
어떤 모델이고 라이선스는 무엇입니까?
Liquid AI 의 LFM2.5-350M 을 ONNX 로 바꾼 것입니다. 같은 실문서로 후보 넷을 재 보고 골랐고, 원문을 되돌려주지 않고 실제로 요약한 유일한 모델이었습니다. 라이선스는 LFM Open License v1.0 입니다 — 카피레프트는 아니지만, 상업적 사용이 연매출 1천만 달러 미만이라는 조건에 걸려 있습니다. 이 사이트는 그 선에서 한참 멀고, 숨기느니 여기에 적어 둡니다. 가중치는 브라우저가 허깅페이스에서 직접 받아 갑니다 — 우리가 보관하거나 다시 배포하지 않습니다.