为什么"粘进 ChatGPT"不是全部答案
云端聊天机器人擅长摘要你能粘进对话框的短东西。当来源不再是一段文字 —— 变成一整篇长文、一份 40 页的 PDF、一份 Word 文档、一张页面照片 —— 工作流开始漏了。你复制粘贴丢了格式;文章因为太长被截断;PDF 必须被上传,这对新闻文章没问题、对合同和病历、对未出版的手稿就尴尬了。
这不是说 AI 摘要是坏主意。这是说工具该在文档所在的位置迎上它 —— 本地、以它本来的格式、且最好不要往你不控制的服务器跑一趟。这现在是可以做到的事。
"所有格式"实际是哪些
一款值得装的摘要工具应该能处理阅读实际会以哪些形式出现的整个动物园。实际上,是五桶:
- 网页文章 —— 粘一条 URL,工具抓页面、剥掉广告与导航栏,摘要剩下的内容。长文、随笔、博客文章、维基页面。
- PDF —— 报告、白皮书、研究论文、合同、登机牌大小的收据、书籍级别的手稿。文本在本地抽出,什么都不上传。
- Word 和文本文件 —— DOCX、纯 TXT、Markdown、HTML 文件、RTF。同事真正会发给你的那些格式。
- 文字照片 —— 纸质书里的一页、白板、印刷讲义、文字无法选中的截图。设备端 OCR 把词从图片里读出来;然后在这些词上跑摘要。支持拉丁与 CJK 字符,所以英文、欧洲语言、中文、日文、韩文的页面都能用。
- 视频 —— 如果你逃避的"阅读"其实是一支三小时 YouTube 播客,那有它自己的指南。
粘贴到云端 vs 专用网页工具 vs 设备端 App
做这件事的三条大路,诚实对比:
| 做法 | 最适合 | 取舍 |
|---|---|---|
| 粘进 ChatGPT / Claude / Gemini | 你不介意分享的短网页文章 | 长度上限、对 PDF 糟糕、粘什么都上传 |
| 云端"摘要"网页工具 | 公开文档上的偶尔一用 | 把文件上传到你不拥有的服务器;免费额度常有质量限制 |
| 设备端 App(Gist&Chat) | 一切,尤其是私密文档 | 模型一次性下载;能力上限低于最大的云端模型 |
操作步骤:三秒到摘要
URL 里的文章
复制文章 URL 粘进 App。页面被抓取、广告和导航被剥掉,模型摘要剩下的内容。适用于大多数现代文章站点,包括你在自己浏览器里已经登录能看的付费墙文章。
PDF 与文档文件
点文件按钮,从手机存储或某个云盘的分享菜单里选 PDF(或 DOCX/TXT/MD/HTML/RTF)。文本在其他任何事之前先在本地被抽出来。长 PDF 会分几轮处理,以确保整篇文档都被覆盖 —— 不是只有前几页。
文字照片
拍一张 —— 或者从相册选一张 —— 你想摘要的页面。设备端 OCR 把文字读出来;摘要在这段文字上跑。纸质书流程,终于有了。
然后:追问它
每一份摘要都自带一个后续对话。"第二作者不同意的是哪一点?""跳到讲定价的那一节。""用大白话解释那张图。"AI 仍然把整份文档装在脑子里,所以答案是基于你给它的内容。
为什么"离线"对文档来说是比对聊天更大的特性
一句随口的聊天消息和一份法律合同,隐私权重完全不同。当你把整份 PDF 粘进云端工具时,你 —— 毫不夸张地说 —— 是在把那份文档的一份副本存到别人的基础设施上,受制于他们的保留政策、他们的转包商、以及未来客气来问的政府。对于一篇新闻文章,没问题。对于你的雇佣协议、你孩子的 IEP、你小说的早期草稿、你的体检报告、或者你尚未发表的研究论文,显然不 OK。
设备端版本从架构上就不同 —— 我们在《设备端 AI 到底是什么》里细讲。文档被打开、被读、被摘要,全程不离开你的手机。飞行模式测试在这里跟对私密聊天一样有效:关掉网络,跑摘要,观察文档哪都不去。
诚实的边界
不列出工具做不到什么的指南是广告。直说:
- 很长的文档要更久。一份 300 页 PDF 是很大的文本量;模型分段读,那要真实的秒数。不是分钟 —— 但也没有短网页文章那种近乎即时的手感。
- 扫描版 PDF 需要 OCR。如果 PDF 是一页扫描图(PDF 壳里包了张图),抽文本会拿不到任何文字。改用照片路径截图那一页,或者先在桌面 OCR 工具里处理一下。
- 登录墙后的文章需要你已登录。URL 摘要看到的是浏览器在那 URL 看到的。如果文章在付费墙或登录后面,抓到的页面就是登录框。先"打印 → 存为 PDF"再摘要那份 PDF。
- 紧凑模型 < 前沿云端模型。设备端模型不是最大的云端巨头。在摘要、翻译、以及对文档做问答 —— 本文关心的任务 —— 差距小、隐私收益完全。要最顶端的专家推理,云端仍赢。
读得更快。什么都不上传。
Gist&Chat —— 摘要文章、PDF、文档和文字照片的设备端 AI,然后跟你就它们对话。Android 免费。
- 所有格式 —— URL · PDF · DOCX · TXT · MD · HTML · RTF · 照片(OCR)
- 什么都不离开你的手机 —— 用飞行模式验证
- 追问摘要 —— 整份文档在记忆里的后续对话
- 11 种语言 —— 界面与摘要
- 免费上手 —— 无账号、无上传、无广告
免费下载 · 模型在 Wi-Fi 下一次性下载 · 几乎不需要存在的隐私政策
常见问题
我可以在不上传的前提下总结一份 PDF 吗?
可以。Gist&Chat 在你的手机上打开 PDF、在本地抽出文本,喂给同样跑在手机上的语言模型。什么都不上传 —— 当这份 PDF 是一份合同、一份病历、或一段你还不想交给云端服务商的研究时,这就是全部意义。
支持哪些文件格式?
PDF、Word(DOCX)、纯文本(TXT)、Markdown(MD)、HTML 文件、RTF —— 外加任意网页文章的 URL,以及任意文字照片(通过设备端 OCR)。有效地说:只要可读,就能摘要。
能总结一张截图或一页纸的照片吗?
能。设备端 OCR 把图片里的文字读出来 —— 拉丁字符和 CJK 字符都支持,所以英文、欧洲语言、中文、日文、韩文的页面都能处理 —— 然后在那段文字上跑摘要。对纸质书、白板、以及文字无法选中的截图非常有用。
文章或 PDF 有长度上限吗?
语言模型一次能持有的文本量是有上限的,长文档会被切段分几轮处理,以确保整篇都被覆盖 —— 而不只是前几页。实际上,书籍级别的 PDF 也能处理;只是摘要生成时间会更久。
AI 在本地跑,我的文档真的私密吗?
是的 —— 结构性地,不是承诺性地。文件从不离开手机。你可以自己验证:开飞行模式跑一次摘要 —— 如果它照样工作,那份文档就可证明地不去任何地方。
gist-ai.net 上更多阅读:如何用 AI 总结任意 YouTube 视频、设备端 AI 到底是什么(以及它为什么可行)、设备端小语言模型与 Gemma 4 为什么改写了地图、在飞行模式下也能用的 AI 聊天、2026 年真正能用的离线 ChatGPT 替代方案、用口袋里的 AI 练习语言、YouTube 上 8 个最好的播客,以及更多免费工具 —— 永远无需注册。