通过 Qwen3 和 LM Studio 在本地分析数百页文档,无需将数据发送到云端
在你的电脑上运行具有128K上下文窗口的模型,获取任何大型 PDF 或 DOCX 文件的摘要、关键要点和文本问答
- 1.下载并安装 LM Studio - 一款用于在本地运行AI模型的程序。访问网站,选择适合你操作系统(Windows / Mac / Linux)的版本并安装。
该程序免费,安装后可离线运行。如果在你所在地区无法打开网站,可尝试使用 VPN 下载,但模型运行本身不需要联网。
LM Studio ↗关于该工具 - 2.打开 LM Studio,在搜索栏输入「Qwen3 32B GGUF」,下载量化版本(寻找文件名中带有 Q4_K_M 的 - 它在质量和内存消耗之间取得最佳平衡)。点击 Download。
Qwen3 32B 模型支持最高128,000 token的上下文窗口 - 约等于300-400页文本。运行它建议有16GB以上内存。如果你的内存较少,可以找 Qwen3 14B 或 Qwen3 8B,它们也支持大上下文。
LM Studio ↗关于该工具 - 3.模型下载完成后,切换到聊天标签(左菜单中的对话框图标)。在顶部下拉列表中选择已下载的 Qwen3 模型。在右侧设置面板中找到「Context Length」参数,将其设置为131072(或你的显卡/内存允许的最大值)。
上下文窗口越大,占用的内存越多。如果模型无法启动,可将 Context Length 减小到65536或32768。对于大多数文档,32K 就够了。
LM Studio ↗关于该工具 - 4.点击输入栏中的回形针按钮(或「Attach File」),选择你的文档 - PDF、DOCX 或 TXT。LM Studio 会提取文本并加载到模型上下文中。等待文件在聊天中显示为附件。
⚠️ 注意:文档在本地处理,不会发送到外部服务器。这对于机密材料是安全的。支持文本型 PDF;没有文本层的扫描件请先用 OCR 处理(例如免费的 OCR MyPDF)。
LM Studio ↗关于该工具 - 5.将以下提示词粘贴到聊天中,将方括号中的文本替换为你的任务。点击 Send 并等待模型回复。
根据文档大小和你的硬件性能,模型生成回复可能需要30秒到几分钟。进度可通过流式文本输出查看。
LM Studio ↗关于该工具提示词你是一位资深分析师。请仔细阅读附件中的文档,并完成以下任务: 1. 用5-7句话写一份简洁的摘要。 2. 列出10个最重要的关键要点,以项目符号呈现。 3. 提取文档中提到的所有日期、数字和专有名词。 4. 仅根据文档内容回答以下问题:[你的文档相关问题] 如果问题的答案在文档中找不到,请说:「文档中未包含此信息。」
这个提示词的作用该提示词要求模型:1) 写5-7句摘要,2) 提取10个关键要点,3) 提取所有日期、数字和专有名词,4) 严格依据文档文本回答你的问题。请将[你的文档相关问题]替换为具体问题,例如「合同中指出了哪些风险?」或「项目的总预算是多少?」。如果你用中文提问,模型会以中文回答。 - 6.如有需要,可继续提出追问 - 模型在上下文中「记住」了整个文档,你可以进行对话而无需重新上传文件。
聊天记录会保存在 LM Studio 中。要开始分析另一个文档,请点击顶部栏的「New Chat」,否则上下文会累积并导致速度下降。
LM Studio ↗关于该工具提示词现在请比较文档中的[A]部分和[B]部分。突出它们之间的任何矛盾、重叠或遗漏之处。请以表格形式呈现比较结果。
这个提示词的作用该提示词要求模型比较文档的两个部分,找出矛盾、重叠和遗漏,并将结果以表格形式呈现。请将[A]和[B]替换为部分的名称或编号,例如「第3部分」和「附录2」。
💰 跟着做需要花多少钱价格截至 2026-08
- 免费LM Studio程序完全免费,不限制请求或文档数量。
- 免费Qwen3 32B GGUF(模型)模型免费,可直接从 LM Studio 中下载。运行32B版本建议有16GB以上内存;更轻量的版本(8B、14B)可在8GB内存上运行。
试一试,做第一个打卡的人
为什么是今天
LM Studioweb
每周攻略发到邮箱
AI 服务变化很快 - 界面和免费额度可能与描述有所不同。