每日 AI 攻略学习已验证 2026年8月12日

通过 Qwen3 和 LM Studio 在本地分析数百页文档,无需将数据发送到云端

在你的电脑上运行具有128K上下文窗口的模型,获取任何大型 PDF 或 DOCX 文件的摘要、关键要点和文本问答

  1. 1.下载并安装 LM Studio - 一款用于在本地运行AI模型的程序。访问网站,选择适合你操作系统(Windows / Mac / Linux)的版本并安装。

    该程序免费,安装后可离线运行。如果在你所在地区无法打开网站,可尝试使用 VPN 下载,但模型运行本身不需要联网。

    LM Studio 关于该工具
  2. 2.打开 LM Studio,在搜索栏输入「Qwen3 32B GGUF」,下载量化版本(寻找文件名中带有 Q4_K_M 的 - 它在质量和内存消耗之间取得最佳平衡)。点击 Download。

    Qwen3 32B 模型支持最高128,000 token的上下文窗口 - 约等于300-400页文本。运行它建议有16GB以上内存。如果你的内存较少,可以找 Qwen3 14B 或 Qwen3 8B,它们也支持大上下文。

    LM Studio 关于该工具
  3. 3.模型下载完成后,切换到聊天标签(左菜单中的对话框图标)。在顶部下拉列表中选择已下载的 Qwen3 模型。在右侧设置面板中找到「Context Length」参数,将其设置为131072(或你的显卡/内存允许的最大值)。

    上下文窗口越大,占用的内存越多。如果模型无法启动,可将 Context Length 减小到65536或32768。对于大多数文档,32K 就够了。

    LM Studio 关于该工具
  4. 4.点击输入栏中的回形针按钮(或「Attach File」),选择你的文档 - PDF、DOCX 或 TXT。LM Studio 会提取文本并加载到模型上下文中。等待文件在聊天中显示为附件。

    ⚠️ 注意:文档在本地处理,不会发送到外部服务器。这对于机密材料是安全的。支持文本型 PDF;没有文本层的扫描件请先用 OCR 处理(例如免费的 OCR MyPDF)。

    LM Studio 关于该工具
  5. 5.将以下提示词粘贴到聊天中,将方括号中的文本替换为你的任务。点击 Send 并等待模型回复。

    根据文档大小和你的硬件性能,模型生成回复可能需要30秒到几分钟。进度可通过流式文本输出查看。

    LM Studio 关于该工具
    提示词
    你是一位资深分析师。请仔细阅读附件中的文档,并完成以下任务:
    
    1. 用5-7句话写一份简洁的摘要。
    2. 列出10个最重要的关键要点,以项目符号呈现。
    3. 提取文档中提到的所有日期、数字和专有名词。
    4. 仅根据文档内容回答以下问题:[你的文档相关问题]
    
    如果问题的答案在文档中找不到,请说:「文档中未包含此信息。」
    这个提示词的作用该提示词要求模型:1) 写5-7句摘要,2) 提取10个关键要点,3) 提取所有日期、数字和专有名词,4) 严格依据文档文本回答你的问题。请将[你的文档相关问题]替换为具体问题,例如「合同中指出了哪些风险?」或「项目的总预算是多少?」。如果你用中文提问,模型会以中文回答。
  6. 6.如有需要,可继续提出追问 - 模型在上下文中「记住」了整个文档,你可以进行对话而无需重新上传文件。

    聊天记录会保存在 LM Studio 中。要开始分析另一个文档,请点击顶部栏的「New Chat」,否则上下文会累积并导致速度下降。

    LM Studio 关于该工具
    提示词
    现在请比较文档中的[A]部分和[B]部分。突出它们之间的任何矛盾、重叠或遗漏之处。请以表格形式呈现比较结果。
    这个提示词的作用该提示词要求模型比较文档的两个部分,找出矛盾、重叠和遗漏,并将结果以表格形式呈现。请将[A]和[B]替换为部分的名称或编号,例如「第3部分」和「附录2」。
💰 跟着做需要花多少钱价格截至 2026-08
  • 免费LM Studio程序完全免费,不限制请求或文档数量。
  • 免费Qwen3 32B GGUF(模型)模型免费,可直接从 LM Studio 中下载。运行32B版本建议有16GB以上内存;更轻量的版本(8B、14B)可在8GB内存上运行。
试一试,做第一个打卡的人

为什么是今天

AI 服务变化很快 - 界面和免费额度可能与描述有所不同。