使用指南
小木屋自动截图助手是一款 Windows 桌面截图与会议记录工具,集自动截图、本地语音转写、AI 总结于一体,支持一键导出 PPT / Word。
1. 安装与启动
双击 小木屋自动截图助手.exe 即可启动,无需安装 Python 环境。
数据文件保存在程序所在目录:截图及各类文字在 screenshots\ 会话文件夹中,配置在 config.json,语音模型在 models\。建议把程序放在固定文件夹长期使用。
💡 程序会记住主窗口位置大小、小窗布局等,下次启动自动恢复。
2. 界面概览
主窗口从上到下分为以下几个区域:
- 截图组 — 选择截图区域、手动截图、自动截图勾选框;启用语音转写后出现“语音转写 / AI 总结”运行开关
- 系统组 — 设置、关于(含使用指南入口)
- 记录组 — 记录名输入框、开始新记录、导入历史记录、生成 PPT、生成 Word、AI 会议纪要、打开导出目录
- 截图记录(左侧)— 缩略图列表
- 预览(右上)— 选中截图的大图
- 备注区(右下)— 截图备注 | 语音转写 | AI 总结 三列(启用对应功能后显示)
3. 截图操作
3.1 选择截图区域
- 点击【选择截图区域】或按 Ctrl+Alt+X
- 屏幕出现半透明蒙层,按住左键拖动框选
- 松开完成,并自动截一张图
💡 蒙层出现后任意时刻按 Esc 取消。区域会被记住,下次直接截图。
3.2 手动截图
点击【手动截图】按钮,或使用全局快捷键 Ctrl+Alt+Z(窗口未聚焦也能用)。截图自动保存、复制到剪贴板,备注框获得焦点可直接输入。
3.3 自动截图
勾选【自动截图】或按 Ctrl+Alt+A:程序定时检测区域画面,变化时自动保存截图。检测间隔与敏感度在 设置 → 自动截图 中调整。
4. 记录管理
一场会议或一节课程对应一段记录。相关操作集中在【记录】组:
- 记录名 — 直接输入,实时生效。用于会议纪要的“会议名称”、PPT 封面标题、Word 文档标题、窗口标题栏。每次打开程序为空,需为当次命名
- 开始新记录 — 结束当前记录:截图列表清空恢复“暂无截图”,记录名清空待重填;磁盘文件全部保留(软删除),可随时用【导入历史记录】找回
- 目录命名 — 有记录名时会话目录为 记录名-日期-序号(如 Q3发布评审-20260823-01);未命名则为 screenshots-日期_序号
5. 语音转写
开会/看课时开启,程序一边截图一边录音转文字。本地离线识别——无需联网、音频不上传。
5.1 启用与运行(两层开关)
| 层 | 位置 | 说明 |
|---|---|---|
| 功能启用 | 设置 → 语音转写 | 勾选“语音转写”(检查语音模型,缺则引导下载约 229MB,仅一次)。一次启用长期有效,启用后主界面/小窗出现运行开关与文本栏 |
| 运行开关 | 主界面/小窗【语音转写】 | 勾选 = 开始录音,取消 = 停止。只管启停,文本栏始终显示 |
5.2 工作方式
- 混录系统声音(会议播放的声音)与麦克风(自己说的话);设置中可关闭麦克风只录系统声音
- 文字实时滚动上屏,始终显示最新内容
- 每次截图时切一段:该段语音归属上一张截图(“这张图之后讲了什么”);连续静默达到设定秒数(默认 60 秒,可配置)也视为一段讲完,触发该段总结——保证最后一页也能被总结
- 转写开启时已有截图:之后到下一张截图之间的语音归属最后那张;开启时无截图则攒实时预览、并入首张
- 转写文本保存在 截图名.transcript.txt,实时落盘,崩溃不丢
5.3 手动修正
语音转写栏双击进入编辑,修改后点别处(或按 Esc)自动保存;后续识别内容追加在修改后的文本之后,不会覆盖你的修正。
6. 区分说话人(声纹)
设置 → 语音转写 → 勾选区分说话人(首次开启自动下载约 27MB 声纹模型)。
- 转写自动分段标注:【说话人1】:、【说话人2】:……同一音色自动归为同一人,换人时空行分隔
- 标记真人名:在语音转写栏(主窗或小窗)右键 → 选说话人 → 输入姓名 → 框内即时替换为 【张三】:(无弹窗);之后此人的语音自动用人名
- 声纹档案:标记的人名保存在 models\speakers.json,跨会议有效。设置页“已标记人名”列表可选中改名(自动同步全部记录)或删除,操作即时保存
- 识别阈值(设置页可调,录音中即时生效):同人阈值(默认 0.5)与归并阈值(默认 0.42)。同一人被拆成多个说话人 → 两者调低;不同人被并成一个 → 调高
- 开启声纹需重新勾一次“语音转写”生效;开启前已转写的内容不会补标
💡 同一人在“系统声音(远端)”和“麦克风(本地)”中音色特征不同,可能被判为两人。纯听讲场景建议关闭麦克风。
7. AI 总结
把每段语音逐字稿自动压缩成要点(云端大模型)。
7.1 启用与运行
- 启用:设置 → 语音转写 → 勾选“AI 总结”(需已启用语音转写;自动测试大模型连通,失败不让开)
- 配置:同页填写 OpenAI 兼容接口三要素——Base URL / API Key / 模型名称(DeepSeek、智谱 GLM、通义、Kimi 等国内厂商均支持),可点【测试连接】验证
- 运行:主界面/小窗勾选【AI 总结】。必须先开启语音转写;关闭语音转写时 AI 总结自动同步关闭
⚠ 隐私提示:开启 AI 总结后逐字稿将上传到所配置的云端大模型,首次开启需确认。
7.2 总结时机与立刻总结
- 每段语音讲完(截图切换或静默超时)自动生成该段要点,写入 AI 总结栏与 截图名.summary.txt
- 【立刻总结】按钮:对当前选中的截图立即总结(按钮显示“AI总结中...”并禁用防重复,完成/失败后恢复;AI 总结运行中才可点)
8. AI 会议纪要
开启语音转写 + AI 总结后,【记录】组的【AI会议纪要】按钮可用。
点击后把本次记录全部转写内容提交大模型提炼(不是整理流水账:忽略寒暄重复,保留决策结论/关键数据/核心概念/待办),生成 Word 文档并自动打开:
- 会议名称:取记录名输入框
- 会议时间:按首末截图时间计算,格式如 2026年8月23日 08:39:23 ~ 10:50:02 (2小时11分)
- 内容重点:条数不设上限,重要的全部列出
- 遗留待办事项:含负责人与时间(转写中提到才写)
💡 超长内容自动分段提炼再汇总;纪要保存在会话目录 会议纪要-日期时间.docx。
9. 小窗模式
会议/网课场景的常驻置顶小窗(【小窗模式】按钮或 Ctrl+Alt+M),主窗自动隐藏。
- 左侧预览:当前截图,滚轮/按钮翻页,双击用系统看图程序打开,右键查看/删除
- 右侧:备注 | 语音转写 | AI 总结(与主窗并列展示,可拖动分隔条调整比例并记忆)
- 底部按钮:截图、选区域、退出;自动截图/语音转写/AI 总结勾选框(与主窗联动);立刻总结;四个翻页图标(第一页/上一页/下一页/最后一页,悬停有提示)与删除
- 语音转写栏同样支持右键标记说话人、双击编辑
- 窗口位置/大小/分隔比例全部记忆
10. 截图管理
10.1 浏览与备注
左侧缩略图点击选中、双击打开原图、↑↓ 切换。选中后在备注栏输入,自动保存到 截图名.txt。
10.2 删除(配套同步原则)
截图与它的备注、语音转写、AI 总结是配套文件,删除时同步处理:
| 操作 | 快捷键 | 效果 |
|---|---|---|
| 删除(软) | Delete | 列表移除 + 配套文字文件一并删除;截图 PNG 保留在磁盘 |
| 彻底删除 | Shift+Delete | 截图 PNG + 全部配套文字一起删除,不可恢复 |
| 删除全部 | Ctrl+Delete | 所有截图(含文件)删除,先确认 |
是否弹确认框由 设置 → 常规 → 删除确认 控制。
11. 文件导出
【记录】组【生成PPT】/【生成Word】:
- 每张截图一页/一段,备注区按“手动备注 → AI 总结 → 语音转写”顺序拼接(各项可在 设置 → 导出 勾选是否携带,段间分隔线隔开)
- PPT:16:9,有记录名时首页为主题封面;页边距/背景色在 设置 → 导出 调整
- Word:微软雅黑排版,文档标题用记录名
- 文件保存在会话目录,生成后自动打开
12. 导入历史记录
【导入历史记录】选择一个历史会话目录:图片及其配套的备注/转写/总结文字批量找回(支持 png/jpg/jpeg/bmp),重名自动加序号。导入后与新截图待遇完全一致。
13. 设置详解
常规
- 删除确认开关
- 截图时是否隐藏本程序窗口(含仅重叠时隐藏、隐藏等待时长)
自动截图
- 截图检测间隔(1~10 秒)
- 变化敏感度(0.70~1.00,越低越敏感)
语音转写
- 功能启用:语音转写(检查模型)、AI 总结(测试连通)
- 录音选项:录麦克风开关、静默断段秒数(默认 60,录音中改即时生效)
- 区分说话人:声纹开关 + 已标记人名列表(改名/删除)
- 云端大模型:Base URL / API Key / 模型名称 + 测试连接
- 语音模型:状态与下载/检查更新
导出
- PPT 页边距、背景色
- 导出携带内容三项勾选(备注/AI 总结/语音转写)
快捷键
三分类(全局/截图列表/备注框)全部可自定义。
14. 快捷键一览
全局(窗口未聚焦可用,需管理员权限)
| 功能 | 快捷键 |
|---|---|
| 手动截图 | Ctrl+Alt+Z |
| 选择截图区域 | Ctrl+Alt+X |
| 自动截图开关 | Ctrl+Alt+A |
| 小窗模式 | Ctrl+Alt+M |
截图列表
| 功能 | 快捷键 |
|---|---|
| 切换截图 | ↑ / ↓ |
| 删除(软) | Delete |
| 彻底删除 | Shift+Delete |
| 全删 | Ctrl+Delete |
| 查看大图 | Ctrl+L |
| 复制截图 | Ctrl+C |
| 打开目录 | Ctrl+O |
备注框
| 功能 | 快捷键 |
|---|---|
| 聚焦备注 | Tab |
| 切换截图 | Alt+↑ / Alt+↓ |
| 删除当前图(软/硬) | Alt+Delete / Alt+Shift+Delete |
15. 常见问题
语音模型下载失败?
网络受限时可手动下载 model.int8.onnx(约 229MB)与 tokens.txt,放入 models\sense-voice-int8\ 目录。
识别不出声音?
确认系统正在出声;纯听讲场景关闭麦克风;连续两次截图间隔太短且无声的段会被跳过。
转写有小错误?
双击语音转写栏直接编辑修正,后续内容追加不覆盖。
同一人被标成两个说话人?
远端(系统声音)与本地(麦克风)音色特征不同所致,关麦克风只录系统声音可避免。
AI 总结/连接失败?
检查 Key 有效性与账户额度(401=Key无效/欠费);推理型模型(如 glm-5.3)较慢且可能先输出思考内容,建议 glm-4-flash / deepseek-chat 等非推理模型。
找回以前的记录?
【导入历史记录】选择当时的会话目录即可。
⚠ 首次运行提示
本软件为绿色免费软件,未购买商业代码签名证书,Windows SmartScreen 可能提示「无法识别的应用」——请点击「更多信息」→「仍要运行」即可正常使用。
个别杀毒软件可能因软件包含屏幕截图、全局热键等功能特征而误报(机器学习启发式判定)。
本软件不含广告与后门,不采集、不上传任何数据——截图与备注全部保存在本机程序目录,断网可完整使用。