mianaz/jargonslayer / docs / zh / 使用指南
主页 English App GitHub
使用指南

JargonSlayer 文档

JargonSlayer 是面向非英语母语者的英文会议实时理解助手。它把会议转录成文本,识别习语、商务黑话、委婉表达、缩写、专有名词和领域术语,并生成简短解释卡片。会议结束后,可以生成双语纪要、全文翻译、学习卡片和可导出的笔记。

无账号 词典模式 BYOK AI 本地 Whisper IndexedDB 历史 远程词典包 macOS 桌面版 iOS 测试版 Chrome 插件

这一页是动手指南:安装、开一场会议、会后复盘。另外三个页面讲得更深:

79 秒无声演示:实时转录、解释卡片、双语纪要(网页版,录制于 v0.7.1)

快速开始

三条路都能跑起来 JargonSlayer,全部免费:macOS 桌面版(最省事,签名安装包)、网页版(在线体验或本地自托管)、Chrome 插件(轻量划词查词)。iOS 测试版可通过 TestFlight 受邀使用。

桌面版(macOS,Apple Silicon)

  1. releases/latest 下载签名并公证的 DMG。
  2. 打开 DMG,把 JargonSlayer 拖进「应用程序」,启动它。
  3. 首次启动会出现一个全屏向导。macOS 26+ 上第一步是选引擎:系统识别(System Speech,零安装)——选它就跳过整个安装流程,直接可用;或 Whisper(更高质量),继续原有安装流程。Whisper 路径下,点击 开始安装 之前不会下载任何东西:随后它会把独立的 Python 运行环境、faster-whisper 和你选的模型(预选 medium)全部装进应用自己的数据目录,不碰系统 Python。
  4. 向导结束后还有两步可跳过的引导:连接 OpenRouter(用于 AI 检测/解释)、填入 Hugging Face token(用于说话人分离)。详见下方「桌面版」。
仅支持 Apple Silicon——没有 Intel 版本。应用本身在更旧的 macOS 上也能装,但「系统/App 音频」这一个引擎需要 macOS 14.4+,「系统识别」(System Speech)需要 macOS 26+,「英文加速」(Parakeet)模型需要 macOS 14+;低于对应版本时,每个选项都会显示为禁用并附带说明。

网页版

先试试 在线体验——零安装。不管走哪条路,最快理解产品的方式都是内置演示:打开 菜单 → 演示,不需要麦克风,也不需要 API Key。它会回放一段脚本化的产品会议,走完整条流水线——转录、高亮表达、卡片,配置了 AI 的话还有双语纪要。

或者自己跑起来:

git clone https://github.com/mianaz/jargonslayer.git
cd jargonslayer
npm install
npm run dev
# 打开 http://localhost:3000

如果需要更接近生产环境的本地运行方式,使用 npm run buildnpm start。环境变量、部署层级和本地 Whisper sidecar 的说明见「高级玩法」。

Chrome 插件(JargonSlayer Lite)

releases 下载 zip 并解压,然后打开 chrome://extensions → 开启「开发者模式」→「加载已解压的扩展程序」→ 选中解压后的文件夹。插件暂不上架 Chrome 网上应用店,手动加载就是正式的安装方式(和很多开发者工具的分发方式一样)。Lite 在侧边栏里提供实时麦克风转录、内置词典和设备端翻译——没有 LLM 检测,没有标签页/系统音频,也没有账号;完整能力对比见「功能页的能力矩阵」。

iOS(TestFlight 内测)

iOS 版目前是 TestFlight 内测,受邀制——联系作者获取邀请。需要 iOS 26+,识别和翻译都在设备本地完成(系统语音识别 + Apple 翻译),不需要 API Key。如果现在就想在手机上用 JargonSlayer,网页版也能通过 Safari 添加到主屏幕,作为 PWA 使用。

选择适合的配置

合适的模式取决于会议本身——主要看音频有多敏感、愿意花多少功夫配置。从最接近的一行开始:

使用场景推荐配置取舍
30 秒体验产品在线体验 + 演示零配置,但预览 AI 文本走预览提供商路径。
日常低敏会议浏览器识别 + BYOK AI实时配置最简单;音频会进入浏览器厂商语音服务。
隐私敏感会议本地 Whisper + 词典模式音频和文本都留在本机,但解释能力限于词典和个人词典。
既要隐私又要上下文检测本地 Whisper + Ollama OpenAI 兼容端点可全本地,但质量取决于本地模型。
听懂线上会议中对方声音macOS 桌面版:系统/App 音频,零额外配置。网页版:标签页音频或虚拟声卡 + 本地 Whisper。桌面版只需要一次性授权;网页版需要 sidecar,用虚拟声卡还要额外的系统级路由设置。
分析会后录音短文件用浏览器音视频导入;大文件/说话人分离用 sidecar 导入浏览器路径最省事;sidecar 路径适合重任务。

示例:完全本地配置,一步步来

最严格的配方——什么都不出这台机器,不需要 Key,也不需要账号:

  1. 桌面版:从 DMG 安装,向导里选 Whisper(macOS 26+ 也可以选系统识别)。网页版:本地运行,并启动 Whisper sidecar
  2. 在设置里关掉 AI 检测——内置词典仍会即时检测,完全离线。
  3. 如果需要实时翻译,在 翻译引擎 里选平台自带的本机引擎(网页版是 Chrome 内置翻译器,桌面版/iOS 是 Apple 翻译框架),而不是 LLM。
  4. webhook 和文件夹自动导出不配置,或者只指向本机路径。

其他每种配置下具体有哪些数据会离开本机,见下方「隐私」表格。

示例:线上会议需要听到对方声音

  1. macOS 桌面版:选系统/App 音频作为音频来源,开始监听,授权一次性的「系统音频录制」权限——就这样。Zoom、Teams、微信里的声音都能进来;这个来源永远不会捕获你自己的麦克风。
  2. 网页版:用标签页音频分享会议标签(在线体验内置一个免 Key 的限量试用),或者用 BlackHole(macOS)/ VB-Cable(Windows)等虚拟声卡把系统音频路由进本地 Whisper。

会议流程

1. 开始监听

先选「音频来源」(麦克风 / 浏览器标签页 / 系统音频 / 导入),再选引擎——选择器里按 本地 STT 模型 / 系统 STT 服务 / 第三方 STT 提供商 分组——然后点 开始监听。音频来源从 v0.7.4 起是独立控件,会议进行中也能随时切换,不再只能会前选定。最终转录片段会进入正文区域;未定稿的中间结果会以更弱的样式显示。

2. 阅读卡片

右侧显示表达解释卡和术语卡。缩写、公司名、产品名、指标、技术术语会进入术语通道;重复命中只增加次数,不刷屏。

3. 会后复盘

停止会议后生成报告,导出 Markdown、Anki TSV、JSON 或 Cornell 笔记,也可以之后从历史中重新打开。

  • 点击转录里的下划线表达,可以跳到对应卡片。
  • 选中任意转录文本即可查询。v0.7.4 起,先列出命中的词典包和义项;真查不到时结合上下文解释并翻译。解释在后台生成,关掉弹窗也不会丢,做完自动并入卡片列表。加入我的词典是弹窗里的次要动作,不再是唯一出口。
  • 说话人可以手动指定:单句,或一次选中多句一起改,单句操作里有「应用到本句及之后」;实时监听时侧边跟着一个「当前说话人」标记。手动指定过的句子会被锁定,后续自动说话人分离不会覆盖它。点击说话人标签即可改名。

悬浮字幕

菜单打开悬浮字幕,实时转录会弹成一个小小的置顶字幕视图——只显示最后一句定稿、正在识别的中间句,加最近一条解释释义。网页版用的是 Document 画中画窗口(Chrome/Edge 116+;浏览器没有这个接口时,菜单项自动隐藏)。桌面版没有第二个窗口,而是把主窗口自己缩成一条无边框字幕条,随便点哪儿都能拖动,关掉再还原成原来的大小。它适合压在视频通话上层看,主应用退到后面。iOS 没有这条路径,菜单里不显示。

崩溃恢复

会议进行中会实时写自动草稿。页面刷新、标签页被关、浏览器崩溃后重新打开,历史里会出现一条恢复到历史记录横幅,把中断前的内容一键找回,一次意外不至于赔掉整场会议。

翻译

实时双语字幕和全文翻译共用一套设置:设置里的 双语转录 开关正上方是 翻译引擎 选择器。四种引擎可选:平台自带的本机翻译(系统翻译——网页版是 Chrome 内置的 Translator API,桌面版/iOS 是 Apple 翻译框架;默认选项,不需要 Key)、LLM、DeepL(自备 Key),以及有道翻译(Youdao,自备 Key,v0.7.1+)。DeepL 和有道都是原生 App 专属引擎——网页版会把它们显示为禁用,因为两家 API 都不支持浏览器跨域请求,所以网页版实际能选的只有本机翻译或 LLM。有道需要在 ai.youdao.com 创建应用(服务选「文本翻译」、接入方式选「API」)拿到应用ID和应用密钥,按字符量计费(英译中约 ¥48/百万字符,新用户有体验金)。

会议结束后,只要双语字幕开着、还有没翻译成功的片段(比如某次 API 调用失败,或翻译时没配 Key),工具栏就会出现补全翻译 (N)按钮——点一下用当前配置的翻译引擎分批补齐,补完自动消失。

转录引擎

网页版和桌面版的引擎清单不一样——桌面版完全没有浏览器识别(Tauri 的 webview 没有 Web Speech API),但多了网页版做不到的、基于 CoreAudio 的系统/App 音频捕获。引擎选择器是底部状态栏里的一个下拉菜单,各种屏幕宽度下都一样。

按类型分组(v0.7.4):引擎选择器现在分三组——本地 STT 模型(本地 Whisper、英文加速这类自己跑的模型)、系统 STT 服务(浏览器识别、系统识别这类系统自带的识别)、第三方 STT 提供商(Soniox、Deepgram、ElevenLabs 这类自备 Key 的云端服务)。第三方服务没配 Key 也常驻显示,标注「已配置」或「未配置」,不会因为没配置就被隐藏。

网页版

引擎配置成本音频去向适合场景
演示无需配置无音频;脚本回放无需麦克风或 Key 即可体验
浏览器识别无需配置,推荐 Chrome/EdgeChrome 139+ 有本地语言包时仅本机(设备端);否则浏览器厂商的语音服务(云端)日常低敏会议
本地 WhisperPython sidecar(手动安装,见「高级玩法」)本机 127.0.0.1隐私敏感、离线、稳定转录
标签页音频同一个本地 sidecar本机捕获线上会议中对方的声音
Soniox(实验)Soniox API Key(自备)直连 Soniox 实时接口(云端,你自己的 Key)中英夹杂实时场景;通过内部基准测试前保持「实验」标记;在线体验另有限量试用,见下方说明
DeepgramDeepgram API Key(自备)云端处理(Deepgram,你自己的 Key)纯英文会议,追求云端识别质量
ElevenLabsElevenLabs API Key(自备)云端处理(ElevenLabs,你自己的 Key);默认会留存转录内容,企业版才有免留存选项另一个按量计费的云端识别选项
线上会议注意:麦克风通常只听得到你自己。Zoom、Teams、Meet 等场景如果要听到对方声音,可使用标签页音频;或在 macOS 用 BlackHole、Windows 用 VB-Cable 把系统音频路由成输入,再配合本地 Whisper。
在线体验的限量试用:预览部署内置一个 Soniox 云端识别的限量试用——不需要自己的 API Key,每人每天最多 3 段、单次最长约 10 分钟,总额度先到先得用完即止;音频经 Soniox 云端转写,不落盘留存。标签页音频也跟着在线体验一起回归,走的是同一份试用额度,不再要求本地 sidecar。在线体验现在也接受你自己的 Soniox / Deepgram Key:在设置里填入后,会话由浏览器直连、走你自己的账户,不受试用限额(有 Key 时始终优先于试用)。自托管/本地部署的 Soniox 仍然是 BYOK,不受这个限额影响。

桌面版(macOS)

引擎配置成本音频去向适合场景
麦克风 · 本地 Whisper无需配置——应用自带自管本机默认日常引擎,开箱自带 medium 模型
麦克风 · Soniox(实验)Soniox API Key(自备)直连 Soniox 实时接口(云端,你自己的 Key)和网页版一样,面向中英夹杂场景
系统/App 音频无需配置——同一个内置本地 Whisper本机捕获在 Zoom、Teams、微信等原生 App 里开会时对方的声音,不用虚拟声卡
系统识别(System Speech,v0.4.3)无需配置——macOS 原生识别,不下载模型、不装 Python本机,且音频不出捕获进程macOS 26+ 上免安装的第一场会;约 30 种语言,术语表参与识别偏置;不支持说话人分离,中文可能不带标点
英文加速(Parakeet,v0.4.4)模型选择器里手动开启,非默认——需 Apple 芯片(M 系列)+ macOS 14+,约 2.5GB(含约 1GB MLX 运行环境)本机,音频不离开这台设备英文优先的会议;比 Whisper 快得多(批量推理约百倍实时);暂不支持实时说话人分离

桌面版没有浏览器识别引擎;网页版的标签页音频,在桌面版对应的位置是系统/App 音频。权限流程和捕获范围见下方「桌面版」。

导入

所有导入都归到 历史 里——导入中心覆盖粘贴的文稿、文件和 URL,每次导入的结果都会变成一个可以正常分析、翻译、导出的已保存会话。

文稿导入

  1. 打开 历史,选择 导入文稿
  2. 粘贴文本,或上传 .txt.srt.vtt
  3. 检查解析后的片段、时间戳和说话人。
  4. 可选:同时生成中文对照。
  5. 导入并分析,结果会保存为已停止的会议。

音频/视频文件

  1. 打开 历史,选择 导入录音
  2. 选择浏览器本地转录,或本地 Whisper sidecar 路径。
  3. 常见音频文件可直接导入;视频文件会先在浏览器内用 ffmpeg.wasm 提取音轨。
  4. 使用 sidecar 路径时,如果配置了 pyannote,可以做说话人分离。
浏览器导入的限制:单个文件最长 45 分钟、最大 200 MB;首次使用会下载浏览器侧 Whisper 模型资源。时长更长或体积更大的录音建议走 sidecar 路径,同时还能解锁说话人分离。

视频 URL 导入

视频 URL 导入只属于本地版。sidecar 会在你的机器上调用 yt-dlp,再走本地转录任务管线;在线体验不提供这个服务器侧能力。

谨慎使用 URL 导入。服务器侧抓取第三方视频涉及平台条款和法律风险,所以项目把这条路径限制在用户自己的机器上,而不是放进在线体验演示。

桌面版

桌面版把同一个应用装进原生 Tauri 外壳,本地 Whisper 由应用自己安装和管理——安装步骤见「快速开始」。这一节只讲桌面版独有的部分:系统/App 音频引擎、两步可选引导、后台任务中心、延迟提示、更新检查。

51 秒无声演示:桌面版——系统/App 音频、引擎清单、悬浮字幕(录制于 v0.7.1)

系统/App 音频

系统/App 音频做音频来源,就能转录 Zoom、Teams、微信这类原生 App 里对方说的话——不需要虚拟声卡,不需要装 BlackHole/VB-Cable。它替换了桌面版旧版那个只能失败的「标签页音频」——Tauri 的 webview 里没有标签页分享选择器可以调用;网页版的标签页音频不受影响。

  • 捕获范围:这台 Mac 当前正在播放的所有声音——会议对方的话,但如果同时在放音乐或弹通知音,也会被录进去。它从不捕获麦克风。
  • 权限:macOS 会在你真正开始用这个引擎监听时(不是选中它的那一刻)弹一次「系统音频录制」授权——这是它自己的 TCC 权限类别,和麦克风、屏幕录制完全分开。
  • 系统版本:需要 macOS 14.4 或更高版本。低于这个版本,选项会在选择器里显示为置灰并注明原因,而不是直接隐藏。
  • 音频去向:仅本机——音频只送到内置的 Whisper sidecar,不会去别处;跟麦克风类引擎一样,状态栏显示「音频在本地处理」。
如果 macOS 拒绝了授权:应用会显示一个按钮,直接跳转到 系统设置 → 隐私与安全性 → 屏幕与系统音频录制;如果这个深度链接没跳到正确的面板,手动打开这个路径总是有效的。

首次引导

安装向导跑完之后(不是每次启动都出现——已经有健康本地服务的老用户不会被重复打扰),会出现两步各自独立、都能跳过的引导:

  1. 连接 OpenRouter——直接粘贴已有的 Key,或者点「使用 OpenRouter 登录」走一键 OAuth:应用会打开你的系统默认浏览器完成登录,再自动把控制权交还给应用。如果 OAuth 失败,会有一个回退链接指向 openrouter.ai/keys,去创建并粘贴 Key。这一步打通的是 AI 检测、翻译和会后报告。
  2. 说话人分离 token——粘贴一个 Hugging Face token,前提是已经在 Hugging Face 上接受了 pyannote 的 segmentation 和 speaker-diarization 两个模型的使用条款(这一步直接给出两个链接)。跳过是零摩擦的默认选项——说话人分离会保持关闭,直到你回来配置。

这两步写入的设置和手动填写是同一处。v0.7.4 起,Key/token 本身存在 设置 → 密钥 里,这里填过的值和之后手动填的效果完全一样。两步都跳过也完全不影响正常使用云端/无需 BYOK 的功能。

后台任务中心

Header 里有一个「后台任务」入口(仅桌面版),有任务在跑或者有新版本可用时会亮一个提示点。打开后分两个区:

  • 系统状态——「本地服务」一行显示 托管(应用自己管)还是 外部(你自己起的 sidecar)模式,加上 运行中 / 未连接 / 未知 状态,旁边有「重新检测」按钮可以随时手动探测;「应用更新」一行见下方「更新检查」。
  • 任务——模型下载、说话人分离扩展安装,以及各种导入任务,每个都有进度显示。模型下载或分离扩展安装失败会出现「重试」按钮;已完成的导入任务点一下就跳转到对应会话。
排障:模型下载中途失败,点「重试」会重新发起下载——因为模型来自 Hugging Face 自己的下载缓存,网络抖一下通常不会导致从零开始。如果「本地服务」显示未知,说明应用还没探测过(或者上一次探测没有返回),点「重新检测」,或者直接去 设置 → 转录引擎 里查看。

转录延迟提示

正在使用本地 Whisper 类引擎监听时(麦克风 Whisper、标签页音频、系统/App 音频),只要解码延迟持续超过约 2 秒,状态栏就会亮起一个 延迟 ~Ns 的提示。这是「机器/模型这个组合快跟不上实时了」的预警,不是错误——如果经常出现,换成更轻的模型(small)通常能在老机器上解决。

更新检查

应用每次启动会安静地检查一次 GitHub 上的最新发布(带 ETag 缓存,重复检查很轻量),在 后台任务 → 系统状态 里显示当前版本和最新版本,随时可以点「重新检查」。这只是一次检查,不是自动安装:有新版本时,点「打开下载页」跳转到 GitHub release 页面,自己下载安装。

AI 模式与模型配置

词典模式

在设置中关闭 AI 检测,转录文本就不会因为 AI 检测离开本机。内置词典仍会即时检测固定表达和术语。这是零 Key、零成本、本地文本路径——自 v0.6 起,这是新安装的默认模式;AI 模式转为可选。

在线体验 AI

没配 Key 时,在线体验走预览服务器配置好的模型路径:文本经项目服务器内存中转,再转发到 OpenRouter,带 data_collection=allow,模型只能在预置列表里选。请把这条路径下的 AI 文本视为会与模型提供商共享。

填入自己的 Key 后,在线体验切换为浏览器直连:每次 AI 调用都从你的浏览器直接发往你配置的服务商,模型随意选,Key 和会议内容不经过项目服务器——服务端还会直接拒绝任何带 Key 的转发请求。自定义 OpenAI 兼容端点在体验版上需要支持浏览器跨域(CORS),不支持的端点请用自托管或桌面版。

BYOK AI

  1. 打开 设置 → AI 检测,选择服务商预设——Anthropic、OpenAI、DeepSeek、通义千问、OpenRouter、Poe、本地 Ollama,或自定义 OpenAI 兼容端点。
  2. 按需填写 base URL。
  3. 设置 → 密钥 里输入 API Key(见下方说明)、用一键 OAuth 连接 OpenRouter,或使用 ANTHROPIC_API_KEY 等服务端环境变量。
  4. 回到 AI 检测,选择检测模型和报告模型,测试连接并保存。
密钥统一入口(v0.7.4):设置 → 密钥 现在收着所有 API Key 和 token——LLM 提供商、转录(Soniox/Deepgram/ElevenLabs)、翻译(DeepL/有道)、说话人分离用的 Hugging Face token——此前这些分散在五个不同功能区各自的入口里。存储位置和钥匙串托管方式都没变。
设置里的密钥统一入口,每个服务商一个独立字段
设置 → 密钥(v0.7.4):所有 Key 和 token 收在一处,每个服务商一个独立字段
Key 处理:UI 输入的 Key 存在本地浏览器。自托管网页版调用时经你自己服务器的 API 路由内存转发,不落盘;在线体验则完全不把 Key 发给项目服务器——调用由浏览器直连服务商。环境变量方式可以让 Key 完全不进入浏览器。桌面版的 OAuth 走的是系统默认浏览器(RFC 8252 loopback),不是应用内弹窗——这个流程首次启动时的版本见「桌面版」。v0.7.3 起,各服务商的 Key 各自独立存储、独立发送,切换服务商不会把上一个的 Key 带到新的那边。

分任务模型

高级设置可以为检测、翻译、报告使用不同提供商或模型。常见策略是实时检测用快而便宜的模型,会后报告用更强的模型。完整设置项参考见「高级玩法」。

AI 状态面板

从底部状态栏打开 AI 状态,能一眼看清 AI 到底在做什么。检测、解释、翻译、报告四类任务分别显示各自用的模型、路由方式(自带 Key / 服务端代理 / 未配置),以及调用、失败、QC 丢弃的累计次数。状态栏还有一个随时能瞄一眼的状态小标。没配 Key 时,面板会直接告诉你哪些功能回退到词典、哪些暂不可用,而不是默默出错。

复习与学习

/review 页面把历史会议和个人词典变成轻量学习中心。

JargonSlayer 复习页面
复习页:统计、词云、高频列表、翻卡练习
  • 统计条展示会议数、累计表达、累计术语和近期活动。
  • 词云用于快速扫过反复出现的表达和术语。
  • Top 10 列表用于集中复习最高频项目。
  • 翻卡练习适合快速巩固;可以标记认识/不认识。
  • 到期复习——由到期驱动的复习队列,用 SM-2 简化排期;已经掌握的词会在实时卡片上收起,让信息流始终聚焦真正新的内容。
  • 重度间隔重复用 Anki TSV 导出(或一键 AnkiConnect 同步)。

词典与词典包

个人词典

  1. 在应用中打开 我的词典
  2. 手动添加条目,或选中转录文本先查词典——命中的包和义项会列出来,真查不到时给出解释和翻译——再点 加入我的词典,作为次要动作。
  3. 存词时记的是它在这场会议里实际出现的说法,不只是词典的标准写法——转录里说的是「back on the envelope」,词典收录的词条是 back of the envelope,存下来的仍然是会议里那句实际说法,后续复习和检测都认得这个变体。
  4. 个人词典会参与后续会议检测,并优先于内置词典。
  5. 可以拆成多个自定义命名词包,各自开关,按会议场景勾选启用。
  6. 需要独立复习流程时,可导出为 Anki TSV。

内置词典包

词典包按主题缩小检测范围。目前内置 17 个包——基础表达、会议流程、项目执行、反馈、销售增长、委婉批评、学术会议、闲聊过渡、商务术语、技术术语、医药生物科技、统计学、机器学习、生物信息学等——合计 1,000+ 条,配多义排序(按会议语境给释义排序)和变体匹配(能识别词条的屈折变化和近似形式,比如词典收录的是 get the ball rolling,说话人说成 keep the ball rolling 同样命中)。每个包都能按会议单独开关,core 始终开启。统计学/机器学习包里有几个日常英语高频词(mean、prior、attention、precision 等)默认不触发——只有自己定制过启用列表才会命中,默认全开状态下不会误标平时闲聊。

多义、按领域排序的释义(v0.7.4):讲癌症恶病质时 CAC 解释成 Cancer-Associated Cachexia,不再是获客成本;「IND … or NDA or BLA」里的 NDA 认成新药申请;机器学习语境里 PR 指 precision-recall,不是 Pull Request。释义按会议领域排序,领域不明时依然给出一版可用的解释。

社区词典包

设置里有一个官方词典包目录,可以直接浏览安装——医学、生物医药、AI/ML、法律、金融商务、工程计算机六个专业包,共 4,300+ 词条,发布在 jargonslayer-dicts,此外还能从文件或 GitHub 链接导入任意第三方包。已安装的包每天自动检查一次更新;已安装词典包和内置词典包定义了同一个词条时,优先显示已安装包的释义(v0.7.2+)。

想自己编写并发布词典包?manifest 格式、校验规则和发布流程见「高级玩法 → 词典包编写」。

外观

设置 → 显示 下的所有项都只作用于这台浏览器或这台机器,保存即时生效,不随数据外传。

内置主题

九套内置主题跑在严格校验的 17-token 引擎上(只收 hex、逐项校验、以 CSS 属性注入而不是拼字符串)。每套都按 WCAG AA 逐项测过对比度,原生控件和应用图标跟随它的深浅方案:

  • 终端(默认)——默认的终端深色。
  • 终端(浅色)——它的暖纸浅色版。
  • 清晰(高对比深色)——为可读性加强对比的深色。
  • 水墨(宣纸朱批)——宣纸上的水墨加朱砂批注(浅色)。
  • 魔典(哥特烫金)——皮面烫金的哥特风(深色)。
  • 黑金(黑色电影)——黑金编辑部的黑色电影感(深色)。
  • 青绿(矿彩山水)——矿物色青绿山水(深色)。
  • 像素(8-bit 任务日志)——深靛蓝底、精灵色点缀的任务日志风(深色)。
  • 笔记(课堂手绘)——白纸卡片、铅笔蓝与红笔批注的课堂笔记风(浅色)。

自定义主题编辑器

内置主题之外,主题网格里有一个 新建 格子,点开是就地编辑器。可以从零建一套,也可以复制任意主题(内置或自定义)再改。17 个 token 每个都配一个原生取色器加一个 hex 输入框,可设深浅方案、起名字。编辑时有实时预览,取消就回到已保存的那套。哪个 token 掉到 AA/控件对比度门槛以下,会即时给对比度提示——只警告,不拦你。主题可导出成 JSON 文件,也能粘贴或选文件导入;导入的主题会经校验并重新分配 id,任何导入文件都盖不掉、也覆盖不了内置主题。删除要二次确认;删掉当前正用的那套会回退到终端默认。token schema 和一份完整的示例主题 JSON 见「高级玩法 → 主题定制」。

设置里的主题网格,九套内置主题加一个新建主题格子
设置 → 显示:九套内置主题、新建主题格子和字号控制
主题只带颜色。字体被特意排除在主题 schema 和导出的主题文件之外——它是单独的设置(见下),分享出去的主题 JSON 永远改不了你加载的是哪套字体。

字体

两个独立选择器——界面字体等宽字体——各自给零下载的系统预设,或你自己输入的系统字体名。界面字体预设有 默认 / 衬线 / 圆体;等宽字体预设有内置的 JetBrains Mono 默认 / 你的系统等宽。自定义名字在使用前会做净化处理。

毛玻璃与字号

毛玻璃(frosted glass)开关默认关闭;打开后会给真正的浮层——设置面板、抽屉、弹出层、悬浮卡、导入中心——加一层背景模糊。旁边有三个字号控制:全局字号(整体大小,四档 小 / 标准 / 大 / 特大,类似浏览器缩放)、转录字号(只放大转录区,独立于全局)、转录行距(转录区行距)。

毛玻璃的可读性是尽力而为。半透明加模糊的表面上,对比度取决于底下透出来什么,没法像纯色主题那样保证——毛玻璃是可选项,正是这个原因。

Bit 装扮

状态栏的像素龙 Bit 有一柜子穿搭。跟随主题(默认)时每套内置主题给它配一件:清晰是圆框眼镜,水墨是斗笠,魔典是巫师帽,黑金是礼帽,青绿是玉冠,像素是勇者头带,笔记是耳后铅笔——两套终端主题和自定义主题保持原装。也可以手动指定任意一件(或选 原装 脱掉),不受主题限制。睡着时帽子还戴着;翻肚皮的时候会掉在旁边。报告生成完、复习队列清空时它会张开翅膀撒一把像素火花庆祝,学习中心的角落里也蹲着一只。

导出与备份

单次会议导出

  • Markdown 报告,可选 Obsidian/Dataview frontmatter。
  • docx 导出,下载即是可编辑的 Word 文档。
  • Anki TSV 学习卡片,或用 AnkiConnect 一键同步进本地 Anki(自动去重)。
  • schemaVersion: 1 的完整会议 JSON。
  • 复制纪要到剪贴板。
  • Cornell 笔记可导出 PNG 或 Markdown。

Markdown、docx 和复制纪要导出会带上已有的翻译。如果会议里还有没翻译成功的片段,会弹一个对话框——补全后导出(先跑一遍补全翻译再导出,仍失败的会 toast 提示)、直接导出(现在就导出,未翻译片段原地标出「未翻译」)、取消。JSON、Anki TSV、Cornell 笔记导出不受这道确认影响。iOS 上所有导出都会走系统分享面板。

自动导出、Webhook 与全量备份

设置中可以把每次会议自动保存到文件夹,存成 Markdown 加 JSON(依赖 File System Access API,因此偏 Chromium 浏览器——为 Obsidian vault 和 agent 工作流设计),也可以在每次保存后向自定义 URL POST 一个 meeting.saved webhook,还能对会议、词典和设置做一次全量备份。恢复备份时会先预览内容,并清理有风险的设置项。payload 格式、文件命名规则和一个 webhook 接收端示例见「高级玩法 → 自动化」。

隐私

JargonSlayer 的隐私策略是清楚标出每条数据路径,而不是笼统承诺。不同会议应该选择不同模式。

数据去向
音频,本地 Whisper / 标签页音频 / 系统/App 音频(桌面版)仅本机——loopback websocket,或(系统/App 音频)本机进程通道进同一个内置 sidecar
音频,系统识别 System Speech(桌面版,macOS 26+)仅本机——音频在捕获它的进程内直接转成文字,不经过任何通道,包括本机通道
音频,英文加速 Parakeet(桌面版,Apple 芯片)仅本机——和本地 Whisper 一样完全本地;模型本身首次使用时从 Hugging Face 下载一次
音频,浏览器识别Chrome 139+ 有本地语言包时仅本机(设备端);否则浏览器厂商的语音服务
音频(Soniox 引擎,自备 Key,实验)云端即时处理,不留存——用你自己的 Key 经 WSS 直连 Soniox 实时接口
音频(在线体验:Soniox 限量试用 / 标签页音频)云端即时处理,不留存——无需 Key;每人每天最多 3 段、单次最长约 10 分钟,总额度先到先得
音频(Deepgram 引擎,自备 Key,英文)云端处理——用你自己的 Key,转写在 Deepgram 云端完成
音频(ElevenLabs 引擎,自备 Key)云端处理,用你自己的 Key;默认会留存转录内容,企业版才有免留存选项
音频/视频文件导入浏览器内转录;文件不上传
在线体验 AI 文本项目服务器内存中转,再到 OpenRouter,带 data_collection=allow
BYOK AI 文本你配置的模型提供商端点
订阅直连 detect/define本地 claudecodex CLI,经 sidecar
词典模式文本仅本机
历史、设置、Key本地浏览器存储;无账号
全本地文本路径:使用本地 Whisper 或标签页音频,关闭 AI 检测,并避免把 webhook/自动导出指向外部位置。分步版本见「选择适合的配置」。

正式的隐私政策见 privacy.html;本地日志已加固,不会带上会议原声(v0.7.2+)。

FAQ 与故障排查

浏览器不支持语音识别

浏览器识别推荐 Chrome 或 Edge;也可以切换到本地 Whisper。

Whisper 连接不上

确认 sidecar 终端正在运行,URL 是 ws://localhost:8765,本地防火墙没有拦截 loopback。v0.7.4 起,网页版连不上自建转录服务时会给一句人话提示,不再是开发者才看得懂的 socket 报错。

检测太多或太少

调整置信度阈值,启用/禁用词典包,或按会议场景开关 AI 检测。

报告生成慢

长会议会分块并行翻译;一到两分钟属于正常范围。卡片不需要生成报告也能导出。

移动项目目录后 sidecar 坏了

Python 虚拟环境包含绝对路径。移动或重命名仓库后,重建 sidecar venv。

桌面版:本地服务显示「未知」

应用还没探测过本地服务,或者上一次探测没有返回。打开「后台任务」(桌面版右上角),点「本地服务」旁边的「重新检测」;如果还是不行,去 设置 → 转录引擎 检查。完整的后台任务中心说明见「桌面版」。

提交问题反馈

设置(高级)里的「诊断信息」保存一份本地、已脱敏的信息包——最近的应用事件加一份脱敏后的设置快照,绝不包含会议音频或转录文本。复制诊断信息直接复制;导出诊断文件改为存成文件(iOS 上会打开系统分享面板)。桌面版会自动把三个本地日志(Whisper 服务、系统/App 音频、系统识别)的结尾一并带上,和 查看本地日志 里能单独预览的是同一批日志。Chrome 插件侧边栏也有自己的、更精简的复制诊断按钮。提交 issue 时附上对应的那份即可。