JargonSlayer 能做什么
JargonSlayer 是面向非英语母语者的英文会议实时理解助手。它监听会议,抓住单靠词典会漏掉的部分——习语、商务黑话、委婉表达、缩写、专有名词、领域术语——并在会议还在进行时把它们变成简短卡片。会议结束后,同一场会话会变成一份双语纪要、一份翻译好的转录文本,以及一套个人学习卡片。
实时理解
检测分两层。内置词典在说出的瞬间就能匹配习语、缩写和领域术语,完全离线——零 Key、零成本,v0.6 起是新装应用的默认状态。打开 AI 检测会在词典之上叠加一层 LLM:它结合上下文解释含义,并抓住词典不认识的表达,用的是你配置的任意提供商——Anthropic、OpenAI、DeepSeek、通义千问、OpenRouter、Poe、本地 Ollama 模型,或任意 OpenAI 兼容端点。
右侧面板显示表达解释卡——习语、委婉说法、软化过的批评——以及缩写、公司名、产品名、指标、技术术语的术语卡。重复命中只会增加原卡片的次数,不会刷屏;点击转录里带下划线的表达,会直接跳到对应卡片。
多义词按领域排序的释义(v0.7.4):一个有多个释义的词条,现在会按会议所在领域重新排序。讲癌症恶病质的会议里,CAC 解释成 Cancer-Associated Cachexia,不再是 Customer Acquisition Cost;「IND … or NDA or BLA」里的 NDA 认成 New Drug Application;机器学习会议里 PR 指 precision-recall,不是 Pull Request。领域不明时依然会给出一版可用的解释。
划词查词,v0.7.4 重做成「先查词典」(lookup-first):选中任意转录文本即可查询。命中的词典包和义项会先列出来;真查不到时,才结合上下文回退到 AI 解释并附带翻译。查询在后台持续生成,关掉弹窗也不会丢,完成后自动并入卡片列表——把它加入词典(加入我的词典)是弹窗里的一个次要动作,不再是默认唯一出口。
转录引擎与音频来源
网页版和桌面版的引擎清单并不一样——桌面版完全没有浏览器识别(Tauri 的 webview 没有 Web Speech API),但多了网页版做不到的、基于 CoreAudio 的系统/App 音频捕获。v0.7.4 起,引擎选择器把所有选项分成三组:
- 本地 STT 模型(自己跑的模型)——本地 Whisper(桌面版自带自管,网页版是手动装的 sidecar)和英文加速 Parakeet(Apple 芯片、MLX 加速,在模型选择器里手动开启,批量推理约百倍实时;暂不支持实时说话人分离)。
- 系统 STT 服务(系统或浏览器自带的识别器)——浏览器识别(Chrome 139+ 有本地语言包时是设备端识别,否则走浏览器厂商的云端服务)和桌面版的系统识别 System Speech(macOS 26+,零安装、不下载模型、不装 Python,音频不出捕获进程;约 30 种语言;不支持说话人分离;中文输出可能不带标点)。
- 第三方 STT 提供商(自备 Key 的云端厂商)——Soniox(实验性,面向中英夹杂场景)、Deepgram(仅支持英文),以及 ElevenLabs(默认会留存转录内容,除非用的是企业版免留存方案)。这些选项即使没配 Key 也会常驻显示,各自标注「已配置」或「未配置」,不会因为没配置就被隐藏。
说到音频来源:网页版可以捕获标签页音频,用来听清线上会议里对方的声音。桌面版把这个位置换成了系统/App 音频——一个基于 CoreAudio process tap 的捕获,能录下这台 Mac 当前正在播放的一切,不需要虚拟声卡,不需要装 BlackHole/VB-Cable。它从不捕获你自己的麦克风。v0.7.4 起,音频来源是独立控件,会议进行中也能随时切换,不再只能会前选定。
每个引擎在两个平台上的完整安装步骤、音频去向和适用场景,见使用指南。
双语转录与翻译
实时双语字幕和全文翻译共用同一个设置,可选四种引擎:平台自带的本机翻译器(系统翻译——网页版是 Chrome 内置的 Translator API,桌面版/iOS 是 Apple 的 Translation 框架;默认选项,不需要 Key)、LLM、DeepL(BYOK),以及有道翻译(Youdao,BYOK,v0.7.1+)。DeepL 和有道只在原生 App 里可用——两家的 API 都不支持浏览器跨域请求,所以网页版会把它们显示为禁用,网页版实际能选的只有本机翻译或 LLM。
会议结束后,只要双语字幕开着、还有 N 个片段没翻译成功(比如某次 API 调用失败,或当时没配 Key),就会出现 补全翻译 (N) 按钮——点一下,用当前配置的翻译引擎分批把这些片段补齐,补完自动消失。
Markdown、docx 和复制到剪贴板的导出都会带上已有的翻译。如果导出时还有片段没翻译成功,会弹出一个对话框:先补全再导出,直接导出(未翻译的部分原地标出「未翻译」),或者取消。
AI 转写修订(审阅制,自 v0.5 起):会后一键让 AI 通读转录、挑出识别错误,逐段列出原文和修正建议。接受之前什么都不会改,接受后的片段会自动重新翻译。
说话人工具
说话人可以手动指定:单句,或者一次选中多句一起改,单句操作里有「应用到本句及之后」选项;实时监听时旁边会跟着一个「当前说话人」标记。手动指定过的句子会被锁定,后续自动说话人分离不会覆盖它。点击任意说话人标签即可改名——v0.7.3 修复后,改名会立刻同步到花名册和实时说话人选择器,不再卡在旧名字直到会议结束才刷新。
批量导入可以通过本地 sidecar(pyannote)做说话人分离,需要你提供一次 Hugging Face token,前提是已经在 Hugging Face 上接受了 pyannote 的 segmentation 和 speaker-diarization 使用条款。实时说话人分离仍是 beta:sidecar 会在最近一段音频窗口上反复运行 pyannote,把说话人匹配到一个稳定的 registry,再把标签更新发回界面,不阻塞转录。
学习中心
个人词典(我的词典)和 /review 页面,把检测到的卡片变成一个轻量学习中心。
- 手动添加词条,或先选中转录文本查词典——命中的包和义项会列出来,真查不到时给出解释和翻译——再选
加入我的词典,作为一个次要动作。条目可以拆分到多个自定义命名词包里,各自按会议单独开关。 - 记录实际说法(v0.7.1):存卡片时记的是它在这场会议里实际出现的说法,不只是词典的标准写法——听到的是「back on the envelope」,词典收录的词条是 back of the envelope,存下来的仍然是那句实际说法,后续复习和检测都认得这个变体。
- 已掌握词自动隐藏:标记为已掌握的词不会再出现在实时卡片里,让卡片流始终聚焦在还不熟悉的内容上。
- 到期驱动复习:
到期复习是一个按到期时间驱动的复习队列,使用 SM-2 简化版排期算法。 - 统计条(会议数、累计表达/术语、近期活动)、词云、Top 10 高频列表,加上用于快速练习的翻卡。
- 可以导出 Anki TSV,或用 AnkiConnect 一键同步进本地 Anki(自动去重),用于重度间隔重复。
词典包
今天内置词典包一共十七个——基础表达、会议流程、项目执行、反馈、销售增长、委婉批评、学术会议、闲聊过渡、商务术语、技术术语、医药与生物科技、统计学、机器学习、生物信息学等等——总计超过 1,000 条。每个包都能按会议单独开关,core 始终开启。
变体匹配(85 条)能识别屈折变化和近似说法——词典收录的是 get the ball rolling,说话人说成 keep the ball rolling 同样命中。统计学/机器学习包里有几个日常英语高频词(mean、prior、attention、precision 等)默认不触发——只有你自己定制过启用列表才会命中,默认全开的状态下不会误标日常闲聊。
设置里有一个官方目录,可以直接浏览安装——医学、生物医药、AI/ML、法律、金融、工程计算机六个专业包,共 4,300+ 词条,发布在 jargonslayer-dicts;第三方包同样可以从文件或 GitHub 链接导入。已安装的包每天自动检查一次更新,两边定义了同一个词条时,已安装包的释义优先于内置词典(v0.7.2+)。
想自己做一个词典包并发布?manifest 格式、校验规则和发布流程见高级玩法 → 词典包制作。
导出与集成
- Markdown 报告,可选 Obsidian/Dataview frontmatter。
- docx 导出,下载即是可编辑的 Word 文档。
- Anki TSV 学习卡片,或用 AnkiConnect 一键同步进本地 Anki(自动去重)。
- 带
schemaVersion: 1的完整会议 JSON。 - 复制纪要到剪贴板。
- Cornell 笔记可导出 PNG 或 Markdown。
iOS 上,每次导出都会交给系统分享面板处理。
设置里还能把每场会议自动保存到一个文件夹,格式是 Markdown 加 JSON(基于 File System Access API,为 Obsidian vault 和 agent 工作流设计),在每次保存后向自定义 URL POST 一个 meeting.saved webhook,并对会议、词典和设置做一次完整备份——恢复前会先预览内容,并对高风险设置做脱敏处理。payload 格式、文件命名规则和一个 webhook 接收端示例见高级玩法 → 自动化。
外观与 Bit
九套内置主题跑在严格校验的 17-token 引擎上——只收 hex、逐项校验、以 CSS 自定义属性注入而不是拼字符串——每套都按 WCAG AA 测过对比度,从终端默认色到哥特烫金的魔典,再到像素风的任务日志一应俱全。内置主题之外,自定义主题编辑器可以从零建一套,也可以复制任意主题再改:17 个 token 各配一个原生取色器加一个 hex 输入框,还能设深浅方案。对比度提示会实时标出掉到 AA/控件对比度门槛以下的 token——只警告,不会拦你保存。主题可以导出成 JSON,也能导入;导入的主题会重新分配 id,所以任何导入文件都盖不掉、也覆盖不了内置主题。
两个独立的字体选择器(界面字体、等宽字体)、一个默认关闭的毛玻璃浮层选项(用于面板和抽屉),加上三个字号控制(全局字号、只放大转录区的字号、转录行距),补齐了显示设置——全部只作用于这台浏览器或这台机器,不随数据外传。
状态栏的像素龙 Bit 默认会跟着每套内置主题换装——清晰配圆框眼镜,水墨配斗笠,魔典配巫师帽——也可以手动指定任意一件。报告生成完成,或复习队列清空时,它会张开翅膀撒一把像素火花庆祝。
平台
macOS 桌面版(仅支持 Apple Silicon,没有 Intel 版本)是主打平台:签名并公证的 DMG 来自 releases/latest,自带自管的本地 Whisper,还有网页版做不到的系统/App 音频和系统识别引擎。
网页版可以作为 PWA 安装——在 Chrome/Edge 里装成接近桌面应用的窗口,或通过 Safari 添加到 iOS/iPadOS 主屏幕——也可以本地/局域网自托管一个 Next.js 服务。在线体验无需安装,内置一个 Soniox 云端识别的限量试用(不需要自己的 Key,每人每天最多 3 段,单次最长约 10 分钟,总额度先到先得);填入自己的 Soniox 或 Deepgram Key 后,在线体验会切换成浏览器直连的 BYOK 模式,不受试用限额。
iOS 版目前是 TestFlight 邀请制内测,需要 iOS 26+;系统语音识别和系统翻译都在设备本地运行(Apple 翻译,无需 Key)。
Chrome 插件(Lite)需要从 release 的 zip 手动加载安装——暂不上架 Chrome 网上应用店——目前处于维护模式:侧边栏里提供实时麦克风转录、内置词典和设备端翻译,仅此而已(没有 LLM 检测,没有标签页/系统音频,也没有账号)。
隐私优先设计
- 每种引擎和模式都有明确的数据路径——不是笼统的隐私承诺。
- 没有账号。历史、设置和 Key 都存在本地浏览器/应用存储里。
- 词典模式完全本地:音频和转录文本都不会离开这台机器。
- 自备 Key 按提供商隔离存储(v0.7.3)——切换 LLM 提供商不会再把上一个提供商的 Key 带到新提供商那边。
- 本地日志经过加固,绝不会带上会议原声(v0.7.2)。
诊断信息给出一份脱敏的诊断信息包,方便提交 bug 报告——最近的应用事件加一份脱敏后的设置快照,绝不包含会议音频或转录文本。
逐引擎的完整数据路径表见使用指南的隐私一节;正式的隐私政策在 privacy.html。
部署与能力
网页版的形态是 Web App 和 PWA:可以在 Chrome/Edge 中安装成接近桌面应用的窗口,也可以在 iOS/iPadOS Safari 中添加到主屏幕,或作为本地/局域网 Next.js 服务运行。macOS 桌面版和 Chrome 插件是两个独立打包、独立发版的产物。
| 形态 | 状态 | 说明 |
|---|---|---|
| 在线体验 | 可用 | 预览层,限制透明公开,本地专属功能显示为灰色 |
| 本地 Web App | 可用 | 完整的本地优先构建 |
| PWA 安装 | 可用 | 使用已有的 manifest 和图标 |
| macOS 桌面版(Tauri) | 可用 | 签名并公证的 DMG,见 releases/latest;仅支持 Apple Silicon,没有 Intel 版本 |
| Chrome 插件(Lite) | 可用,需手动加载 | zip 在 releases 页面;手动加载是官方支持的安装方式(暂不上架网上应用店);目前处于维护模式 |
| iOS / iPadOS(测试版) | TestFlight 邀请制 | 需要邀请,请联系作者;iOS 26+,系统语音识别和系统翻译均在设备本地运行(Apple 翻译,无需 Key)。暂无 Android 版本或应用商店上架计划——PWA 已覆盖大多数移动端场景 |
能力对照表
| 能力 | Chrome 插件(Lite) | 在线体验(预览) | 本地 Web / 桌面版 |
|---|---|---|---|
| 词典检测(即时、离线) | ✓ | ✓ | ✓ |
| 实时转录 | Web Speech(仅麦克风) | Web Speech · Soniox 限量试用(免 Key)· 标签页音频(同一试用额度) | Web Speech · 本地 Whisper · 标签页音频 · 系统/App 音频(桌面版)· Soniox(BYOK,实验)· Deepgram(BYOK)· ElevenLabs(BYOK) |
| AI 检测/翻译/纪要 | — | ✓ 内置体验 Key(限流) | ✓ 自备 Key(BYOK) |
| 导入文本/音频/视频 | — | ✓ | ✓ |
| 说话人分离 | — | 展示但需要本地 sidecar | ✓ |
| 历史记录 | 本地 IndexedDB,独立数据库 | IndexedDB | IndexedDB |
未来计划
以下都没有明确的时间承诺——开发按小批次推进,优先级会随一线反馈调整。macOS 桌面版会是今后的主打平台;Chrome 插件保持维护模式。
- 黑话密度控制(设计中)——选择会议所在的领域和一个难度档位,让检测匹配你自己的词汇水平,而不是把词典认识的一切都标出来。
- 会议附件(设计中)——可选的音频留存,随会议一起保存,加上能喂给会后纪要的附件(幻灯片、笔记)。
- 纯英文界面选项(计划中)——完整的界面本地化,让应用从头到尾都能读成英文,不只是检测和释义部分。
- 手机优先的界面打磨(计划中)——更紧凑的移动端外框和更清晰的触控目标。
- 自动化签名发布(v0.7.5 起基本完成)——CI 对每次改动做构建和门禁检查,macOS DMG 的构建、签名、公证和 staple 现在也都由 CI 完成;还需要手写的只剩发布说明。
暂缓项:浏览器端的实时流式转录(作为现有 Whisper sidecar 的浏览器内替代方案),以及选中转录文本发起联网搜索。屏幕录制作为会议附件的一种,明确推迟到 v1.0 之后。