开会时一边盯着屏幕一边手忙脚乱记笔记,是很多人的日常痛点。更麻烦的是,市面上那些录音转文字工具大多把音频传到云端处理,隐私堪忧。最近有人在 Hacker News 上开源了一款叫 Memory Notch 的工具,主打卖点就是完全离线:录音、转录、说话人标记都在你 MacBook 本地跑完,连模型都预装在 1.6 GB 的安装包里,不联网也能用。

它的名字和交互设计有点俏皮——把功能图标放在刘海(notch)区域,有物理刘海的 MacBook 上就显示在凹槽里,没有刘海的外接屏上则变成一个在菜单栏下方的胶囊。点一下就能开始录音,再点一下停止,然后后台自动出转录文本。这种交互把录音工具变成了系统级的存在感,而不是一个需要打开窗口的 App。

对开发者来说,更值得注意的是它的架构选择。所有计算都在本地完成,意味着模型要能跑在 Apple Silicon 上,且安装包体积不小——1.6 GB 里基本都是模型文件。这也间接说明它的语音识别和说话人分离用的是比较完整的离线模型,而不是简化的实时端点方案。它同时抓取麦克风和系统音频,需要 macOS 的屏幕录制权限,这个权限常被误解为只用于录屏,但苹果的系统音频捕获就是挂在它下面的。如果你用 AirPods 通话,得手动把麦克风选成 Mac 内置的,否则蓝牙回环会出问题。

数据存储方面,每条录音在 `~/memory` 下生成一个文件夹,包含音频文件、转录文本、Markdown 笔记,如果开了录屏还有视频。这种设计很务实——文件是开放格式,你可以直接用任何工具读,不需要依赖它的导出功能。它也没有搞复杂的 API 或 MCP server,想集成到自己的工作流里,干脆让 AI Agent 直接读本地文件就行,只要你有权限访问这个目录。当然,如果你后续把笔记发给云端 AI 去总结,那就得看那个云服务自己的数据政策了。

功能边界也写得很清楚:不做自动摘要、库搜索只查标题和元数据而不做全文关键词检索、说话人标签是编号而不是姓名、重叠声音可能分不开。这些都是实在的取舍,避免了那种什么都会但什么都做不好的浮夸宣传。价格方面,免费试用版每次录音最长 5 分钟,到时间自动保存;一次性付费 79 美元解除时长限制,可以装在 5 台自己的 Mac 上,包含一年更新,无订阅,30 天内可退款。硬性要求是 Apple Silicon 且 macOS 26 以上。

把整个产品拆开看,它解决的核心问题是「录音转录中的隐私信任」。本地推理意味着录音永远不出设备,这对处理会议内容、访谈、甚至涉及保密需求的场景很有吸引力。它的思路可以给想在自己工具里做音频处理的人一个参考:不需要云端服务,量化压缩后的模型在个人电脑上也能跑出可用效果;文件用标准格式存,让数据和 App 解耦;权限说明要极其直白,别让用户猜。如果你恰好有 Apple Silicon 的 Mac,又常年在会议里做记录,这个工具可以直接试试。最大的坑可能是录音时长限制和重叠语音的识别质量,但作为离线方案,它的存在本身已经很有价值了。

阅读原文 → 返回 AI 技术文档

内容与图片版权归原作者所有 · 原文: https://memorynotch.app/