Developer Beta · 1.4.0 (19)

让每一句声音,
留在你的 Mac。

原生、本地优先的语音转录工作台。将麦克风、音视频文件或 Mac 正在播放的声音转成可编辑文本,再在设备端翻译、整理并导出。

适用于 macOS 15.5+ 与 Apple silicon。当前需要使用 Xcode 从源码构建。

声迹识别与翻译均在这台 Mac 上完成
识别模型本地
Metal / Core ML准备就绪
麦克风转录实时生成可编辑文本
音频或视频文件导入后选择引擎与语言
原生 SwiftUI为 macOS 设计
默认不上传音频与文本留在本机
4 种识别引擎按任务自由选择
7 种导出格式从文本到字幕
一个完整的本地工作流

不止是听写。

声迹把采集、识别、编辑、翻译与交付放进同一个原生界面,适合采访、课程、会议、视频字幕与长录音整理。

从你正在听的任何内容开始

录制麦克风,导入常见音频或视频文件,捕捉 Mac 系统声音,或把已有的 SRT、VTT、TXT、Markdown 与声迹 JSON 继续编辑。

长任务也有清晰进度

自适应渐进显示、暂停与恢复、追加式会话日志及恢复快照,让数小时录音也能持续处理,并降低意外中断带来的损失。

把转录稿变成交付物

搜索与替换、选区删除、范围裁剪、时间轴检查和译文对照,让识别结果可以直接整理,而不是只能复制出去重做。

翻译、编辑,然后按需导出

使用 Apple Translation 或可选 NLLB 在设备端完成译文。导出 TXT、Markdown、JSON、PDF、SRT、WebVTT,或一键复制到剪贴板。

LocalScribe transcript editor showing translation, search, editing and export controls
本地优先,不是一句口号

你的录音不需要离开电脑。

识别与可选翻译均在 Mac 本机执行;应用不会上传输入音频或导入的转录稿。只有在你主动下载模型、检查更新或打开外部文档时才需要网络。

  • Whisper 通过 Metal 加速,并可自动回退到 CPU。
  • SenseVoice 与 Parakeet 走 sherpa-onnx,可使用符合条件的 Core ML 路径。
  • Apple Speech 与 Translation 由系统管理语言资源与权限。
同一个界面,多种本地引擎

为任务选择合适的模型。

Apple Speech

麦克风、文件与实时字幕。SpeechAnalyzer 功能需要 macOS 26。

系统管理

whisper.cpp

适用于麦克风与文件,Metal 优先,支持 Silero VAD 与 CPU 回退。

GGML · Metal

SenseVoice

适合文件转录,由 sherpa-onnx 驱动,并可走 Core ML 路径。

sherpa-onnx

NVIDIA Parakeet

面向文件的另一种本地选择,支持 Core ML 条件路径与 CPU 回退。

sherpa-onnx
真实应用,真实工作流

每个选项都有上下文。

模型大小、下载状态、硬件路径、来源语言、翻译服务与权限提示都直接显示在当前任务旁边。声迹遵循 macOS 的信息层级和标准交互,让重要状态可见,同时保持界面安静。

LocalScribe home screen with recognition, import, translation and live-caption controls
声迹 1.4.0 的真实应用界面
开放源码 · MIT License

查看每一层实现,或亲自构建。

仓库包含 SwiftUI 应用、项目生成脚本、测试与本地运行时。大型识别模型和 NLLB 模型只会在你选择时下载。

Developer Beta目前尚无 Developer ID 签名并经过 Apple 公证的公开安装包。请使用 Xcode 构建,并将测试结果与硬件信息反馈到 GitHub。
Terminal
$ ruby generate_project.rb

$ xcodebuild \
  -project LocalScribe.xcodeproj \
  -scheme LocalScribe \
  -destination \
  'platform=macOS,arch=arm64' \
  build

开始之前