
本地语音转Markdown:Mac与iPhone版本有何差异?
探索Speech To Markdown在Mac和iPhone上的不同之处,包括语音识别、文本整理和安装方式,以及其功能特点。
Speech To Markdown是一款将语音转化为Markdown笔记的本地工具,适用于Mac和iPhone。尽管两者都能实现语音转写,但它们在技术实现和用户体验上存在差异。
对于经常使用语音记录文章、灵感或工作日志的用户来说,Speech To Markdown提供了更便捷的解决方案,它不仅能将语音转化为文字,还能自动分段、添加标题和整理列表,减少手动排版的工作。

Speech To Markdown能做什么?
Speech To Markdown的主要功能是将口述内容转化为Markdown笔记。它不仅能够实现逐字听写,还能根据内容自动分段、添加标题和整理列表,大大减少了转写后的手动排版工作。

- 语音转文字:将实时口述内容转换为可编辑文本。
- 自动整理Markdown:根据内容自动生成标题、段落和列表。
- 修改已有文字:在Mac上通过语音调整选中的文本。
- 继续补充内容:在现有笔记或草稿后追加新的口述内容。
Speech To Markdown能替代Wispr Flow或Superwhisper吗?
尽管Speech To Markdown提供了许多功能,但目前还不能完全替代Wispr Flow或Superwhisper。它更像是一款面向技术用户的免费方案,不需要持续订阅,但Mac版需要通过官方脚本安装并编译;使用Agent Mode时,还要自行配置兼容的LLM服务。
如果希望文本整理留在本机,可以连接Ollama、LM Studio等本地服务。

本地语音转Markdown:Mac与iOS版有什么区别?
Speech To Markdown同时提供Mac和iPhone、iPad版本,但语音识别、文本整理和安装方式都不一样,具体区别如下:
| 项目 | macOS版 | iPhone / iPad版 |
|---|---|---|
| 语音识别 | whisper.cpp | Apple SpeechAnalyzer |
| 文本结构整理 | 连接兼容OpenAI API格式的LLM服务,可配置Ollama、LM Studio等本机服务 | Apple Foundation Models |
| 数据流向 | 音频在本机转写;整理后的文本是否离开设备,取决于配置的是本地还是远程LLM地址 | 按照官方说明,通过苹果端侧框架在设备上处理 |
| 安装方式 | 通过脚本安装并从源码构建 | App Store直接下载 |
| 核心限制 | 安装略折腾,Agent模式对内存和算力要求较高 | 设备必须支持Apple Intelligence |
Mac版怎么用:全局听写与Agent Mode
Mac版提供两种使用方式。

最基础的是全局语音输入:按下默认快捷键⌘⌥],可以直接在浏览器、终端或编辑器里把语音转成文字,这部分只依赖Whisper模型。

更进阶的是Agent Mode。使用前需要配置兼容OpenAI API格式的LLM服务;如果希望文本整理也在本机完成,可以连接Ollama、LM Studio等本地服务。Agent Mode提供三种处理方式:
- Format模式:把零散口述整理成带有标题、列表和段落结构的提纲或文章初稿。
- Edit模式:选中一段已有文字,再通过语音说明修改要求,例如“把这部分改得更简洁”。
- Append模式:把新口述的内容追加到当前文档,不需要每次重新整理全文,处理长文档时响应更快。
Speech To Markdown的数据会传到云端吗?
这需要分别看Mac版和iPhone、iPad版,不能简单概括为“所有处理都在本地完成”。

Mac版使用whisper.cpp在本机完成语音转写,原始录音不需要上传给在线语音识别服务。进入Agent Mode后,转写文本会被发送到设置中配置的LLM地址:如果连接的是本机运行的Ollama、LM Studio等服务,文本整理可以留在本地;如果用户改为远程服务器或第三方API,相关文本就可能离开设备。

Speech To Markdown没有LICENSE,可以商用吗?
截至2026年7月27日,Speech To Markdown的源码可以在GitHub查看,但仓库中没有LICENSE文件。源码公开不代表自动允许修改、重新分发或商业使用,也不能据此认定可以集成到商业产品中。
个人用户可以按照项目提供的方式安装和体验软件;如果准备修改源码、重新打包发布、集成到商业产品或对外提供服务,建议先联系开发者确认授权范围。后续如果仓库补充了许可证,应以GitHub上的最新说明为准。

Speech To Markdown适合哪些用户?
如果你的Mac内存较充裕,并且已经在使用Ollama、LM Studio等本地模型服务,Speech To Markdown可以作为收费语音输入软件的本地替代方案尝试。它更适合愿意配置本地环境、希望控制数据流向,并且经常用语音整理Markdown笔记的用户。
如果你只想安装后直接使用,或者需要Windows、Android、团队协作及专业会议转录功能,Wispr Flow、Superwhisper或其他成熟商业工具目前会更合适。老款iPhone和不支持Apple Intelligence的iPad也无法运行其移动版本。
