Conversationaly:本地优先的 AI 会议助手开源桌面应用
支持本地转写与摘要的跨平台会议助手,基于转写与 LLM 推理的本地侧车实现,云端可选。
Conversationaly 是一款主打「本地优先」与隐私保护的桌面端会议助手应用,支持 macOS、Windows 和 Linux 三大平台。它在用户本地完成会议录音、实时转写与摘要生成,所有 AI 推理默认不联网;云端转写与云端摘要接口仅为可选扩展,需用户主动配置 API Key 才会启用。
项目背景
Conversationaly 是对开源项目 Meetily 的二次重构版本,在保留核心功能的基础上,引入了 transcribe.cpp 作为转写引擎,并捆绑 llama.cpp 侧车用于本地 LLM 推理。项目遵循 MIT 协议,无付费层级、无授权密钥、无遥测上报,定位为完全免费的桌面工具。
核心能力
应用内置约 87 款转写模型,覆盖 16 个模型家族,包括 Whisper、Parakeet、Nemotron、Canary、Voxtral、Qwen3-ASR、SenseVoice、Moonshine、GigaAM 等,模型按需下载。默认启用 nemotron-3.5-asr-streaming-0.6b-q8,支持 39 种语言的流式转写。流式原生模型可边说边出文本;仅支持批处理的模型则通过语音活动检测(VAD)切片,延迟内仍可获得近实时体验。
摘要环节默认通过内置的 llama-helper 侧车本地运行 Gemma 4,无需安装 Ollama。应用同时支持以下外部接口:
- 摘要:内置 AI、Ollama、Claude、Groq、OpenRouter、OpenAI,以及任意 OpenAI 兼容端点。
- 云端转写(可选):Deepgram、ElevenLabs、Groq、OpenAI。
用户可为摘要独立设置语言,并选择或自定义摘要模板结构。
音频与系统集成
应用同步采集麦克风与系统音频,采用基于 RMS 的 ducking 与削波抑制进行专业混音处理。GPU 加速覆盖 Apple Silicon 上的 Metal、NVIDIA CUDA、AMD/Intel 的 Vulkan 以及 Linux 下的 ROCm 后端。
数据存储完全本地化:会议录音、转写文本与下载的模型分别保存在用户磁盘上的 SQLite 数据库与模型目录中。「Import & Enhance」功能(Beta)允许对历史音频文件重新转写,可更换模型或语言。
架构与开发
整个应用基于单一 Tauri 框架打包:Rust 核心负责音频采集、转写、存储与摘要编排,前端使用 Next.js,两端通过 Tauri 命令与事件通信,无需独立部署服务端。仓库提供面向 macOS、Linux、Windows 的构建与运行脚本(如 clean_build.sh、clean_run.sh、build-gpu.sh 等),开发者可通过 CLAUDE.md 与 docs/GPU_ACCELERATION.md 了解架构约定与 GPU 后端细节。
预编译安装包(macOS .dmg、Windows .exe、Linux .deb / .rpm / .AppImage)在版本发布时随 Releases 页面分发;如需自行构建,需准备 Rust、Node.js、pnpm 与 cmake 等工具链。
