GitHub双响:VoiceStudio把ElevenLabs搬回本地,scriptc把Node踢出二进制

GitHub双响:VoiceStudio把ElevenLabs搬回本地,scriptc把Node踢出二进制

今天的 GitHub 榜单挺有意思,两颗完全不同的星挤在同一页上:一颗是靠”把 ElevenLabs 搬到本地”冲上 5 万多星,另一颗是 Vercel Labs 悄悄做的 TypeScript 原生编译器,两个月不到就攒了 5900 星。

一个在拆云,一个在拆 Node。方向反了,底层诉求是同一个——别再为运行时和 API 付费了。

VoiceStudio:把 ElevenLabs 整个搬回你本机

VoiceStudio 现在的 Star 是 52,866,Fork 5,889,AGPL-3.0。今天一天就涨了 3,086 星,这个速度在语音类项目里是相当罕见的。

它做的事很直接:语音克隆、语音设计、视频配音、听写、转录、有声书,646 种语言,全部本地跑。默认引擎是 k2-fsa 的 OmniVoice,也可以换成别的引擎。

关键在”fully-local”这四个字。README 里写得很清楚:本地工作流跑在你自己的硬件上,远程服务是可选项,使用统计还得单独同意。这在 2026 年的开源语音项目里算少数派——大部分都在偷偷把音频送到云端。

硬件门槛也给得很老实:

  • NVIDIA GPU(Win/Linux)走 CUDA
  • Apple Silicon 走 Metal(MPS)
  • 没有独显也能用,纯 CPU 跑,代价是安装包要吃掉约 5GB 磁盘装 PyTorch CPU 版
  • Intel Mac 只能跑 UI,得自己接远程后端
  • Windows on ARM(骁龙 X 那些)标的是实验性,x64 Python 后端跑在模拟层下,只能用 CPU

另外有两个细节值得注意。一个是它把本地 API 和 MCP 都做了,Agent 可以直接调——这点现在越来越重要,你可以在 ai.godsun.pro 那套工作流里把配音当工具用。另一个是 0.5.3 是最后一个 Tauri 版本,现在 Electron 是唯一的桌面端和 Web UI,旧的 Tauri 壳子和入口都已经删了。作者在 README 里专门写了一段迁移说明,这种”明确告诉你旧路走不通”的写法,比含糊其辞强。

还有 MCP 和 skill 安装:npx skills add debpalash/VoiceStudio,装完直接当 Agent 技能用。

scriptc:把 Node 从产物里踢出去

scriptc 是 Vercel Labs 的实验项目,定位就一句话:TypeScript-to-Native Compiler。现在是 5,912 星、169 个 Fork,Apache-2.0。

这个项目的创建日期是 2026-07-22,到今天才两个半月。两个月从零到 5900 星,涨星曲线相当陡。

它的编译链路大概是这样:

scriptc 编译链路:TypeScript 源码经编译前端落到类型化 IR,再生成可读 C 或 LLVM IR,最后由平台 helper 链接成不带 Node 的原生可执行文件
scriptc 的编译链路:前端复用 TypeScript 编译器做解析与类型检查,落到类型化 IR 后分两路生成,最后链接成不依赖 Node 的原生可执行文件
npm install -g scriptc
scriptc run hello.ts          # 编译并直接跑
scriptc build hello.ts -o hello   # 出独立可执行文件

真正的技术细节在产物形态上。scriptc 能把 TS/JS 编译出六种东西:类型化 IR、可读的 C、文本 LLVM IR、汇编、目标文件、原生可执行文件,外加 WASM 模块。解析和类型检查直接复用 TypeScript 编译器,所以类型不会丢。

最狠的一条是:静态产物里不带 Node,也不带 JavaScript 引擎,只带一个很小的原生 runtime。编译不了的代码直接报诊断,不给你偷偷降级成解释执行。

需要 Node API 的话,常见的 node:http 这类会直接编译到原生 runtime 上。碰到 npm 包和 any 类型代码,加 --dynamic,它会显式内嵌 quickjs-ng。

这个设计的取舍很清楚:macOS 15+ arm64 上,普通的 LLVM 层可执行文件只需要用 scriptc 自带的 helper 和预编译好的 runtime pack,clang 只作为平台链接器驱动,不参与编译生成的 C 或 runtime C。换句话说,你不用装一整套 LLVM 开发包。

它还支持 WASI Preview 1 目标,能出 WASM。对象文件消费目前标注为实验性。

说点实在的

两个项目都在做同一件事:把对云端、运行时的依赖往外甩。但路径完全不同。VoiceStudio 是”功能搬回家”,你得自己有硬件,CPU 跑得慢就是慢,Intel Mac 直接不支持后端。scriptc 是”依赖砍掉”,你不用装运行时,但换来的是编译期的一堆限制。

VoiceStudio 的 AGPL-3.0 是个实际门槛——个人折腾无所谓,一旦你要把语音能力塞进商业产品,模型授权和代码授权得分别看。README 自己也提醒了:模型有自己的许可证,商用前逐个审。

scriptc 是 Apache-2.0,宽松得多,但仓库顶上的徽章明明白白写着 Vercel Labs Experiment。别当生产工具用,当研究对象看。一个月内它大概率还会大改接口。

我的建议:如果你只想找个能离线跑的配音工具,VoiceStudio 值得现在就去下;如果你是 TypeScript 开发者,想看看 AOT 编译现在能做到什么程度,scriptc 值得花一个下午读一遍 README。两者都不算生产可用的成熟方案,但作为趋势信号,指向很明确——Agent 生态的下一个战场不在模型,在运行时。


by 数码罗记 · godsun.pro

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注