晚上好,今天这期四个项目四个方向:有人把 Mac 调教成正经 AI 服务器,微软教 AI 用大白话画图表,腾讯把自家红队工具搬上 GitHub,还有一个 23K 星的新标准想管住满世界乱跑的编码 Agent。都是这两天在 GitHub 上窜得最快的,我一个个说,老规矩,没实测的我会明说。
1. oMLX — ⭐20.1K,苹果电脑的本地 AI 服务器,菜单栏一按就开
一句话定位:把 Mac 的 M 系列芯片变成一台自托管 LLM 推理服务器。
本地跑大模型的老问题:要么只能用别人写死的工具,要么自己啃命令行,想固定常用模型、临时换大模型、限上下文长度,全得手搓。oMLX 的做法是”全都要”:
- 连续批处理(continuous batching),多请求排队不卡顿
- 分层 KV 缓存:常用模型常驻内存,冷数据落 SSD,聊到一半换上下文也不重算,喂 Claude Code 这种长会话工具很实用
- 菜单栏 App + 网页控制台,全离线可用,自带聊天界面
- OpenAI 兼容接口(localhost:8000/v1),Claude Code、OpenCode、Hermes 改个 base_url 就能接
- 文本、视觉、OCR、embedding、reranker 通吃,还有实验性的多 Mac 分布式推理
上手:去 Releases 下 dmg 拖进 Applications 就行;命令行党可 brew install jundot/omlx/omlx。要求 macOS 15+、M1 到 M5。
实话: 我没 Mac,这个真没实测过。README 里特别提醒:GLM-5.2 这类模型不带自定义内核会掉进慢路径,速度差 30 倍,而自定义内核编译要完整 Xcode——嫌麻烦就直接用官方 dmg,内核是预编译好的。适合手上有 M 系 Mac、想把本地模型喂给编程 Agent 的人。
2. AI-Infra-Guard — ⭐5.5K,腾讯朱雀实验室开源的 AI 红队全家桶
一句话定位:给 Agent、技能包、MCP 服务器做安全体检的一站式平台。
以前做渗透测试查的是网站和服务器;现在 Agent 乱跑工具、乱读文件,MCP 服务器成了新攻击面。A.I.G 就是给这套新东西体检的:
- Agent Scan / MCP Scan / Skill Scan 三大扫描,外加 AI 基础设施漏洞扫描
- LLM 越狱评估,内置 Many-Shot、PAIR、GOAT 等多轮越狱攻击手法
- 漏洞库已扩到 130 个组件、1888 条规则,skill-scan 能单独拎出来接进 CI/CD
- 上过 Black Hat Europe 2025 的 “MCP Unchained”,不是玩具
上手:git clone 后 docker compose up 一把梭;OpenClaw 用户直接装 aig-scanner 技能就能用。
实话: 只看了文档没实操。注意它是 Apache-2.0 但带归属要求,商用集成要在文档里写明”集成了腾讯朱雀实验室 AI-Infra-Guard”。适合给 Agent 应用做上线前体检的团队和安全研究的朋友。
3. Data Formulator — ⭐16.1K,微软出品,用大白话画图表
一句话定位:跟 AI 说人话,就能完成数据分析和可视化。
想把 Excel 变成一张说得过去的图,中间隔着字段名、数据清洗、图表类型一堵墙,Data Formulator 把这堵墙拆了:
- 直接拖入 CSV / Excel / JSON / 截图,或者连数据库,AI 帮你规划和加载数据
- Data Thread 对话式分析:每一步的图表都可编辑,聊到一半还能回退换方向
- 分析完直接拼成报告
- 有在线 Demo(data-formulator.ai)可以先试
上手:一行 uvx data_formulator 就起,浏览器打开 localhost:5567;pip 或 docker compose 也行。
实话: 在线 demo 玩过两下,本地没深测。图表质量取决于底层模型,数据一复杂该翻车还是翻车。适合数据分析师,还有被周报和 PPT 折磨的打工人。
4. AGENTS.md — ⭐23.7K,给编码 Agent 立的规矩
一句话定位:一个开放的 AGENTS.md 标准,让编码 Agent 进仓库先读”说明书”。
Claude Code 认 CLAUDE.md,Codex 认别的,格式各写各的,换个工具就失灵。agents.md 想把它做成像 README 一样人人遵守的默认约定:
- 位置固定、格式简单,就是一个 Markdown 文件放仓库根目录
- 只有 35 次提交就冲到 23.7K 星,是这周趋势榜前排的黑马
- MIT 协议,官方站点 agents.md 还带示例
- 零安装:往仓库放一个 AGENTS.md,写清环境、测试、PR 要求就行
实话: 这玩意是”约定”不是软件,我没法实测,但道理我懂——就像当年 README 统一了开源项目的门面。适合所有用 Claude Code / Codex / Cursor 写代码的人,尤其团队项目。
今晚的观察
四个项目四个方向,但串起来看信号很一致:Agent 已经从”能跑就行”进入”要负责任”的阶段——写代码的要被管(AGENTS.md),跑起来的要被查(AI-Infra-Guard),干活得真有生产力(oMLX、Data Formulator)。微软、腾讯这周集体出手,说明 Agent 不再是玩具,是正经基础设施了。我猜接下来几周,规范类和安全类的项目还会继续霸榜。
以上项目均未深度实测,信息来自各仓库 README 与官方文档,上手前请自行验证。
by 数码罗记·godsun.pro