AI前沿速递|红队自动化、科研Agent、浏览器原生Agent

封面占位

title: “AI前沿速递|红队自动化、科研Agent、浏览器原生Agent”
slug: “redteam-sciagent-browser-agent”
date: “2026-07-09T22:30:00+08:00”
categories: [“AI前沿速递”]
tags: [“T3MP3ST”, “OpenScience”, “peerd”, “Agent Chief”, “agterm”, “Brain0”, “AI红队”, “科研Agent”, “浏览器Agent”, “AI安全”, “GitHub热门”]
author: “A7z-爱马仕”


晚上好,各位。今天刷GitHub的时候发现一个有意思的现象——这周新冒出来的项目,方向开始分化了。前两个月大家都在卷Agent框架、卷推理引擎,这周突然冒出来一堆”给Agent做基础设施”的东西:有管Agent注意力的、有审计Agent写代码的、有在浏览器里跑Agent的。说明什么?Agent本身已经不是问题了,怎么让Agent靠谱地干活才是。

废话不多说,今晚挑了6个真正有意思的新项目,全是这周刚出来的,没写过。


1. T3MP3ST — 自主红队平台,AI安全测试的”核按钮”

⭐ 4,006 | 语言:TypeScript | 创建于:2026-07-02

GitHub → elder-plinius/T3MP3ST

这项目一周4000星,疯了吧。作者elder-plinius是AI安全圈的老面孔了,这次搞了个多Agent红队元框架——说白了就是用AI去攻击AI。T3MP3ST跑的是自主红队流程,多个Agent协同执行攻击链,从信息收集到漏洞利用全自动。

亮点:
– 多Agent协同攻击:不是单点测试,是多个攻击Agent编排执行完整攻击链
– 自主决策:不需要人一步步指挥,Agent自己判断下一步打哪里
– TypeScript全栈:部署门槛低,Node环境就能跑

说实话,AI安全测试工具之前也有,但大多是人驱动的半自动工具。T3MP3ST直接把”人”从循环里拿掉了,让AI自己当攻击者。这对做模型安全评估的团队来说是个大杀器,但也确实让人后背发凉——毕竟攻防一体,工具本身也是双刃剑。


2. OpenScience — 开源AI科研工作台

⭐ 1,854 | 语言:TypeScript | 创建于:2026-07-03

GitHub → synthetic-sciences/openscience

Google的Co-Scientist你听过吧?这玩意就是它的开源替代。OpenScience是一个专门给科研人员用的AI工作台,从文献检索、实验设计到数据分析一条龙。

亮点:
– 科研全流程覆盖:文献综述→假设生成→实验设计→数据分析→论文撰写
– 本地优先:支持本地模型,你的实验数据不用上传到别人的服务器
– Bun运行时:比Node快不少,启动秒开

之前做科研AI的要么是闭源SaaS(Co-Scientist、Elicit),要么是零散的脚本工具。OpenScience第一次把整个科研流程串起来做成了开箱即用的CLI+Web工具。对学术圈来说,这比花钱买商业工具香多了。


3. peerd — 浏览器里跑Agent,P2P共享成果

⭐ 335 | 语言:JavaScript | 创建于:2026-06-22

GitHub → NotASithLord/peerd

这个项目思路很野——它是一个浏览器扩展,直接在你已经打开的浏览器标签页里跑Agent循环。不需要开终端,不需要装Docker,Agent就在你Chrome/Firefox里干活。更骚的是,它用WebRTC做P2P共享,Agent构建的东西可以直接分享给其他用户。

亮点:
– 浏览器原生:Agent直接操控你已登录的标签页,Cookie、Session天然可用
– 沙箱计算:JS Notebook + WASM Linux VM,在浏览器里跑代码
– P2P共享:WebRTC点对点分享,不需要中心服务器
– BYOK:自带API Key,无后端,无遥测

这思路确实新颖。之前browser-use之类的项目都是开个新浏览器实例,peerd直接在你正在用的浏览器里干活——这意味着Agent可以用你已经登录的账号,不需要重新登录。对做网页自动化的同学来说,这省了一大堆Cookie管理的麻烦。


4. Agent Chief — Agent的注意力管家

⭐ 319 | 语言:Python | 创建于:2026-07-04

GitHub → SmileLikeYe/agent-chief

这个项目解决了一个很实际的问题:当你同时跑好几个Agent的时候,谁该打断你、谁该闭嘴?Agent Chief是一个本地优先的注意力管理层,把所有Agent的通知、告警、输出统一过滤,只把真正需要你处理的事情推给你。

亮点:
– 注意力守门:不是所有Agent输出都值得看,Chief帮你过滤噪音
– 本地优先:所有决策在本地完成,不依赖云服务
– 统一入口:多个Agent → 一个决策 → 打断/不打断

这东西太需要了。我现在同时跑3-4个Agent,每个都在不停输出日志,根本看不过来。Chief的思路是:Agent的输出先过一遍过滤器,只有”需要人类决策”的才推给我,其余的静默处理。这比什么Agent编排框架都实用——编排是让Agent之间协作,Chief是让Agent和人类之间的接口不爆炸。


5. agterm — 为Agent Flow设计的终端

⭐ 239 | 语言:Swift | 创建于:2026-06-21

GitHub → umputun/agterm

umputun是老牌开源作者了(remark42、spot),这次搞了个专门给Agent流程用的终端。普通终端是给人敲命令的,agterm是给Agent跑流程的——它理解Agent的输入输出模式,提供结构化的交互界面。

亮点:
– 基于libghostty:用了Ghostty终端的渲染引擎,性能拉满
– Swift原生:macOS体验一流
– Agent感知:终端本身理解Agent的输出格式,自动结构化展示

说白了,现在的终端都是给人用的,Agent在里面跑就是一堆乱七八糟的输出。agterm让终端”理解”Agent在干什么,把输出结构化展示出来。对重度使用Codex CLI、Claude Code这类工具的开发者来说,这比在普通终端里看Agent日志舒服多了。


6. Brain0 — AI写代码的”黑匣子”

⭐ 132 | 语言:Rust | 创建于:2026-07-02

GitHub → Brain0-ai/brain0

这个项目解决的是AI编程的信任问题。Agent帮你写了代码,但你知道它为什么这么写吗?它读了哪些文件?做了什么决策?Brain0被动记录每个commit背后的Agent提示词和决策链,生成完整的决策图谱。

亮点:
– 决策图谱:每个commit → 对应的Agent prompt → 读了什么文件 → 为什么这么改
– 漂移检测:Agent的行为偏离预期时自动告警
– DLP审计:Agent读了什么敏感数据,全有记录
– 离线优先:一条命令启动,默认不联网
– MCP记忆:给编码Agent提供上下文记忆

这东西太重要了。现在AI写代码越来越普遍,但出了bug你根本不知道Agent当时在想什么。Brain0相当于给AI编程装了个飞行记录仪——出了问题可以回溯。对团队协作来说,这比code review有用多了,因为review只能看到结果,Brain0能看到过程。


今晚的观察

这周的项目有个共同点:都在给Agent做”配套基础设施”。

  • T3MP3ST:Agent怎么攻击(安全测试)
  • OpenScience:Agent怎么搞科研(垂直场景)
  • peerd:Agent在哪里跑(浏览器原生)
  • Agent Chief:Agent怎么跟人沟通(注意力管理)
  • agterm:Agent怎么展示输出(终端交互)
  • Brain0:Agent怎么留痕(审计追踪)

半年前大家还在争论”Agent到底有没有用”,现在的问题已经变成”Agent怎么用得靠谱”。从框架到基础设施,这个转变说明Agent真的在落地了。


觉得有用?收藏关注,每日午间+晚间更新AI前沿速递

by 数码罗记·godsun.pro

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注