单个 AI Agent 不够用,多 Agent 协作开始成为新玩法。
New
单个 AI Agent 不够用,多 Agent 协作开始成为新玩法。
ccteam 的思路是把 Claude Code、Codex、Grok、Kimi 等不同 Agent 组合成一个协作系统,让不同模型负责自己擅长的任务。
它会根据预设能力分工:
Claude Code:任务拆解、方案设计
Codex:大规模代码编写
Grok:快速响应和辅助分析
Kimi:低成本批量任务处理
比较 ...
一句公式,基本把 AI Agent 的核心讲明白了:
New
一句公式,基本把 AI Agent 的核心讲明白了:
Agent = LLM + 上下文 + 工具
围绕这个思路,李博杰整理了一本《深入理解 AI Agent:设计原理与工程实践》,目前已经完整开源。
内容不是只讲概念,而是从上下文管理、工具调用、RAG、Coding Agent,到多智能体协作、多模态交互,一步步拆解 Agent 怎么真正落地。仓库里还配 ...
代码都让 Agent 写了,架构图还自己画?
New
代码都让 Agent 写了,架构图还自己画?
Archify 就是专门把这一步也接过去。
Repo 丢给 Claude Code、Codex、Cursor、OpenCode。
它会自己从代码里整理出:
系统架构
Sequence Diagram
数据流
Workflow
Lifecycle
我比较喜欢的是它能直接做:
Before
Delta
After
一次改动到底动了哪块架构,新增了什么依赖,删 ...
Agent 自我进化跑久了,会出现一种很危险的情况:
New
Agent 自我进化跑久了,会出现一种很危险的情况:分数涨了,能力却在悄悄变窄。这篇 HarnessEvolve 想解决 Agent 自我修改 Harness 时很容易遇到的几个问题。长任务失败后,最终 reward 只能告诉它「错了」,却很难知道真正从哪一步开始偏航。HarnessEvolve 会先生成一条经过验证的「参考轨迹」,再和失败轨迹对齐,找到最 ...
一个终端命令,直接调度 13 个 AI Agent 做安全测试。
New
一个终端命令,直接调度 13 个 AI Agent 做安全测试。
最近发现 PentestCode,把传统渗透测试拆成侦察、扫描、枚举、Web、AD、后渗透等专职 Agent,并行协作。
🤖 13 个 Agent 分工协作
⚡ 多阶段任务可以并行执行
🧠 共享主机、漏洞、凭证等测试状态
📋 每一步都有证据链和 findings 记录
💾 关掉终端后,测试进度也能继 ...
推荐一个教 Agent 用图说话的 Skill:show-me
New
推荐一个教 Agent 用图说话的 Skill:show-me
来自
@humanlayer_dev
团队
@dexhorthy
,教 Agent 用简洁的图示、代码形态草图和单点聚焦的 HTML 页面,让用户直观看懂当前讨论的话题。
https://github.com/humanlayer/skills/blob/main/plugins/show-me/skills/show-me/SKILL.md
核心指令三句话:
· 跳过铺垫,文字尽 ...
一句公式,基本把 AI Agent 的核心讲明白了: Agent = LLM + 上下文 + 工具
New
一句公式,基本把 AI Agent 的核心讲明白了:
Agent = LLM + 上下文 + 工具
围绕这个思路,李博杰整理了一本《深入理解 AI Agent:设计原理与工程实践》,目前已经完整开源。
内容不是只讲概念,而是从上下文管理、工具调用、RAG、Coding Agent,到多智能体协作、多模态交互,一步步拆解 Agent 怎么真正落地。仓库里还配 ...
终端里一口气跑几个 AI Agent,最崩溃的不是它们不会干活,而是你根本不知道谁在干、谁卡住、谁已经做完了。
New
终端里一口气跑几个 AI Agent,最崩溃的不是它们不会干活,而是你根本不知道谁在干、谁卡住、谁已经做完了。
最近挖到一个 Hive,直接给一群 CLI Agent 套上“团队协作层”。
🤖 一个 Orchestrator 负责拆任务、派活
⚡ Claude Code / Codex / Gemini / OpenCode 等都能当 Worker
📡 Agent 之间可以直接派单、汇报进度
📋 ...
Go 开发者做 AI Agent,又多了一个官方级选择。
New
Go 开发者做 AI Agent,又多了一个官方级选择。
Microsoft Agent Framework 的 Go 版本已经公开预览,目标不是做 Demo,而是帮助开发者构建真正能落地的 Agent 系统。
它支持多模型接入,不绑定单一厂商;同时提供工具调用、中间件扩展、上下文管理,以及多智能体工作流编排能力。
比较亮眼的是工作流部分,顺序执行、并 ...
想自己搭一个 AI Agent,可以看看这个开源框架。
New
想自己搭一个 AI Agent,可以看看这个开源框架。
AstrBot 不只是做聊天机器人,而是把模型、工具、知识库和工作流整合到了一起,用来快速搭建自己的 AI 应用。
模型这边支持 OpenAI、Claude、Gemini、DeepSeek、Ollama 等主流方案;平台也覆盖 QQ、飞书、企业微信、Telegram、Slack 等。
另外还有 MCP、多模态、知识库、 ...
agent 绝对可以高速开发大项目。
New
agent 绝对可以高速开发大项目。
我毕业后的第一个项目就是一个 10 亿美金预算,上千人团队的项目,所以学到的软件工程理念,直接学以致用了。系统定好架构和协议,分成 10 个模块,然后再模块内落地框架协议数据结构,每个模块,铺 300 - 700 人的团队干一年。
但是落地到每一个人的项目,能确保最终进入生产环境的,其 ...
LLM 能自己创建和演化 Agent Harness 吗?
New
LLM 能自己创建和演化 Agent Harness 吗?
来自 ByteDance Seed 等团队的研究者们,发布了一个把评测对象从 "任务答案" 转向 "Agent 执行基础设施" 的基准「HarnessDev」
论文:https://huggingface.co/papers/2609.01437
现有问题
同一模型换个 harness(执行循环、工具、上下文管理、恢复、验证),成绩可差十几个点, ...
看懂 AI 七层金字塔,一次性捋清 Token‑Prompt‑Context‑Agent‑Harness‑MCP‑Skills🔥
New
看懂 AI 七层金字塔,一次性捋清 Token‑Prompt‑Context‑Agent‑Harness‑MCP‑Skills🔥
1️⃣Token:AI 理解世界最小积木块,直接决定成本
2️⃣Prompt:给 AI 下达的指令入口
3️⃣上下文 Context:AI 的对话记忆
4️⃣Agent:自主拆解任务干活的智能体
5️⃣Harness:AI 安全安全阀,管控行为边界
6️⃣MCP:万能连接 ...
GitHub 上的 Claude Skill / MCP 已经多到搜不动。
New
GitHub 上的 Claude Skill / MCP 已经多到搜不动。
AgentSkillsHub 把 11 万+ 开源 Agent Skill、MCP Server、Codex Skill 和工具扫进来,按 10 维打分、安全分级、每 8 小时同步一次。
给 Claude Code、Cursor、Codex 找插件,不用再在 topic 里翻垃圾仓库。
注意:评分是启发式,不是官方认证。装之前自己看 README 和 ...
拿掉外部老师,AI Agent 自我进化几乎全部失效!
New
拿掉外部老师,AI Agent 自我进化几乎全部失效!
大多数所谓 "递归自我改进" 系统其实是半闭环:它们默认存在一个 "黄金验证器",一个外部的、可靠的评分信号,持续告诉模型 "方向对不对"。一旦这个外部老师被拿掉,Agent 能否自己闭合这个环,是一个悬而未决的问题。
ByteDance Seed 和 TokenWave 发布的「Self-Developi ...
你用不好 Agent,不是提示词写得差。 是你还在当监工。
New
你用不好 Agent,不是提示词写得差。
是你还在当监工。
前两天我又把《AI炼金术》余一那期翻出来听。节目在小宇宙,栏目是徐文浩、任鑫做的。她把自己管的那一堆 Agent,说成一家百人公司。
她的原话,表里记的是:
「一个人调度100个agent的产出,可能超过1000个不用AI的人。」
(这条我没对上音频原文,先当她的主张, ...
AgentsView:给你的 agent 用量请个会计,常规工作中上万个 session、十几个 agent、每天烧上百美元,你的 AI 员工在干什么,你其实一无所知,AgentsView给所有 coding agent 装了个"监控...
New
AgentsView:给你的 agent 用量请个会计,常规工作中上万个 session、十几个 agent、每天烧上百美元,你的 AI 员工在干什么,你其实一无所知,AgentsView给所有 coding agent 装了个"监控大屏"来审计财务。
它能将20多家code agent 的会话搜出来、看明白、算清花了多少钱:
usage daily 出每日成本、记录 token 与峰值上 ...
AI智能体工具的体验差距有多大?
New
AI智能体工具的体验差距有多大?Grok Bot拥有一个像iMessage一样流畅的移动App,可以随时随地派发任务。博主甚至在健身房就指挥AI装好了新模型!而Hermes目前完全没有移动端,这成了它最大的短板之一。#GrokBot# #HermesBot# http://t.cn/AXpOsDFK
...
1.5TB → 214GB。缩小七倍,几乎没有影响。
1.5TB → 214GB。缩小七倍,几乎没有影响。
这就是 Hy4 预览版。诀窍在于 Sherry —— 我们的量化方法,将权重压缩到每个仅 1.25 位。(图片展示了其原理。)
它还开启了一种全新的运行方式:将您现有的 GPU
跨机器拼接,它们就能作为一个整体工作。
GGUF (量化版): http://t.cn/AX0GMA5v…
原始模型:
引用:We compres ...
OpenClaw 2.0重磅发布,可极少人再去刷屏,这要放在5个月前,简直不敢想象。
OpenClaw 2.0重磅发布,可极少人再去刷屏,这要放在5个月前,简直不敢想象。
它定义了Harness赛道,并抓住Claude的订阅漏洞,用 20 美元的 Claude Pro 订阅跑价值几千美元的 Token,让用户吃到了token经济学的第一波红利。
它也因为安全漏洞、上下文环境差、安装繁琐等产品原因,把快速积攒的市场份额拱手让给了新的龙虾 ...