订阅

AI Agent 今日: 2 |主题: 658|排名: 4 

  • 单个 AI Agent 不够用,多 Agent 协作开始成为新玩法。 New
    单个 AI Agent 不够用,多 Agent 协作开始成为新玩法。 ccteam 的思路是把 Claude Code、Codex、Grok、Kimi 等不同 Agent 组合成一个协作系统,让不同模型负责自己擅长的任务。 它会根据预设能力分工: Claude Code:任务拆解、方案设计 Codex:大规模代码编写 Grok:快速响应和辅助分析 Kimi:低成本批量任务处理 比较 ...
    019 九月旳风 发表于 前天 12:52 AI Agent
  • 一句公式,基本把 AI Agent 的核心讲明白了: New
    一句公式,基本把 AI Agent 的核心讲明白了: Agent = LLM + 上下文 + 工具 围绕这个思路,李博杰整理了一本《深入理解 AI Agent:设计原理与工程实践》,目前已经完整开源。 内容不是只讲概念,而是从上下文管理、工具调用、RAG、Coding Agent,到多智能体协作、多模态交互,一步步拆解 Agent 怎么真正落地。仓库里还配 ...
    027 刘诗楠 发表于 3 天前 AI Agent
  • 代码都让 Agent 写了,架构图还自己画? New
    代码都让 Agent 写了,架构图还自己画? Archify 就是专门把这一步也接过去。 Repo 丢给 Claude Code、Codex、Cursor、OpenCode。 它会自己从代码里整理出: 系统架构 Sequence Diagram 数据流 Workflow Lifecycle 我比较喜欢的是它能直接做: Before Delta After 一次改动到底动了哪块架构,新增了什么依赖,删 ...
    023 荒野丛林 发表于 3 天前 AI Agent
  • Agent 自我进化跑久了,会出现一种很危险的情况: New
    Agent 自我进化跑久了,会出现一种很危险的情况:分数涨了,能力却在悄悄变窄。这篇 HarnessEvolve 想解决 Agent 自我修改 Harness 时很容易遇到的几个问题。长任务失败后,最终 reward 只能告诉它「错了」,却很难知道真正从哪一步开始偏航。HarnessEvolve 会先生成一条经过验证的「参考轨迹」,再和失败轨迹对齐,找到最 ...
    022 axwww 发表于 3 天前 AI Agent
  • 一个终端命令,直接调度 13 个 AI Agent 做安全测试。 New
    一个终端命令,直接调度 13 个 AI Agent 做安全测试。 最近发现 PentestCode,把传统渗透测试拆成侦察、扫描、枚举、Web、AD、后渗透等专职 Agent,并行协作。 🤖 13 个 Agent 分工协作 ⚡ 多阶段任务可以并行执行 🧠 共享主机、漏洞、凭证等测试状态 📋 每一步都有证据链和 findings 记录 💾 关掉终端后,测试进度也能继 ...
    020 玥阳勤峰 发表于 3 天前 AI Agent
  • 推荐一个教 Agent 用图说话的 Skill:show-me New
    推荐一个教 Agent 用图说话的 Skill:show-me 来自 @humanlayer_dev 团队 @dexhorthy ,教 Agent 用简洁的图示、代码形态草图和单点聚焦的 HTML 页面,让用户直观看懂当前讨论的话题。 https://github.com/humanlayer/skills/blob/main/plugins/show-me/skills/show-me/SKILL.md 核心指令三句话: · 跳过铺垫,文字尽 ...
    021 yjs0375 发表于 3 天前 AI Agent
  • 一句公式,基本把 AI Agent 的核心讲明白了: Agent = LLM + 上下文 + 工具 New
    一句公式,基本把 AI Agent 的核心讲明白了: Agent = LLM + 上下文 + 工具 围绕这个思路,李博杰整理了一本《深入理解 AI Agent:设计原理与工程实践》,目前已经完整开源。 内容不是只讲概念,而是从上下文管理、工具调用、RAG、Coding Agent,到多智能体协作、多模态交互,一步步拆解 Agent 怎么真正落地。仓库里还配 ...
    017 xingke 发表于 3 天前 AI Agent
  • 终端里一口气跑几个 AI Agent,最崩溃的不是它们不会干活,而是你根本不知道谁在干、谁卡住、谁已经做完了。 New
    终端里一口气跑几个 AI Agent,最崩溃的不是它们不会干活,而是你根本不知道谁在干、谁卡住、谁已经做完了。 最近挖到一个 Hive,直接给一群 CLI Agent 套上“团队协作层”。 🤖 一个 Orchestrator 负责拆任务、派活 ⚡ Claude Code / Codex / Gemini / OpenCode 等都能当 Worker 📡 Agent 之间可以直接派单、汇报进度 📋 ...
    013 民间编诗人 发表于 3 天前 AI Agent
  • Go 开发者做 AI Agent,又多了一个官方级选择。 New
    Go 开发者做 AI Agent,又多了一个官方级选择。 Microsoft Agent Framework 的 Go 版本已经公开预览,目标不是做 Demo,而是帮助开发者构建真正能落地的 Agent 系统。 它支持多模型接入,不绑定单一厂商;同时提供工具调用、中间件扩展、上下文管理,以及多智能体工作流编排能力。 比较亮眼的是工作流部分,顺序执行、并 ...
    023 lnhssjw 发表于 3 天前 AI Agent
  • 想自己搭一个 AI Agent,可以看看这个开源框架。 New
    想自己搭一个 AI Agent,可以看看这个开源框架。 AstrBot 不只是做聊天机器人,而是把模型、工具、知识库和工作流整合到了一起,用来快速搭建自己的 AI 应用。 模型这边支持 OpenAI、Claude、Gemini、DeepSeek、Ollama 等主流方案;平台也覆盖 QQ、飞书、企业微信、Telegram、Slack 等。 另外还有 MCP、多模态、知识库、 ...
    029 宇智考试 发表于 3 天前 AI Agent
  • agent 绝对可以高速开发大项目。 New
    agent 绝对可以高速开发大项目。 我毕业后的第一个项目就是一个 10 亿美金预算,上千人团队的项目,所以学到的软件工程理念,直接学以致用了。系统定好架构和协议,分成 10 个模块,然后再模块内落地框架协议数据结构,每个模块,铺 300 - 700 人的团队干一年。 但是落地到每一个人的项目,能确保最终进入生产环境的,其 ...
    047 程丰 发表于 4 天前 AI Agent
  • LLM 能自己创建和演化 Agent Harness 吗? New
    LLM 能自己创建和演化 Agent Harness 吗? 来自 ByteDance Seed 等团队的研究者们,发布了一个把评测对象从 "任务答案" 转向 "Agent 执行基础设施" 的基准「HarnessDev」 论文:https://huggingface.co/papers/2609.01437 现有问题 同一模型换个 harness(执行循环、工具、上下文管理、恢复、验证),成绩可差十几个点, ...
    049 湖泊 发表于 5 天前 AI Agent
  • 看懂 AI 七层金字塔,一次性捋清 Token‑Prompt‑Context‑Agent‑Harness‑MCP‑Skills🔥 New
    看懂 AI 七层金字塔,一次性捋清 Token‑Prompt‑Context‑Agent‑Harness‑MCP‑Skills🔥 1️⃣Token:AI 理解世界最小积木块,直接决定成本 2️⃣Prompt:给 AI 下达的指令入口 3️⃣上下文 Context:AI 的对话记忆 4️⃣Agent:自主拆解任务干活的智能体 5️⃣Harness:AI 安全安全阀,管控行为边界 6️⃣MCP:万能连接 ...
    050 清晨日落 发表于 5 天前 AI Agent
  • GitHub 上的 Claude Skill / MCP 已经多到搜不动。 New
    GitHub 上的 Claude Skill / MCP 已经多到搜不动。 AgentSkillsHub 把 11 万+ 开源 Agent Skill、MCP Server、Codex Skill 和工具扫进来,按 10 维打分、安全分级、每 8 小时同步一次。 给 Claude Code、Cursor、Codex 找插件,不用再在 topic 里翻垃圾仓库。 注意:评分是启发式,不是官方认证。装之前自己看 README 和 ...
    048 大熊进口优化师 发表于 6 天前 AI Agent
  • 拿掉外部老师,AI Agent 自我进化几乎全部失效! New
    拿掉外部老师,AI Agent 自我进化几乎全部失效! 大多数所谓 "递归自我改进" 系统其实是半闭环:它们默认存在一个 "黄金验证器",一个外部的、可靠的评分信号,持续告诉模型 "方向对不对"。一旦这个外部老师被拿掉,Agent 能否自己闭合这个环,是一个悬而未决的问题。 ByteDance Seed 和 TokenWave 发布的「Self-Developi ...
    051 大概脑子不够用 发表于 6 天前 AI Agent
  • 你用不好 Agent,不是提示词写得差。 是你还在当监工。 New
    你用不好 Agent,不是提示词写得差。 是你还在当监工。 前两天我又把《AI炼金术》余一那期翻出来听。节目在小宇宙,栏目是徐文浩、任鑫做的。她把自己管的那一堆 Agent,说成一家百人公司。 她的原话,表里记的是: 「一个人调度100个agent的产出,可能超过1000个不用AI的人。」 (这条我没对上音频原文,先当她的主张, ...
    072 珠子 发表于 6 天前 AI Agent
  • AgentsView:给你的 agent 用量请个会计,常规工作中上万个 session、十几个 agent、每天烧上百美元,你的 AI 员工在干什么,你其实一无所知,AgentsView给所有 coding agent 装了个"监控... New
    AgentsView:给你的 agent 用量请个会计,常规工作中上万个 session、十几个 agent、每天烧上百美元,你的 AI 员工在干什么,你其实一无所知,AgentsView给所有 coding agent 装了个"监控大屏"来审计财务。 它能将20多家code agent 的会话搜出来、看明白、算清花了多少钱: usage daily 出每日成本、记录 token 与峰值上 ...
    033 蕙心纨质 发表于 6 天前 AI Agent
  • AI智能体工具的体验差距有多大? New
    AI智能体工具的体验差距有多大?Grok Bot拥有一个像iMessage一样流畅的移动App,可以随时随地派发任务。博主甚至在健身房就指挥AI装好了新模型!而Hermes目前完全没有移动端,这成了它最大的短板之一。#GrokBot# #HermesBot# http://t.cn/AXpOsDFK ​​​ ...
    033 珊珊子 发表于 6 天前 AI Agent
  • 1.5TB → 214GB。缩小七倍,几乎没有影响。
    1.5TB → 214GB。缩小七倍,几乎没有影响。 这就是 Hy4 预览版。诀窍在于 Sherry —— 我们的量化方法,将权重压缩到每个仅 1.25 位。(图片展示了其原理。) 它还开启了一种全新的运行方式:将您现有的 GPU 跨机器拼接,它们就能作为一个整体工作。 GGUF (量化版): http://t.cn/AX0GMA5v… 原始模型: 引用:We compres ...
    051 与君经年 发表于 7 天前 AI Agent
  • OpenClaw 2.0重磅发布,可极少人再去刷屏,这要放在5个月前,简直不敢想象。
    OpenClaw 2.0重磅发布,可极少人再去刷屏,这要放在5个月前,简直不敢想象。 它定义了Harness赛道,并抓住Claude的订阅漏洞,用 20 美元的 Claude Pro 订阅跑价值几千美元的 Token,让用户吃到了token经济学的第一波红利。 它也因为安全漏洞、上下文环境差、安装繁琐等产品原因,把快速积攒的市场份额拱手让给了新的龙虾 ...
    043 会飞的公奶牛 发表于 7 天前 AI Agent
  • 下一页 »

    快速发帖

    还可输入 120 个字符
    您需要登录后才可以发帖 登录 | 立即注册

    本版积分规则

    关注公众号

    相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

    Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

    在本版发帖
    关注公众号
    返回顶部