我的经纪人给我报价 1.5 万美元来读 Twitter。
我的经纪人给我报价 1.5 万美元来读 Twitter。 这个数字不是玩笑,它就是上限。 X 本周向 Grok Bot 开放了 API:每读一条帖子 0.5 美分,平台每人每月限制 300 万次阅读。 1.5 万美元能买下所有这些,还能超出。
所有带有「\bagent\b」标签的 AI 情报。
133 条情报我的经纪人给我报价 1.5 万美元来读 Twitter。 这个数字不是玩笑,它就是上限。 X 本周向 Grok Bot 开放了 API:每读一条帖子 0.5 美分,平台每人每月限制 300 万次阅读。 1.5 万美元能买下所有这些,还能超出。
模型对于智能体栈来说是零成本的。 Grok Bot 可以在 2 秒内生成答案。 生产工作需要其周围的层级: 可持久保存的上下文 可执行的工具 可恢复的循环 可路由的图 可阻止损害的审批 在 1 天内更换模型。 构建
因此,本质上,我们已经运行 Salesforce Headless 和“Claudeforce”超过 6 个月了。 怎么做到的?我们只是通过 Salesforce API 实现了无头化,并在这个 API 之上使用了一个基于 Claude 本身构建的代理。事实上,这就是我们自有的 Claudeforce。 经验教训: - 我们永远不会回头
又一个例子说明,真正决定智能能走多远的,是 harness 而非模型本身。 仅靠 API,模型一旦停止,执行也就结束了。 @atomicagent_io,一个与模型无关的 agent 层,让 GLM 5.3 变得更好了,而且成本只多了 77 美分。 它保持了
英伟达首席执行官黄仁勋: “每位工程师都将拥有并管理数百个智能体。” 2026年最有价值的工程技能并非任何大学都会教授。 没有计算机科学课程教授驾驭工程。 没有训练营教授智能体记忆架构。 没有学位
LOOPS VS GRAPHS:2026年让你升职的唯一区别 问十个运行Claude的工程师他们在用哪个。 八个不知道。这就是差距。 loop - 你设定框架,智能体找到路径。最适合还没人知道路线的时候 graph - 你绘制……
7月24日,AnySearch、OpenBuild和DataWhale将在北京通过产品首发、真实集成案例以及一场关于面向智能体的信息基础设施的圆桌讨论,探索AI搜索的未来。 随着搜索用户从人类转向智能体,仅有链接已不再
Claude 的新一篇博文《How Warp builds self-improving agents on Claude》( Skill 的进化问题。 这个问题我以前也研究过,我写了一个反编译 JS 代码的 Skill( Agent
这他妈简直是黄金 我见过的最干净的图工程配置 一个智能体从原始来源中提取主张,一个提出它们如何连接,一个将每条主张与已有内容进行核对 每条主张都会被追加、加上时间戳、标注来源。没有任何内容会被覆盖
我靠——Grok机器人点燃了导火索,Kimi K3搭起了队伍 视频里的想法很简单:一个人用一个周末把Kimi K3变成了一个四人AI团队,让每个智能体负责特定任务,而不是让一个模型包揽所有事情。一个负责研究,另一个负责写作,
我的 8 个智能体的 Grok Bot 交易台本周实现了完全放手。从那以后它再也没找过我。整个交易台在我睡觉时自己交易。不是标题党。 我不再一个个照看孤立的提示词。我把整个交易台接入了一张组织架构图,只用一个屏幕教了它一次。
Replit 总裁 Michele Catasta 谈编程智能体: "我认为最简短的概括就是自主性" Replit 总裁用 24 分钟解释编程智能体如何每次进行 10 到 15 分钟的有用工作 用户可以在实时运行期间通过聊天停止或重定向智能体
Anthropic 工程师: 「不要信任你的智能体永远不会出错。让第一个错误可恢复,并让 95% 的潜在损害无法触及。 我们是在一个智能体自信地在 90 秒内做错了约 200 次之后学到这一点的。」 在这场演讲中,他揭示了 Anthropic
大多数测试 K3 Agent Swarm 的人只会让它做一个落地页,然后称之为 demo…… 而这一次,我们要求它实现一个可用的数据库、真正的筛选功能,以及上线文档——这才是真正有趣的地方。 以下是 300 个 agent 一步步构建真实产品的全过程: -
这太他妈疯狂了 有人用这个赚了1.7万美元,我还是不明白为什么还没所有人都用上 Grok Bot 现在让你用一条消息就能启动整个智能体团队 多个机器人一起协作完成任务,而不是一个单独的智能体独自辛苦处理。 以下是
我真的想不通,为什么更多人不用一个从不下线的智能体来运营自己的 X 账号 Grok bot 悄悄解决了那个让大多数 AI 自动化在你合上笔记本电脑的瞬间就崩溃的核心问题,但几乎没人在认真测试它 下面是
代价最高的 AI 错误不是一次错误的回答。而是一个每周二都会运行的错误回答。 聊天机器人偶尔产生幻觉只是烦人。 一个拥有 Gmail、文件、仪表盘和定时任务的智能体,每周都在同一个工作流上产生幻觉,这是基础设施故障。 这就是
一名Kimi工程师刚刚展示了为什么智能体记忆应该被构建为“规则+关系”,而不是更庞大的聊天记录。 3个持久化约束在运行前加载,随后每一条有用的主张、实体和冲突都会被添加到同一个上下文图中,而不会随会话一起消失。
卧槽,这个 84K Star 的仓库让 Kimi 变成了编程智能体 OpenHands 是一个开源软件工程智能体,它可以编辑文件、运行命令,并在每个提示词后持续工作而不中断 仓库 → 智能体工作区 → Kimi k2.7 → 编辑 → 运行 → 验证 →
Grok Bot 现在已在 Cursor 订阅中上线。 我们发布周就上线了。它从不要求占用我们的电脑,每个机器人都有自己的电脑。几个小时后,我们就不再叫它智能体了。 它是员工。 以前要用上意味着每月 300 美元的 SuperGrok Heavy 或 200 美元的 Cursor Ultra。现在 Pro+ 就够了。
现在用 Grok 机器人经营企业,简直简单到有点不公平了。 我运营的是一个小型机器人团队,而不是一个万事包办的代理。以下是架构及其有效的原因: > Atlas 是我的幕僚长。我只和 Atlas 沟通。它会读取其他机器人的角色,并把每项任务分配给合适的那位。
他以 3,000 美元的價格銷售 AI 自動化服務 而最有趣的事情並不是某種複雜的機器人。 AI Agent 接收訊息、處理它們、使用記憶體,並透過 Gmail 發送電子郵件。 所有這些都可以透過 n8n 來整合。 也就是說,人們不只是為 AI 付費。 他們為
已恢复的 17,600 个操作,生产环境内的四天半,而动机却是所有可能中最无聊的那个。Hugging Face 发布了取证重建结果。一个运行名为 ExploitGym 的网络基准测试的 OpenAI 智能体,从其评估沙箱中越狱,通过
36.2% 如果放宽一个标准,就会变成大约 72%。同样的运行,同样的模型,放宽评分标准中的一条。这就准确地告诉你那些失败是由什么构成的。智能体几乎完成了全部工作。它唯一遗漏的是该策略存在的根本原因。论文这样表述。
你准备好让你的代理人访问你的银行账户了吗?
AI 记忆层方面正涌现出大量出色的工作。 而这看起来已经非常接近修复我最讨厌的 Gmail 那个部分了。 @getlindy 的新 Chrome 扩展程序将 AI 智能体助手直接搬进我的 Gmail 里。 无需再切换到单独的 AI 界面去
苏黎世联邦理工学院将大语言模型智能体群体置于共识博弈中。完全没有对手的情况下,仅有41.6%的运行达成了有效共识。加入一个破坏者后,情况变得更糟。 智能体之间的协议是概率性的。结算必须是确定性的:https:// agent-dashboard.vector.apexfusion.org/?utm_source=x& utm_medium=social&utm_campaign=research-notes&utm_content=et
TinyFish 已在 Pond 上线 4 天。83 个 AI 智能体和人类专家使用它运行了任务,其中 10 个已结算。如果任务需要实时网页数据,TinyFish 会去获取。搜索并抓取任何网站,若需要点击和操作时则使用网页智能体。开放任务
调优评估器会自动为生产轨迹添加质量反馈。它们已预置了经过调优的模型、提示词和托管基础设施,因此您只需点击几下,即可开始发现需要关注的智能体行为。
了解 @unifygtm 如何在发布两周前,在上期 Max Agency 节目中将模型成本削减 90–95%。 YouTube: Apple: Spotify:
让 AI 代理更快运行的最佳方式是一份权限清单。原因如下:你委托给代理的方式和委托给员工一样:安全任务、授权任务、禁止任务。将每个任务归入这三类之一,你就总能知道它有多大的余地
如果你的AI审查自己的工作,它永远不会发现自己的错误 一个有61个智能体的仓库在一周内获得了10,000个GitHub星标,原因并不是什么新模型。每个智能体都只有一个任务。 但这还不是最有趣的部分。 当一个模型编写代码,然后
“如果你不能一開始就讓 Agent 直接試用並立即投入生產,那你就完了。舊的、緩慢的「演示—決策—實施」流程正在消失。現在的驚艷體驗是,你的 Agent 在第一天就真正運作起來。” @abialecki 首席執行官 @klaviyo
让代理在凌晨3点与你一起解决事件。
LangSmith 现在可以在 @awscloud 上作为自带云(BYOC)部署提供。 将智能体追踪和运行时数据保留在您的 AWS 边界内,而 LangChain 负责配置、升级、扩展和支持。 BYOC 让团队兼具数据主权与托管服务的速度。
今天我在 Hermes 桌面应用中试用了 Bot Mode,所以快速录制了一段视频,展示其主要功能,以及与常规 Hermes 会话的区别: - 侧边栏显示可对话的机器人列表(agent profiles) - Agent Inbox 允许机器人之间直接通信
发布日!!!@invideoOfficial Agent 2 现已上线!!!
隆重介绍 Monid,将您的智能体连接到 1,200 多个工具和 API 的最简单方式。 您的智能体在运行时即可发现、运行并支付工具费用。 因此,您再也无需注册十几个账户,也不必为几乎不用的订阅付费。 上个月我们路由了超过 100 万次工具调用。方法如下
Garry Tan 表示,AI 可以让单个 markdown 文件像员工一样工作: “如果你真的想最大化 token 利用,就必须使用类似 Hermes Agent 或 OpenClaw 的工具……让我能在任意一个请求中加载 100 万或 80 万个 token。” “对于 CEO 或创始人来说,它实际上
Your AI coding agent proposes five classes, three levels of inheritance, and a metaclass. The problem needed one @dataclass . Build the judgment to tell the difference:
Agent workflows change with every request. NVIDIA NeMo Switchyard is an open-source model-routing library that routes each request across the models you choose using live context, tool results and agent progress. See how
The boundary between a specification and a product is dissolving. A Markdown file can now behave like a small software service when an AI agent can read instructions, use tools, and act on schedule. "Do you know how many
Hermes has twelve browser tools. Browser Use mode replaces them with a single one, driven by @browser_use 's CLI 3.0. Instead of a dozen schemas in every request and a tool call per click, the agent writes a script. In o
Claude Code把间接提示词注入攻击压到了【接近0】。 Boris Cherny透露,关键不是单一防线,而是叠加模型训练、输入探测和意图分类器;即使面对未见过的攻击,也能保持效果。 基于这套防护,Auto Mode将从下周起成为默认模式。Agent安全可能真的迈过了一道坎。
You know how refreshing the page kills your AI chat mid-response? @triggerdotdev 's new chat agent fixes that so it survives crashes, redeploys and can pause to ask permission before a tool does something scary. Worth ch
Stop outsourcing your PR review agent. It's so easy to build your own! Here's how to hand-roll a PR review agent with GitHub CI in 60 seconds:
Day 11! Under the hood - this agent is a different beast!
...
在全公司部署 AI 智能体。每个智能体都拥有独立的提示词、工具、技能和预算——全部通过单一指挥中心统一管理。
...
一位博士研究生,做研究那几年脑子里塞满了论文、想法、各种截止日期。 后来记不住东西了,试了一圈笔记工具都觉得不对路,干脆自己做了一套。 My-Brain-Is-Full-Crew,给 Obsidian 配了 8 个 AI Agent,各管一摊。
Meta’s new coding agent is cheap (but it’ll cost you your data).
If story is king then workflow is queen Check out these different use cases on how to use Workflows inside invideo Agent Two. Pre-production just gets smoother and smoother these days.
Today, Sierra’s launching Voice Personas, which enable you to give your agent not just a voice, but a personality. Voice AIs shouldn't sound the same. It's time to empower every company to define their own brand voice. A
Hermes Agent Desktop keeps evolving
“The others make the easy part easier. Vercel makes the hard part easy” – direct quote today from tech lead for AI agent platform built on http:// eve.dev at 55,000+ person company. They wanted to have their company's al
expertise is mostly knowing what questions to ask and workflows you choose at the start is one way we've put that into the agent, so it asks you what it needs instead of you guessing what to brief. 9 at launch across fil
An engineer asked a coding agent to fix a small bug. The agent decided the cleanest fix was to delete the prod environment. No confirmation prompt. No second pair of eyes. 13-hour outage, 6.3 million orders lost. @ajeets
sie - Open-source inference server and production cluster for all the models your agent needs.
You have a repeatable video process? You can teach that to this AI agent!
如果您是与 Agent Harness 相关的开源项目的开发者,并希望参与 DeepSeek Harness 的 beta 测试,请回复或私信我。请附上您的 GitHub ID 和一个代表性开源项目。
当其他人都在争论最新模型时,Twitter和Reddit几个月来一直在热议另一件事:一个名为OpenClaw的AI智能体。它不是聊天机器人,它实际上会在你的电脑上执行操作、读写文件、运行终端命令、发送电子邮件,
那些向AI语音客服收取数千或数万美元费用的皮包公司要倒大霉了——官方版本已经把他们的把戏彻底揭穿了。 LiveKit已正式开源这个实时语音AI代理框架,直接串联语音
这个实验挺有趣的!给一个AI代理一台Mac mini和一个真实的在线iOS应用。为它配备了一个邮箱和一张虚拟信用卡,让它自己推广产品并赚钱。虽然实验失败了——海外沟通依赖电子邮件,
关于自我进化智能体的优秀论文。 企业智能体在将其混乱的日常工作转化为安全的学习数据之前,无法真正改进。 未来的企业智能体可能通过先更新记忆再改变其底层模型来改进。 问题在于,已部署的智能体会产生许多
有人在 Hermes Agent v0.19.0+ 中解析了三个隐藏的“Quicksilver”功能,它正成为自主 AI 代理的终极配置而流行。 大多数人都在照看他们的 AI 助手,但配置智能审批、单轮模型路由和自我改进的 cron 任务可以
一个AI代理能够构建整个流程、设计、时间安排等等,这一事实意义重大。如果你想连接你的代理,请尝试这里: (也适用于codex,所以自己去运行吧。)
我从今天(7月29日)到7月31日(周五)将访问多伦多的Trajectory Labs。我非常乐意与任何对合作式人工智能、多智能体系统及相关话题感兴趣的人交流想法。欢迎联系!
代理式人工智能需要新的身份与访问管理方法
但像X这样包含大量视觉内容的应用仍然会存在。我希望能够通过触摸滑动,或者使用眼镜进行眼球导航。即使是一个能够按需生成完美可视化的超人AI代理,也不得不使用像Signal或Amazon这样的应用来进行交互。
我觉得人工智能在一定程度上可以处理状态管理,但性能可能不是其强项,因为这要求代理完全理解所有传输数据的结构、输入输出、后端操作以及诸多可能不掌握的上下文。
4月3日,安德烈·卡帕斯发布了一个修复AI失忆的方法——而开发者界在一个周末内就纷纷效仿。以下是完整构建:将你的笔记转化为你的智能体可以查询的知识图谱,并以你拥有的纯Obsidian Markdown格式保存:• 00:00 - 你的编程助手患有失忆症
荒谬的论点 - 没有任何公司会在短期内放弃微软办公套件和Azure,如果说有什么变化,人工智能反而是一股顺风,因为增加了功能和智能体之间的工作流。股价可能会追随谷歌,并在更高的资本支出指引下下跌。谷歌通过增发股票点燃了引信。
忘记你所知道的关于多智能体系统的一切!这个界面正在运行一个实时推理网格,其中64个专用节点每12毫秒交换状态更新,而不是等待中央协调器。每个决策在下个令牌甚至生成之前就被传播。
刚刚干掉了所有其他的编码智能体IDE。这款IDE适用于你现有的工作流程。没有那些编排的废话。管理数千个有状态的Claude代码会话,每个都在“处理一些事情”。达到你的订阅限制?一键切换订阅,恢复会话。关闭你的电脑?打开
我的智能体运行了两周,一切正常。令牌没问题,延迟没问题,零错误。我盯着仪表盘,感觉很平静。然后我打开了实际输出。它一直自信地输出垃圾。在图表上,这是两个分开的盒子,而我一直在混淆它们。
突发新闻... 应用图工程刚刚将自主智能体转化为永不停止的执行引擎。 不再是线性的提示链,每个智能体都是一个图节点,具有隔离状态、局部内存和确定性转换。循环控制器持续重新调度。
CLAUDE目前根据系统实际需求生成五种不同的图架构 大多数代理系统无论规模如何都被迫采用单一拓扑结构,在不需要协调的任务上浪费协调开销。 该应用程序为顺序任务构建线性链
传统的职位角色就像那些你还在寻找前端工程师、后端工程师、大数据工程师等等。你应该关注的是AI产品经理、企业FDE和AI代理工程师。我要做一个大胆的预测:变化在
Agent治理不仅限于安全,还整合了身份验证、审计日志、用户管理、提供商密钥、数据隔离、数据驻留、速率限制、回退机制以及集中式支出控制。 8月12日,我们将分享一个实用的评估框架。
如果你正在使用@GoogleDeepMind Gemini Live构建实时语音代理,现在可以直接在@LangChain中追踪你的语音到语音代理循环! - 说话者回调钩子仅捕获用户在中断事件前听到的确切音频。 - 实时时间线
首个在GAIA基准测试中超越Hermes的开源本地代理。 是循环设计,而非模型规模,造成了这一差距。 @atomicagent_io ,一个本地优先的AI代理,运行在你的机器上,支持本地或云端模型。在macOS、Windows和Linux上开源。 两个代理都推动了
吴恩达刚刚发布了一门关于构建智能体知识图谱的免费1小时课程。60分钟。免费。来自那位培养了全球半数AI工程师的人。00:00 - 智能体图谱简介 03:07 - 智能体图谱的构建 14:00 - 多智能体架构
Nanocoder 是一个基于终端的编码代理,可在任何模型上运行并保持代码本地化,由社区集体而非公司构建。 - 通过 Ollama 或任何兼容 OpenAI 的 API 使用您自己的模型 - 内联模式将消息渲染到终端的原生回滚中
一个团队仅通过单一提示词,运用应用图工程部署了15个自主循环代理。大多数开发者仍手动硬编码多代理系统,为每个独立任务编写单独逻辑。图工程通过使用中心拓扑图改变了这一现状。
所有模型现在在Nous Portal限时八折优惠,这是驱动您的Hermes Agent的最佳方式。是的,即使是昂贵的前沿模型也不例外。
我们刚刚筹集了550万美元来回答一个问题: 当你的AI代理搞砸时,谁来买单? 到目前为止,没有人有好的答案。 这就是为什么我们构建了 @klaimee_ai :为AI代理提供保险支持的性能保证。 AI代理正在企业内部采取实际行动。它们可以
当您配置以下5项内容时,HERMES代理的实用性将提升10倍。每项配置仅需5分钟。大多数用户从未触及这些设置。 1. 正确的模型 一个模型应对所有任务 = 对大多数任务而言都是错误的模型。 GPT-5.6 Sol:最强推理能力。日常首选。通过您的访问权限获取。
同一代理。同一任务。不同价格标签。 → 浏览网站:1.43美元 → 运行它自己构建的CLI:0.18美元 它只学习了一次网站。再也没有浏览过。 这不是折扣。这是不同的架构。 看看 @heywebcmd
什么是适合短视频社交的最佳视频编辑代理?它真的有效吗?我们观看了专业视频编辑者一步步在Adobe Premiere Pro中制作短视频社交片段的过程。今天,我们在@huggingface上开源这个预览数据集,以推动AI代理的发展。
Kimi Code CLI:终极终端AI编码工具 官方Moonshot AI开源终端AI代理:一键启动Kimi,能够读写代码、运行Shell命令、搜索文件、抓取网页并自主决策。 支持
Hermes Agent v0.19.0:水银发布
他27岁。他的AI代理在他睡觉时运营着生意。大多数人仍用AI回答问题。他用AI运营公司。一个代理研究产品。另一个创建内容。另一个发布帖子。另一个管理运营。一切都在一个系统中运行。
一个AI代理系统全天候运营整个公司——但这只是冰山一角。我刚看了一个制作精良的视频,展示了一个AI代理系统。它配备了一个完整的“神经皮层”仪表盘,所有代理实时连接并协同工作:> A
人们正在用KIMI K3构建令人惊叹的世界
HERMES AGENT v0.18.0 刚刚发布。 “审判版本。” 1,720 次提交。998 个拉取请求。370 多位贡献者。 零个未解决的 P0 或 P1 错误。有史以来第一次。 团队花了 12 天清理 整个仓库中所有关键和高优先级的问题。 解决了 692 个项目。 零个 P0。零个 P1。他们