一名Kimi工程师刚刚展示了为什么智能体记忆应该被构建为“规则+关系”,而不是更庞大的聊天记录。
一名Kimi工程师刚刚展示了为什么智能体记忆应该被构建为“规则+关系”,而不是更庞大的聊天记录。 3个持久化约束在运行前加载,随后每一条有用的主张、实体和冲突都会被添加到同一个上下文图中,而不会随会话一起消失。
所有带有「\bKimi\b」标签的 AI 情报。
10 条情报一名Kimi工程师刚刚展示了为什么智能体记忆应该被构建为“规则+关系”,而不是更庞大的聊天记录。 3个持久化约束在运行前加载,随后每一条有用的主张、实体和冲突都会被添加到同一个上下文图中,而不会随会话一起消失。
Unsloth AI 刚刚把 Kimi K3 压缩到 1-bit,并在 4 张 B200 上以每秒 36 个 token 的速度本地运行复杂物理模拟,而且没有崩溃 把权重量化到 1-bit 以前会让模型彻底变傻 Unsloth 的自定义内核打破了这一壁垒,将显存需求削减了
FreeKimi K3 has been extended through August 12! Quick setup: → http:// tokenrouter.com /?twclid=29rsf4jjnwwdpgtty0qfd5lnjx → get API key → model: moonshotai/kimi-k3-free → base URL: http:// api.tokenrouter.com/v1 ?twcli
开放模型不再只是廉价的备选方案。 Kimi K2 已足够接近前沿编码模型,以至于真正的问题变成了: 你在这个任务中需要最好的模型吗? 还是需要一个强大、快速、开放且足够便宜,可以每天使用的模型? 基准测试并非
MOONSHOT 刚刚构建了一个免费、开源的 Claude Code 复制品。它名为 Kimi Code CLI,来自 Kimi K3 背后的团队。具备 Claude Code 所没有的功能。可直接输入屏幕录制。内置编码、规划和研究代理,每个代理独立运行。
Kimi K3 绝对牛掰! HyperFrame 团队用 Kimi K3 复刻了一个超知名动态设计团队的动态设计视频,还原度极高。 而且他们的风格超级独特——说实话,挺难模仿的。 然后搞笑的是,
在美国就对中国芯片实施出口管制展开辩论之际,阿里巴巴最新发布的模型宣称的成就大于其提供的证据。该声明背后没有基准测试表、模型卡或许可证。只有一条推文和一个预览接口——恰好是在月之暗面的Kimi发布两天后推出的。
最近发现了一个实用的开源项目:OpenCodex。它让Codex不再局限于GPT模型,还可以接入Kimi、Grok、GLM等其他大模型。一次配置后,原有的Codex应用和工作流基本不受影响。
鲍里斯·切尔尼 (Boris Cherny) 大声说出了有关特工工作的安静部分: “通常每天晚上我都会有几千人在做更深层次的工作。” 有用的问题是,是什么阻止这些特工犯下更深层次的错误 这段代码中运行的 Kimi K2.6 以循环回答 >
李文停止每月支付199美元订阅AI服务。他在桌上堆了几台 Mac Mini,把工作负载搬到了本地。用上了 Kimi K2.6——约1万亿参数,300个并行代理。大多数人还在按月租借的同等级算力,现在他的模型跑在自己的硬件上。