返回 AI Pulse
TAG COLLECTION

\bLLM\b

所有带有「\bLLM\b」标签的 AI 情报。

17 条情报
X.com08/24 19:47Agent

Andrej Karpathy 在斯坦福的 1 小时大师课 “删除一切,保留图” 他解释道,LLM 本身只占整个技术栈的 10%,而智能体最多也只能带你走到一半,但完整的 100% 归根...

Andrej Karpathy 在斯坦福的 1 小时大师课 “删除一切,保留图” 他解释道,LLM 本身只占整个技术栈的 10%,而智能体最多也只能带你走到一半,但完整的 100% 归根结底取决于有向图上的消息传递 当大多数人还在炫耀庞大的

X.com08/20 22:33Agent

苏黎世联邦理工学院将大语言模型智能体群体置于共识博弈中。完全没有对手的情况下,仅有41.6%的运行达成了有效共识。加入一个破坏者后,情况变得更糟。

苏黎世联邦理工学院将大语言模型智能体群体置于共识博弈中。完全没有对手的情况下,仅有41.6%的运行达成了有效共识。加入一个破坏者后,情况变得更糟。 智能体之间的协议是概率性的。结算必须是确定性的:https:// agent-dashboard.vector.apexfusion.org/?utm_source=x& utm_medium=social&utm_campaign=research-notes&utm_content=et

X.com08/17 00:20产品更新

中国的开放权重模型在欧洲正获得关注。

中国的开放权重模型在欧洲正获得关注。 因为这提供了另一条摆脱对外国专有API依赖的路径。 西门子已公开透露,正在一个独立的LLM平台上试验Qwen和DeepSeek,该平台可以运行所支持的开源权重版本。

X.com08/10 21:34商业动态

有时候我觉得拿LLM做很多事情太浪费计算资源,但是仔细想想计算机系统里大部分资源都没拿来直接做“有意义”的事情,比如图形界面、比如WebView、比如3D游戏。

有时候我觉得拿LLM做很多事情太浪费计算资源,但是仔细想想计算机系统里大部分资源都没拿来直接做“有意义”的事情,比如图形界面、比如WebView、比如3D游戏。

X.com08/08 23:32商业动态

In the era of base LLM scaling (2022-2024), I believed the LLM line of research would reach a...

In the era of base LLM scaling (2022-2024), I believed the LLM line of research would reach a capability plateau (as later seen with base LLMs). In late 2024, after the o3 test-time compute demo, I changed my views: the

X.com08/02 23:46基础设施

不要浪费2年时间去学习构建像Claude和ChatGPT这样的LLM。

不要浪费2年时间去学习构建像Claude和ChatGPT这样的LLM。 斯坦福大学刚刚发布了一门2小时的课程,讲解如何从头构建LLM。 • 00:00 - LLM分词 • 25:44 - LLM如何解码用户提示 • 35:40 - LLM的训练流程 • 1:16:47 - LLM架构从

X.com07/31 21:33Agent

最便宜的 token 是你从不发送的那个。

最便宜的 token 是你从不发送的那个。 大多数 AI 代理不断地将相同的上下文发送回 LLM。 CodeMode 将执行保持在代码沙箱内,只发送下一个决策所需的内容。 更少的 token。更低的成本。更快的代理。 https:// datalayer.ai/guide #AI

X.com07/20 20:01商业动态

理想气体定律与LLM训练是同一个方程。萨斯坎德的推导从自由能开始:F = E - TS。在固定温度和体积下将其最小化。通过微积分推导,压力在恒定T和N下作为p = -(∂F/∂V)出现。...

理想气体定律与LLM训练是同一个方程。萨斯坎德的推导从自由能开始:F = E - TS。在固定温度和体积下将其最小化。通过微积分推导,压力在恒定T和N下作为p = -(∂F/∂V)出现。对于理想气体,

X.com07/01 23:46商业动态

一位在阿姆斯特丹的博士生将她的黑曜石笔记库变成了一个在她睡觉时工作的研究助手。

一位在阿姆斯特丹的博士生将她的黑曜石笔记库变成了一个在她睡觉时工作的研究助手。 3200条笔记。 一周内47篇论文。 12个她未曾意识到的矛盾潜藏于自己的思维中。 这一切始于卡帕西关于LLM维基的想法。 不是聊天机器人。

X.com06/28 21:46基础设施

一位开发者通过插入一个AMD外置显卡,将一台2019年二手的Mac Pro改造成了一个35B参数的本地LLM服务器,总花费不到3000美元,使该设备达到了每秒52个token的处理速度。...

一位开发者通过插入一个AMD外置显卡,将一台2019年二手的Mac Pro改造成了一个35B参数的本地LLM服务器,总花费不到3000美元,使该设备达到了每秒52个token的处理速度。他发布了一段视频,显示Mac Pro放在桌子下面,一根雷电电缆连接到装有RX 6800的Paladin外置显卡扩展坞。

X.com06/25 22:35基础设施

所以我几乎加上了 - 家用 GPU 装备 这对于自给自足来说可能很好,但我仍然不认为本地 LLM 的东西在质量、性能(速度)或成本方面甚至无法接近云 让你的家自给自足是件好事,我有: -...

所以我几乎加上了 - 家用 GPU 装备 这对于自给自足来说可能很好,但我仍然不认为本地 LLM 的东西在质量、性能(速度)或成本方面甚至无法接近云 让你的家自给自足是件好事,我有: - 2x Tesla Powerwall (27

X.com06/24 21:45商业动态

1/ 我们使用法学硕士法官来扩大成本高昂的人工评估。但要信任法学硕士法官,您需要……人工评估。

1/ 我们使用法学硕士法官来扩大成本高昂的人工评估。但要信任法学硕士法官,您需要……人工评估。 我们的新预印本解决了这种循环问题:“度量匹配:评估法学硕士法官可靠性的子集选择方法”

X.com06/24 20:16商业动态

“在 @databricks ,我们现在可以在 30 天……或更短的时间内完成企业级 LLM 迁移。

“在 @databricks ,我们现在可以在 30 天……或更短的时间内完成企业级 LLM 迁移。 过去这需要长达三年多的时间。” Databricks 联合创始人 Arsalan Tavakoli

X.com06/14 20:15产品更新

上周刚刚发布,仅在HuggingFace上就已超400万次下载量 这使得Gemma 4 12B成为迄今为止最受欢迎的免编码器VLM。

上周刚刚发布,仅在HuggingFace上就已超400万次下载量 这使得Gemma 4 12B成为迄今为止最受欢迎的免编码器VLM。 此外,它还是第一款支持免编码器音频输入的通用LLM!