AI Pulseに戻る
TAG COLLECTION

インフラ

「インフラ」タグが付いたAI Pulseの更新一覧です。

78 件のシグナル
X.com08/30 23:17インフラ

"Claudeの利用上限に達しました。上限は午後7時にリセットされます。" 毎日。本当に毎日。

"Claudeの利用上限に達しました。上限は午後7時にリセットされます。" 毎日。本当に毎日。 Maxに200ドル払うところだった。そしたらこの18分の動画を見つけた 98.5%のトークンが無駄になった あなたが払っているのは回答の対価じゃない。Claudeにコードベース全体を30回読み直させる対価だ 私は使った

X.com08/30 23:17インフラ

まだトップクラスのLLMを定価で支払っていますか?Jalapeno Cloudの期間限定セール:GLM-5.3-Flashが50%オフ、DeepSeek V4 Flash 0731が80...

まだトップクラスのLLMを定価で支払っていますか?Jalapeno Cloudの期間限定セール:GLM-5.3-Flashが50%オフ、DeepSeek V4 Flash 0731が80%オフ——自社のGPUスタックから直接提供。

X.com08/30 20:06インフラ

フーリエ変換はすべてのGPU、すべてのWiFiチップ、すべてのMRIスキャナーの内部で動作している——それはただの掛け算と積分にすぎない。

フーリエ変換はすべてのGPU、すべてのWiFiチップ、すべてのMRIスキャナーの内部で動作している——それはただの掛け算と積分にすぎない。 この方程式は怪物のように見える。ギリシャ文字、虚数、負の無限大から正の無限大までの積分。ほとんどの人はそれを見て、

OpenAI08/26 08:00インフラ

JalapeñoはOpenAIのカスタム推論チップであり、最新のモデルに対して高いスループットと低レイテンシを備えた、より高速で省電力なAI推論を実現します。

JalapeñoはOpenAIのカスタム推論チップであり、最新のモデルに対して高いスループットと低レイテンシを備えた、より高速で省電力なAI推論を実現します。

X.com08/24 19:34インフラ

Jane Street は、22 歳の若者に対して、無料で学び始められるスキルに対し年俸 50 万ドル以上を支払うことがある。

Jane Street は、22 歳の若者に対して、無料で学び始められるスキルに対し年俸 50 万ドル以上を支払うことがある。 それは、不確実性に数値を与える方法を知ることだ。 インド工科大学カラグプール校の教授である Mrityunjoy Chakraborty は、公理から始まり構築されていく確率論の無料講義シリーズを提供している。

X.com08/22 20:47インフラ

Claude Fable 5 ボットが手動トレーダーを置き換えつつある Polymarket 用の最もシンプルな裁定取引ボットを約6時間で構築 コスト:500万トークン 現在のセッション...

Claude Fable 5 ボットが手動トレーダーを置き換えつつある Polymarket 用の最もシンプルな裁定取引ボットを約6時間で構築 コスト:500万トークン 現在のセッション損益:+$2,793.36 そして、それはまだたった一つのことを行う: YES + NO < $1 のときに取引を開始すること。 それだけ。 しかし、これで裁定取引の機会に到達できる

X.com08/22 20:02インフラ

EIS 導入前:CPU ノード、セルフマネージド、モデルごとに 1 つ。

EIS 導入前:CPU ノード、セルフマネージド、モデルごとに 1 つ。 EIS 導入後:Elastic による管理のもと、GPU 加速フリート 1 つ。 ベクトル検索とセマンティック リランキングは、それぞれユーザーが自分でプロビジョニングした CPU ノード上で実行されていました。 モデルが増えるほど、運用するインフラストラクチャも増えていました。 Elastic Inference Service(EIS)

X.com08/22 19:03インフラ

Google DeepMindが12分で「思考モデル」を解説 塩と砂糖の例は Best-of-N を葬る:一度ラベルを間違えれば、100個の失敗したケーキを焼くことになる。頻度は系統的な...

Google DeepMindが12分で「思考モデル」を解説 塩と砂糖の例は Best-of-N を葬る:一度ラベルを間違えれば、100個の失敗したケーキを焼くことになる。頻度は系統的な誤りを修正しない。検証器を入れるか、死ぬか。 9個対27個のリンゴ:ワンパスは失敗し、CoT(Chain-of-Thought)は通った。誰も CoT のトークンコストを問わない。

X.com08/20 23:17インフラ

フィンランド。タイ。オーストラリア。インド、その他多数。エッジでの RTX GPU、$0.10/時間から。Theta EdgeCloud にデプロイ。

フィンランド。タイ。オーストラリア。インド、その他多数。エッジでの RTX GPU、$0.10/時間から。Theta EdgeCloud にデプロイ。

X.com08/20 23:17インフラ

GamerHash AI を使えば、独自の GPU で動画、画像、チャット応答を生成できます。すべてローカルで実行されるため、料金はかからず、誰にも肩越しに見られません。

GamerHash AI を使えば、独自の GPU で動画、画像、チャット応答を生成できます。すべてローカルで実行されるため、料金はかからず、誰にも肩越しに見られません。 しかし、あなたの GPU にはもう一つの機能があります。 作成が終わったら、Earn モジュールをオンにしてください。開発者が

OpenAI08/20 08:00インフラ

Replit は GPT-5.6 Luna を搭載した Free Mode を導入し、トークンコストを気にせず、誰でもアイデアを実動するソフトウェアに変えられます。

Replit は GPT-5.6 Luna を搭載した Free Mode を導入し、トークンコストを気にせず、誰でもアイデアを実動するソフトウェアに変えられます。

X.com08/19 00:03インフラ

TypeGPU における深度を考慮したライトインジェクション 448×448 の単眼深度モデルを、M4 Pro 上で約 250 回のディスパッチを跨って約 8 ms にまで短縮できました...

TypeGPU における深度を考慮したライトインジェクション 448×448 の単眼深度モデルを、M4 Pro 上で約 250 回のディスパッチを跨って約 8 ms にまで短縮できました。これはリアルタイムで使うには十分速いです :D 推論が TypeGPU に直接書かれているので、深度バッファをそのまま

X.com08/19 00:03インフラ

NASA は私たちの申請を拒否した。だから私たちは独自のコックピットを作った。

NASA は私たちの申請を拒否した。だから私たちは独自のコックピットを作った。 GamerHash AI にプロンプトを1つ入力すれば、あなたの GPU が離陸をフレームごとにレンダリングする。完全無料。

X.com08/19 00:03インフラ

Anthropic エンジニアの Andrej Karpathy 氏が、『Intro and Deep Dive to LLMs and Tokenizer』の全6時間ガイドを公開しまし...

Anthropic エンジニアの Andrej Karpathy 氏が、『Intro and Deep Dive to LLMs and Tokenizer』の全6時間ガイドを公開しました: • 00:00 - LLM入門 • 00:59:28 - LLMの深掘り(Karpathyメソッド) • 03:31:43 - GPT Tokenizerをゼロから作ろう このKarpathyコースは置き換える

X.com08/17 00:20インフラ

ウォール・ストリート・ジャーナルのタイトル選択は興味深い。

ウォール・ストリート・ジャーナルのタイトル選択は興味深い。 エヌビディアと6つの金融機関は、独立したコンピュート・ファイナンス・プラットフォームを通じて5000億ドル以上の第三者資本を動員する覚書に署名した。 — ウォール街がGPUを回収可能な担保として受け入れれば、エヌビディア

X.com08/17 00:20インフラ

適所適時:多くのネオクラウド企業は長年にわたり暗号資産をマイニングしてきたが、AIの登場により、電力権利、データセンター、GPUがテック業界で最も注目される資産の一部となった。

適所適時:多くのネオクラウド企業は長年にわたり暗号資産をマイニングしてきたが、AIの登場により、電力権利、データセンター、GPUがテック業界で最も注目される資産の一部となった。 25四半期目には、CoreWeaveの四半期収入がAzure、AWS、Google Cloudを上回っている。

X.com08/17 00:20インフラ

AI に過払いするのはやめましょう。代わりに 30% 節約します。

AI に過払いするのはやめましょう。代わりに 30% 節約します。 https:// CheaperInference.com は主要な AI モデルを割引価格で提供します。未使用の利用コミットメントを安く買い取るため、あなたの支払いは少なくなります。 $5 を入金すると、$10 を追加します —— $15 で始めることができます。

X.com08/14 23:17インフラ

非常に恐ろしいことが静かに起こった:Qwen3.8-27Bは、ほとんどの能力でClaude Opus 4.6 Maxを超え、あるいはほぼ匹敵している!つまり、今日から、あなたのPCにシン...

非常に恐ろしいことが静かに起こった:Qwen3.8-27Bは、ほとんどの能力でClaude Opus 4.6 Maxを超え、あるいはほぼ匹敵している!つまり、今日から、あなたのPCにシングルGPU・シングルカードでデプロイできる小さなモデルは、半年前の世界の頂点であったClaude Opus 4.6に引けを取らない知能を手に入れたということだ!コーディングであれ、OpenClawを駆動するであれ!

OpenAI08/14 08:00インフラ

Ultrafast をプレビュー。GPT-5.6 Sol を最大 14 倍高速に実行する新しい OpenAI API サービス階層です。Cerebras を搭載し、秒間最大 750 トー...

Ultrafast をプレビュー。GPT-5.6 Sol を最大 14 倍高速に実行する新しい OpenAI API サービス階層です。Cerebras を搭載し、秒間最大 750 トークンを出力します。

X.com08/13 00:01インフラ

Cheaper Inference は、ほとんどの主要モデルに対する API アクセスを 30% オフで販売しています。

Cheaper Inference は、ほとんどの主要モデルに対する API アクセスを 30% オフで販売しています。 http:// cheaperinference.com /?twclid=2drokxbgyzpbftxp1birzo8ov3

X.com08/12 21:57インフラ

BDH-CQ 反復潜在推論によるコンテキスト内学習 論文: https:// huggingface.co/papers/2608.09 888 …

BDH-CQ 反復潜在推論によるコンテキスト内学習 論文: https:// huggingface.co/papers/2608.09 888 …

X.com08/12 00:45インフラ

Big announcement from @MistralAI today: European Compute Units Regional inference Third-party...

Big announcement from @MistralAI today: European Compute Units Regional inference Third-party model support starting with GLM 5.2 @MistralAI is bringing together the inference infrastructure, open models, and long-term c

X.com08/11 00:01インフラ

We identified the source of the issue affecting creation of fine-grained personal access toke...

We identified the source of the issue affecting creation of fine-grained personal access tokens and have applied a mitigation. Users should now be able to create new fine-grained tokens successfully. We are continuing to

X.com08/10 21:34インフラ

Microsoft reportedly plans to unveil Maia 300, its custom AI silicon.

Microsoft reportedly plans to unveil Maia 300, its custom AI silicon. Also it wants TSMC capacity for 300,000 Maia 300 chips for future delivery. Microsoft says the chip delivers over 30% more tokens per dollar than the

X.com08/10 19:32インフラ

New CSS Attacks Expose Webmail Users to Passord and Token Theft https:// cysecurity.news/2026...

New CSS Attacks Expose Webmail Users to Passord and Token Theft https:// cysecurity.news/2026/08/new-cs s-attacks-expose-webmail-users-to.html?utm_source=dlvr.it&utm_medium=twitter … #AIEmailAttacks #AuthenticationTokens

X.com08/09 19:27インフラ

Fable 5は曖昧に定義された機能構築に優れている GPT 5.6 Solはほとんどの実務的な重労働タスクに長けている Grok 4.5はトークン効率が重要な場面、例えばPRレビューで...

Fable 5は曖昧に定義された機能構築に優れている GPT 5.6 Solはほとんどの実務的な重労働タスクに長けている Grok 4.5はトークン効率が重要な場面、例えばPRレビューで優れている Opus 5 GPT 5.6 Luna Maxははるかに低いコストでSolの80%の性能を持つ

X.com08/08 20:01インフラ

FreeKimi K3 has been extended through August 12!

FreeKimi K3 has been extended through August 12! Quick setup: → http:// tokenrouter.com /?twclid=29rsf4jjnwwdpgtty0qfd5lnjx → get API key → model: moonshotai/kimi-k3-free → base URL: http:// api.tokenrouter.com/v1 ?twcli

X.com08/02 23:46インフラ

ちょっとしたリマインダー: OpenAIが計画しているデータセンターのほとんどはまだ建設されていません。

ちょっとしたリマインダー: OpenAIが計画しているデータセンターのほとんどはまだ建設されていません。 NVIDIAのRubin GPUは、2026年第4四半期から推論コストを約90%削減すると予想されています。 さらに、OAI独自のチップはVera Rubinよりも推論を50%安くできる可能性があり、発売が計画されています。

X.com08/02 23:46インフラ

ClaudeやChatGPTのようなLLMの構築を学ぶために2年を無駄にしないでください。

ClaudeやChatGPTのようなLLMの構築を学ぶために2年を無駄にしないでください。 スタンフォード大学は、LLMをゼロから構築する方法に関する2時間のコースを公開しました。 • 00:00 - LLMのトークン化 • 25:44 - LLMがユーザープロンプトをデコードする方法 • 35:40 - LLMのトレーニングパイプライン • 1:16:47 - LLMアーキテクチャから

X.com08/02 23:31インフラ

GPT-5.4 フルは xhigh で 51 を獲得し、それはちょうど今日の Luna max の位置です。GPT-5.4 の価格は 2.50/15 ドル、Luna は現在 0.20/1...

GPT-5.4 フルは xhigh で 51 を獲得し、それはちょうど今日の Luna max の位置です。GPT-5.4 の価格は 2.50/15 ドル、Luna は現在 0.20/1.20 ドルです。言い換えれば、およそ4か月後、OpenAI は3月のフルフラッグシップインテリジェンスをトークン価格の約13分の1で販売していることになります。

X.com08/02 22:46インフラ

luna max = sol medium gpt-5.6 luna を max 推論で使用すると、sol を medium で使用するのと基本的に同じ知能が得られ、コストは sol の...

luna max = sol medium gpt-5.6 luna を max 推論で使用すると、sol を medium で使用するのと基本的に同じ知能が得られ、コストは sol の25分の1です。

X.com08/02 22:32インフラ

DeepSeek Flashは8月1日に8Tトークンを処理しました。5Tの無料利用 + OpenCode Goでの3T。

DeepSeek Flashは8月1日に8Tトークンを処理しました。5Tの無料利用 + OpenCode Goでの3T。

X.com08/01 23:46インフラ

暗号資産ポートフォリオの管理は複雑であるべきではありません。だからこそ、私は @alloxdotai をチェックしています。

暗号資産ポートフォリオの管理は複雑であるべきではありません。だからこそ、私は @alloxdotai をチェックしています。 AlloX は AI を使用して個々のトークンを分析し、ユーザーは自動的に選択できます。 データ駆動の洞察で分散を維持し、投資するための賢い方法です。 #Allox #Crypto #aigirlep1 #Web3 #DEFINITION

X.com07/31 21:33インフラ

同意できない、これはやはりAIの粗製濫造だ。完全に派生したもので、一見すると視覚的に興味を引くが。

同意できない、これはやはりAIの粗製濫造だ。完全に派生したもので、一見すると視覚的に興味を引くが。 何百ドルものトークンを費やしてMinecraftやNo Man's Skyや適当なFPSをコピーするのは技術的には驚異的だが、想像力に欠ける。 AIの本当の創造性は来つつあるが、まだ実現していない。

OpenAI07/30 08:00インフラ

2つのAPI設定がARC-AGI-3でのGPT-5.6のパフォーマンスをどのように向上させたか、推論を保持し、圧縮を可能にすることでスコアと効率を向上させました。

2つのAPI設定がARC-AGI-3でのGPT-5.6のパフォーマンスをどのように向上させたか、推論を保持し、圧縮を可能にすることでスコアと効率を向上させました。

X.com07/29 22:32インフラ

最も強力な通貨のアンカーは、その時点で世界経済が機能するために使用しなければならないものです。今やそれは、金、石油、AIの入出力トークンではなく、必要な生産コストで物事を行うフルスタック...

最も強力な通貨のアンカーは、その時点で世界経済が機能するために使用しなければならないものです。今やそれは、金、石油、AIの入出力トークンではなく、必要な生産コストで物事を行うフルスタック経済です。

X.com07/29 00:02インフラ

ジャッキー・シュマンスキー @SzymanskiJackie · 3時間前 inc.com さようなら、無制限有給休暇:シリコンバレーを席巻する必須のAI特典 エヌビディアCEOジェンセ...

ジャッキー・シュマンスキー @SzymanskiJackie · 3時間前 inc.com さようなら、無制限有給休暇:シリコンバレーを席巻する必須のAI特典 エヌビディアCEOジェンセン・フアン、エンジニアにAI利用のトークンバジェットを提案。

X.com07/27 22:46インフラ

株は下落しているが、宇宙におけるテスラの未来がこれほど可能性が高く、差し迫っていることはかつてない。テスラが新しいMegaPodノードを即座に作成し、電力供給する能力は、グリッド改善、地...

株は下落しているが、宇宙におけるテスラの未来がこれほど可能性が高く、差し迫っていることはかつてない。テスラが新しいMegaPodノードを即座に作成し、電力供給する能力は、グリッド改善、地球での推論質問のための分散型AI計算クラスターを強化することであり、これは巨大なAIである。

X.com07/27 20:16インフラ

AIレースにはボトルネックがある それはGPUではない。

AIレースにはボトルネックがある それはGPUではない。 それは電力だ。 $KEELは、データセンタープロジェクトと大規模な電力パイプラインを備えたAIのインフラストラクチャ層に自らを位置づけている。 群衆はチップメーカーを見ている… 賢いお金はチップが必要とするものを見ている。

X.com07/27 00:47インフラ

人々は彼がこのMac Miniのバッテリーテストを偽造したと非難した 彼がローカルAIを実行中にデスクランプよりも消費電力が少ないことを証明するまでは ほとんどの開発者は、ローカルLLM...

人々は彼がこのMac Miniのバッテリーテストを偽造したと非難した 彼がローカルAIを実行中にデスクランプよりも消費電力が少ないことを証明するまでは ほとんどの開発者は、ローカルLLMを実行するには、壁から直接500ワットを消費する騒々しい3,000ドルのGPUリグが必要だと考えている。 このクリエイターは接続した

X.com07/25 00:47インフラ

2008年製Mac Pro 3,1を電子廃棄物から0ドルで引き取り、80ドルのGPU交換で復活させる計画です。付属品は以下の通り:NVIDIA GeForce GT 120が2枚、各PC...

2008年製Mac Pro 3,1を電子廃棄物から0ドルで引き取り、80ドルのGPU交換で復活させる計画です。付属品は以下の通り:NVIDIA GeForce GT 120が2枚、各PCIeスロットに1枚ずつ搭載、各512MB VRAM、16倍速

X.com07/23 22:03インフラ

事前学習済みViTは、豊かで密な詳細で世界を見ています。ほとんどのポリシーは、行動する前にそれを単一のベクトルにプールし、そのほとんどを破棄します。

事前学習済みViTは、豊かで密な詳細で世界を見ています。ほとんどのポリシーは、行動する前にそれを単一のベクトルにプールし、そのほとんどを破棄します。 私たちはPatch Policyを導入します:トランスフォーマーベースのポリシーが密なトークンを直接消費できるようにする最小限のアーキテクチャ拡張で、

X.com07/22 23:46インフラ

4枚のIntel Arc Pro B60カードが、1台のローカルAI PCを、1つのGPUでは保持できないモデル用の192GB VRAMプールに変えました。定期的な内部コードやドキュメン...

4枚のIntel Arc Pro B60カードが、1台のローカルAI PCを、1つのGPUでは保持できないモデル用の192GB VRAMプールに変えました。定期的な内部コードやドキュメントジョブを実行するオペレーターにとって、レンタル容量はモデルの問題になる前にスケジューリングの問題になります。4枚のデュアルボードIntel

X.com07/22 23:01インフラ

2.8兆パラメータのモデルが、人々が実際にお金を払う唯一の分野でクローズドAIを打ち負かしました:構築です。Kimi K3はフロントエンドコーディングで1位を獲得し、100万トークンのコ...

2.8兆パラメータのモデルが、人々が実際にお金を払う唯一の分野でクローズドAIを打ち負かしました:構築です。Kimi K3はフロントエンドコーディングで1位を獲得し、100万トークンのコンテキストウィンドウを備え、1つのプロンプトをゲーム、3Dワールド、完全な製品、またはリポジトリ全体のエンジニアリングに変換できると報告されています。

X.com07/22 23:01インフラ

中国の開発者が120ドルのミニPCにフルGPUを取り付け、昨年19万ドルを稼いだ一方、元共同創業者たちはシリーズA資金をAnthropicの請求書に費やしていた

中国の開発者が120ドルのミニPCにフルGPUを取り付け、昨年19万ドルを稼いだ一方、元共同創業者たちはシリーズA資金をAnthropicの請求書に費やしていた

X.com07/22 22:47インフラ

1966年、スタンフォード大学は世界初のAIロボット「シェイキー」を製作しました。現代のAIはここで生まれました。元の映像を見る人はほとんどいません。GPUもニューラルネットワークも現代...

1966年、スタンフォード大学は世界初のAIロボット「シェイキー」を製作しました。現代のAIはここで生まれました。元の映像を見る人はほとんどいません。GPUもニューラルネットワークも現代のコードもありません。ただ、部屋サイズのメインフレームに接続された、車輪付きの1メートルの箱だけでした。それはスタンフォード大学で製作されました。

X.com07/21 23:47インフラ

56ドル対0.50ドル。同じ100万トークン。1バレルのコストはもう1つの112倍で、おそらく20%多く働くだけ。チャマスはCNBCで率直に言った:「50ドルの知能のバレル」が1ドルのも...

56ドル対0.50ドル。同じ100万トークン。1バレルのコストはもう1つの112倍で、おそらく20%多く働くだけ。チャマスはCNBCで率直に言った:「50ドルの知能のバレル」が1ドルのものの隣にある。プレミアムが静かに消える方法:ステップ1→競合他社が品質の80-95%を提供する。

X.com07/20 21:02インフラ

AIで成功している人々は、より多く費やしているわけではない。彼らはより少なく費やしている。誰もが月額200ドルのサブスクリプションについて話す。ほとんど誰も、今利用可能な数億の無料AIト...

AIで成功している人々は、より多く費やしているわけではない。彼らはより少なく費やしている。誰もが月額200ドルのサブスクリプションについて話す。ほとんど誰も、今利用可能な数億の無料AIトークンについて話さない。最も賢い構築者は、最も高価なものを購入することから始めない。

X.com07/20 20:01インフラ

ローテーションに残っているモデルは2つ、フルプライスで稼げるのは1つだけ

ローテーションに残っているモデルは2つ、フルプライスで稼げるのは1つだけ

X.com07/19 20:47インフラ

23歳の開発者が一度に4,699ドルを支払い、月額850ドルのAIコストを削減し、1台のデスクトップをビジネスに変えた。

23歳の開発者が一度に4,699ドルを支払い、月額850ドルのAIコストを削減し、1台のデスクトップをビジネスに変えた。 誰もがより良いAIモデルについて話す。 それらを動かすコンピュータを所有することについて話す人はほとんどいない。 クラウドGPUは考える時間ごとに課金する。 ローカルAIボックス

X.com07/19 20:47インフラ

GoogleのAIエンジニアが誤ってローカルのObsidianナレッジボールトを漏洩しました。内部には、18,000の相互リンクされたクライアントファイルにまたがるオフライングラフがあり...

GoogleのAIエンジニアが誤ってローカルのObsidianナレッジボールトを漏洩しました。内部には、18,000の相互リンクされたクライアントファイルにまたがるオフライングラフがあります。18,000の知識ノード。11,200のリンク。0ドルのクラウドトークン請求書。OpenClawワークスペースを開きます。画面にObsidianが表示されます。

X.com07/02 00:46インフラ

THIS DEVELOPER ADMITS HE'S GPU POOR WITH A 4-YEAR-OLD RTX 3090 - AND TESTS EVERY VRAM TIER SO...

THIS DEVELOPER ADMITS HE'S GPU POOR WITH A 4-YEAR-OLD RTX 3090 - AND TESTS EVERY VRAM TIER SO YOU KNOW EXACTLY WHAT YOUR HARDWARE CAN DO RTX 3060 with 12GB vs AMD BC250 with 16GB - one is a dedicated GPU with extra CPU a

X.com07/01 23:16インフラ

温度0.5:トップトークンが96.97%を占める。

温度0.5:トップトークンが96.97%を占める。 温度2.0:同じトークンが58.58%、隣接トークンが1.5%から20%に跳ね上がる。 何も見ずにドラッグするスライダーは分布を非線形に変化させる 1889年のガルトン盤で分解した

X.com07/01 21:33インフラ

31歳のブカレストのオペレーターが、8枚の中古NVIDIA T4をSupermicroシャーシに詰め込み、1,847ドルで構築。現在、ルーマニアのShopifyストアに推論サービスを提供...

31歳のブカレストのオペレーターが、8枚の中古NVIDIA T4をSupermicroシャーシに詰め込み、1,847ドルで構築。現在、ルーマニアのShopifyストアに推論サービスを提供し、月額11,240ドルで運用している。

X.com07/01 00:46インフラ

atomic[.]chatは、LLMをローカルで実行するデスクトップアプリで、Claude Sonnet 5、Claude Opus 4.8、Claude Sonnet 4.6、GPT ...

atomic[.]chatは、LLMをローカルで実行するデスクトップアプリで、Claude Sonnet 5、Claude Opus 4.8、Claude Sonnet 4.6、GPT 5.5について非常に示唆に富む比較を行いました。 Claude Sonnet 5は、3つの物理コーディングデモでGPT 5.5と同等の性能を、6分の1のコストで達成しました。 また、最小限のトークン数を使用しました。

X.com06/30 21:16インフラ

29歳のデンバーの開発者が、昨年新品で40万ドルで販売されていたNVIDIA H100リグを42,000ドルで購入し、現在は微調整収入として月額43,200ドルを得ている。イーサンは29...

29歳のデンバーの開発者が、昨年新品で40万ドルで販売されていたNVIDIA H100リグを42,000ドルで購入し、現在は微調整収入として月額43,200ドルを得ている。イーサンは29歳で、デンバーの地下室オフィスの緑のアイロン台の下で働き、サニーベールのAIスタートアップからNVIDIA HGX H100 8 GPUサーバーを獲得した。

X.com06/30 20:31インフラ

推論は決して同じではなくなる:Etchedは、計算コスト、速度、ワットあたりの効率を大幅に向上させる2つの新しい方法、低電圧推論(より多くのFLOPs)とクラスター規模のメモリ(メモリ/...

推論は決して同じではなくなる:Etchedは、計算コスト、速度、ワットあたりの効率を大幅に向上させる2つの新しい方法、低電圧推論(より多くのFLOPs)とクラスター規模のメモリ(メモリ/帯域幅)を発明した。この組み合わせにより、80%以上のMFUで兆パラメータモデルを実行する。

X.com06/30 20:16インフラ

この中国人ビルダーは、退役したTesla P40を8枚使い、192GBのプライベートAIサーバーに改造しました。毎月5,760 GPU時間の処理が可能です。00:06 彼は1枚の中古Te...

この中国人ビルダーは、退役したTesla P40を8枚使い、192GBのプライベートAIサーバーに改造しました。毎月5,760 GPU時間の処理が可能です。00:06 彼は1枚の中古Tesla P40を持ち上げ、その後ろにさらに7枚が置かれ、それらを巨大なデュアルXeonサーバーシャーシにフルスタックでインストールします。各カード

X.com06/30 20:16インフラ

中国の開発者が、2018年製の35ドルのRaspberry Piで実際のAIモデルを実行できることを証明し、42,000ドルを稼いだ。2GBのRAM、GUIなし。実際に存在する最も安価な...

中国の開発者が、2018年製の35ドルのRaspberry Piで実際のAIモデルを実行できることを証明し、42,000ドルを稼いだ。2GBのRAM、GUIなし。実際に存在する最も安価なローカルAIへの入り口。彼は1分間に1単語を期待していたが、代わりにDeepSeek R1 1.5Bが実際の質問に対して推論を始めた。

X.com06/30 19:16インフラ

599ドルのMac Miniが、3800ドルのGPUを重要な性能で打ち負かす。ユニファイドメモリにより、モデルは一度ロードされるだけで、両方のプロセッサが同じプールから読み取る。価格が2...

599ドルのMac Miniが、3800ドルのGPUを重要な性能で打ち負かす。ユニファイドメモリにより、モデルは一度ロードされるだけで、両方のプロセッサが同じプールから読み取る。価格が2倍のWindowsマシンは、RAMとVRAMの間でデータをコピーする必要があり、それでも性能が低下する。2015年の130ドルのTesla M40。

X.com06/29 21:31インフラ

Dan FuはTri Daoと共にFlashAttentionを共同執筆しました。その後、Hyena、Monarch Mixer、ThunderKittensを共同開発しました。現在はT...

Dan FuはTri Daoと共にFlashAttentionを共同執筆しました。その後、Hyena、Monarch Mixer、ThunderKittensを共同開発しました。現在はTogether AIの著名な研究者です。ChatGPT、Claude、Geminiを実行する推論スタック内には4つのカーネルがあります。一人の人物が、すべてあなたのホットパスに存在しています。

X.com06/29 21:16インフラ

3,999ドルまたは4,699ドル。同じ128GB。同じローカル推論。箱のロゴだけが違う。

3,999ドルまたは4,699ドル。同じ128GB。同じローカル推論。箱のロゴだけが違う。 AMDのRyzen AI Halo開発者プラットフォーム。NVIDIAのDGX Spark。どちらも大規模モデルをローカルで実行可能。どちらも128GBのユニファイドメモリを搭載。同じカテゴリー、同じユースケースで、700ドルの差。 以下のビデオはJensenを編集

OpenAI06/29 08:17インフラ

OpenAIとBroadcomは、LLM推論向けに構築されたカスタムAIチップ「Jalapeño」を発表し、AIシステム全体のパフォーマンス、効率、スケーラビリティを向上させます。

OpenAIとBroadcomは、LLM推論向けに構築されたカスタムAIチップ「Jalapeño」を発表し、AIシステム全体のパフォーマンス、効率、スケーラビリティを向上させます。

X.com06/28 22:46インフラ

エッジでのコンピューティングはもはや贅沢品ではない

エッジでのコンピューティングはもはや贅沢品ではない

X.com06/28 21:46インフラ

ある開発者が、中古の2019年Mac ProにAMDのeGPUを1台接続し、総額3,000ドル未満で35BパラメータのローカルLLMサーバーに改造し、毎秒52トークンの処理速度を実現しま...

ある開発者が、中古の2019年Mac ProにAMDのeGPUを1台接続し、総額3,000ドル未満で35BパラメータのローカルLLMサーバーに改造し、毎秒52トークンの処理速度を実現しました。彼は机の下にあるMac Proと、RX 6800を搭載したPaladin eGPUエンクロージャに接続された1本のThunderboltケーブルの動画を投稿しています。

X.com06/28 21:46インフラ

中国の開発者が、PS5のシリコンから作った80ドルのカードでAIを実行し、月額2万2000ドルを稼ぐ一方、すべてのAIスタートアップは8ヶ月待ちのH100待機リストに載っている。Leno...

中国の開発者が、PS5のシリコンから作った80ドルのカードでAIを実行し、月額2万2000ドルを稼ぐ一方、すべてのAIスタートアップは8ヶ月待ちのH100待機リストに載っている。LenovoのオフィスPC。側面から突き出たAMD BC-250。ソニーがPS5に搭載している同じチップが、現在3人の有料顧客のために推論を実行している。ハードウェアは80ドル。

X.com06/28 21:33インフラ

死んだ暗号ラックから24枚のBC250ボードをクラスタリングして384GBの推論プールにしたところ、1トークン/秒、年間電力費5000ドルに達した。あなたのマップ上のティアゼロハックは4...

死んだ暗号ラックから24枚のBC250ボードをクラスタリングして384GBの推論プールにしたところ、1トークン/秒、年間電力費5000ドルに達した。あなたのマップ上のティアゼロハックは4ノードを超えてスケールしない。

X.com06/25 22:35インフラ

それで私はほとんど追加しました - 家庭用GPUリグ 自給自足には良いかもしれませんが、繰り返しになりますが、ローカルの LLM のものは、品質、パフォーマンス (速度)、コストのいずれ...

それで私はほとんど追加しました - 家庭用GPUリグ 自給自足には良いかもしれませんが、繰り返しになりますが、ローカルの LLM のものは、品質、パフォーマンス (速度)、コストのいずれにおいてもクラウドにさえ及ばないと私はまだ考えています。 家を自給自足できるようにするのは良いことですが、私は次のことを考えています。 - テスラ パワーウォール 2 台 (27

X.com06/25 22:15インフラ

LLM が人間の言語ではなく潜在空間でうまくコミュニケーションできるようにする方法を示します。

LLM が人間の言語ではなく潜在空間でうまくコミュニケーションできるようにする方法を示します。 #ICML2026 スポットライト (上位 2%) 自己回帰的な潜在思考 -> KV 伝達 -> 入出力調整 デコードをバイパスすることで推論を 4 倍以上高速化し、パフォーマンスを最大 14% 向上させます。

X.com06/25 22:03インフラ

この中国人起業家は倉庫規模の GPU ファームを構築し、現在 AI スタートアップに月額 400 万ドルの賃貸料を稼いでいます ウォルマートほどの規模の倉庫に 4,000 個の GPU ...

この中国人起業家は倉庫規模の GPU ファームを構築し、現在 AI スタートアップに月額 400 万ドルの賃貸料を稼いでいます ウォルマートほどの規模の倉庫に 4,000 個の GPU が設置され、電力契約と冷却設備がすでに導入されており、オペレーターの身長は 6 フィート 6 インチで、規模に対応しています イーサリアムは2022年9月に合併

X.com06/24 19:31インフラ

100 デシベルの ASICS 10,000 台は、月当たり 160 万ドルの電力を消費します。

100 デシベルの ASICS 10,000 台は、月当たり 160 万ドルの電力を消費します。 85 DB で 5,000 GPUS を備えた同じ倉庫が AI 推論で 400 万ドルをクリア 100 decibels on the warehouse floor, workers wear industrial ear muffs all 8 hour shifts, you cannot hold a conversation 3

X.com06/23 19:45インフラ

AI の料金は月額 220 ドル。彼は何も考えずに2年分を支払いました。

AI の料金は月額 220 ドル。彼は何も考えずに2年分を支払いました。 するとクライアントは 1 つの質問をして、90 秒以内に 5,000 ドルを持って帰ってきました。 0:21から見てください。そこで彼は机の下にある GPU を指差しました。 1 つは RTX 3090 を使用しました。24GB VRAM。中古で1,050ドルで購入しました。

X.com06/18 22:45インフラ

なぜ拡散言語モデルはまだスマートではないのでしょうか?トレーニング後の安定性がないことが大きなボトルネックです。

なぜ拡散言語モデルはまだスマートではないのでしょうか?トレーニング後の安定性がないことが大きなボトルネックです。 DiPOD をご紹介します。トレーニング後の拡散モデル用の三脚です。 DiPOD は、1 行のコード変更により、推論タスク全体の精度を向上させ、数独は 22% から 97% に上昇しました。 1/5

X.com06/18 20:15インフラ

Huggingface_hub v1.19.0 は信頼できるパブリッシャーに出荷されました: OIDC トークン交換を介したハブへのキーレス CI/CD 認証。

Huggingface_hub v1.19.0 は信頼できるパブリッシャーに出荷されました: OIDC トークン交換を介したハブへのキーレス CI/CD 認証。 CI 構成に HF_TOKEN シークレットが残る必要はもうありません。仕組みは次のとおりです

X.com06/18 06:30インフラ

Ondo は株式と ETF のトークン化を主導しています 次の大きなステップは、基本的に株式とETFのポートフォリオを管理するスマートAIであるロボアドバイザーになるだろう。

Ondo は株式と ETF のトークン化を主導しています 次の大きなステップは、基本的に株式とETFのポートフォリオを管理するスマートAIであるロボアドバイザーになるだろう。 これは実際にRevolutが暗号通貨よりも先を行っていた分野の1つであり、今後暗号通貨はロボットアドバイザーに追いつく必要があるでしょう

X.com06/18 05:45インフラ

2026 年のスーパーコンピューターは MAC MINI の倉庫です。

2026 年のスーパーコンピューターは MAC MINI の倉庫です。 KIMI API を机の上に 1 つ置くと、15 分で 300 ユーロの研究レポートが配信されます ほとんどの人は、AI を実行するには 10,000 ドルの GPU サーバーか、毎月増加するクラウドの料金を意味すると考えています。実際のビジネスを構築する開発者は、単一の