翻到一条六年前发的、体验 GPT-3 后的推文,没想到这一晃就六年了,这下真的开始慌了。
翻到一条六年前发的、体验 GPT-3 后的推文,没想到这一晃就六年了,这下真的开始慌了。
「\bGPT\b」タグが付いたAI Pulseの更新一覧です。
22 件のシグナル翻到一条六年前发的、体验 GPT-3 后的推文,没想到这一晃就六年了,这下真的开始慌了。
I just realized I will be in San Francisco again on Sep 30th and that this is the exact date I predicted I would turn more bullish on OpenAI than Anthropic maybe they delay GPT-6 until DevDay on Sep 29th, which could tec
GPT-4 finished training four years ago today.
...
1) 同じモデル(GPT 5.6 Sol @ medium) 2) 同じ環境(ubuntu 26.04) 3) 同じエージェントタスク 4) 同じ結果 3) 異なるトークン使用量
GPT-5.4 フルは xhigh で 51 を獲得し、それはちょうど今日の Luna max の位置です。GPT-5.4 の価格は 2.50/15 ドル、Luna は現在 0.20/1.20 ドルです。言い換えれば、およそ4か月後、OpenAI は3月のフルフラッグシップインテリジェンスをトークン価格の約13分の1で販売していることになります。
これはすごい、私はちょうどKimi K3、Grok 4.5、GPT 4.6 Sol、Claude Opus 5にスタートの合図を与えて、自分たちで絵を完成させてもらった。 また、それぞれの方法で創造的になるようにも言った。 これがその結果で、正直言って、どれが一番グッと来るのか本当に決められない。
luna max = sol medium gpt-5.6 luna を max 推論で使用すると、sol を medium で使用するのと基本的に同じ知能が得られ、コストは sol の25分の1です。
...
笑った、彼らは桁違いに外してる。彼らの最高のAIは何に匹敵するの、GPT 3.5?
彼らはモデルが十分に最適化され、Claude、GPT、その他の主要な米国AIモデルとほぼ同等の性能を発揮できれば、必ずしも最高級のDRAMを必要としません。米国は効率を生の計算能力で置き換えています。また、中国はコピーと安価なものの大量生産が得意です。
この動画はAIリーダーボードを役に立たないものに見せている。3つの最先端モデルが同じプロンプトを受け取った。それぞれが異なるゲームで勝利した。Opus 5は最も豊かな世界を構築した:多様な地形、風に反応する旗、ユニットアニメーション、そしてヒットリアクション。GPT-5.6 Solは最高のUIを持っていた。によると
Claude Opus 5は、難しい3DコーディングテストでClaude Fable 5を3/4の価格で打ち負かしました。 @thehypedotnewsによる興味深い実験 — opus 5 vs. fable 5 vs. gpt 5.6 sol vs. kimi k3 opus 5は、最もよく設計され、視覚的に最も説得力のあるThree.jsの結果を生成しました なぜ誰がわざわざ...と思う
ビハール州の発展がデジタル加速!名誉ある首相Shri @samrat4bjp jiのリーダーシップの下、NDA政府がSarvam AIおよびBharat GPTと締結した重要なMoUにより、ビハール州のニーズに合わせた国産AIモデルの開発が可能になります。
MoEはMixture of Expertsの略称です(日本語では混合専門家モデルを意味します)。これは特殊なニューラルネットワークアーキテクチャであり、現在最高のモデルは基本的にすべてこの構造を採用しています。例えばFable5、またGPT 5.6 solなどがあります。一緒にMoEについて学びましょう。
最近、実用的なオープンソースプロジェクト「OpenCodex」を発見しました。これによりCodexはGPTモデルに限定されず、Kimi、Grok、GLMなどの他の大規模モデルも統合できます。一度設定すれば、既存のCodexアプリケーションやワークフローは基本的にそのまま使用できます。
HERMESエージェントの有用性が10倍になるのは、以下の5つを設定したときです。それぞれ5分で完了します。ほとんどのユーザーはこれらに触れたことがありません。 1. 適切なモデル すべてに1つのモデルを使う=ほとんどのことに間違ったモデルを使うことになります。 GPT-5.6 Sol:最強の推論能力。日常使いに最適。あなたのアクセスを通じて。
なんてこった、AI競争が狂ってる。誰かがGPT-5.6 SolとFable 5を直接対決させた——同じプロンプト、各一回ずつ。タスクは:完全なSubway Surfersクローンを作成すること。両方とも成功した。エンドレスランナー、交通回避、コイン収集、スピードランプ——全部揃ってる。2つのフロンティアモデル。
atomic[.]chatは、LLMをローカルで実行するデスクトップアプリで、Claude Sonnet 5、Claude Opus 4.8、Claude Sonnet 4.6、GPT 5.5について非常に示唆に富む比較を行いました。 Claude Sonnet 5は、3つの物理コーディングデモでGPT 5.5と同等の性能を、6分の1のコストで達成しました。 また、最小限のトークン数を使用しました。
LONGCAT は実際の物理タスクで OPUS 4.8 と GPT 5.5 に匹敵し、しかも完全無料です。Atomic Chat は4つのモデルで同じテストを実施し、実際の物理演算を用いた HTML5 Canvas シーン(大砲 vs レンガの壁、ボウリングのピン、物体を吸い上げる竜巻)を構築しました。Opus 4.8 は0.48ドル、GPT...
GLM 5.2が実際のビルドでClaudeを打ち負かした 驚くべき点は? オープンソースであること。 テスト結果: → GLM 5.2が最高のゲームを構築 → Claude Opus 4.8が軌道マップを圧倒 → GPT 5.5が1つのプロンプトからプレイ可能なカラーチェーンゲームを構築 実際に重要だったこと: ✓ GLM 5.2が最も創造的だった
OpenAIがGPT 5.6 SOLをプレビューしたが、政府はあなたに触れさせない