M5 Ultra Mac StudioはローカルAIエージェントの夢を叶えるマシンだ

M5 Ultra Mac Studio Review: The Dream Mac for Local AI Agents

M5 Ultra Mac Studio(256GB RAM)を4日間テスト。M3 Ultra比でトークン生成が約70%高速化、プロンプト処理は平均150%向上し、Qwen3.8-Flash-Nextが64K〜256Kのコンテキストでも60〜85トークン/秒を維持。RTX 5090搭載PCより静かでコンパクト。iOS 27レビューのため310文書を99日間24時間体制で処理したエージェント群も、すべてこのマシン上でクラウド費用ゼロで稼働した。

M5 Ultra Mac Studioは、MLXで動くローカルモデルのパフォーマンスを劇的に引き上げる。プロンプト処理はM3 Ultra比で平均150%向上し、私の以前の環境から約2.5倍の改善だ。
  1. simonw

    一番興味があった数字は、下の方にあるチャートにひっそり載っている——Mac StudioとRTX 5090の速度比較だ:

    Qwen3.8 27B のトークン/秒 生成速度

    プロンプトサイズ 8K 64K 128K 256K

    RTX 5090 PC 59 51 44 n/a

    M5 Ultra 48 39 32 24

    M3 Ultra 31 23.5 20 15

    このセクションにはさらにたくさんの比較数値がある:https://www.macstories.net/stories/m5-ultra-mac-studio-revie...

  2. srcreigh

    ファーストインプレッションとしては素晴らしいけど、著者は開発者ではないので、開発者がM5 Mac Studio上のローカルモデルで、20xのサブスクリプションプランと比べて同じくらい生産的に働けるかどうかはまだ分からない。

    この新しいハードウェア向けのカーネルに、新たな低コストで実現できる最適化の余地があるかどうかも気になる。

    まともな利用率を前提とすれば、M5 Mac StudioがOpenRouterで動かせる何よりもコスパが良いのはもう明らかだ。

    M5 Mac Studioは、検閲なしのサイバー能力を持つオープンエージェントを動かすのに最もコスパの良い方法になるだろう。

    エキサイティングな転換点となるのは、プログラマーがこのハードウェアで一週間ずっとAstra-Ultraのような体験を得られるようになったときだ。それこそが、このハードウェアが20xのクラウドサブスクリプションすら上回る価値を持つと実感できる本当の意味での瞬間だろう。

  3. sajithdilshan

    Appleのウェブサイトには、512GBメモリのオプションは10月に利用可能と書いてある。そのモデルに上げると、さらに4〜6千ドルかかるだろう。つまり2TBストレージのUltraは1万5千ドル超になる。

    それはOpenAI Proのサブスクリプション12年分に相当する。

  4. mtsolitary

    64GBのM5 Pro Miniを待っている。ローカルAIをいじるのにも楽しいことを願っている。

  5. tempoponet

    apples to applesではないのは分かっているけど、今のところの比較対象はDGX Spark 2台だ。価格は似ていて、256GB。議論はエージェントループにおけるメモリ帯域 vs 演算に集中しているから、ほとんどの人にとって生の数値はコーディングベンチマークの「タスクあたりの時間」ほど意味を持たないだろう。

    これは素晴らしい記事で、M5にとって良い兆しだけど、本当にどこに位置するのかを理解するには、他のプラットフォームとの比較がもっと出てくるのを待つべきだ。

  6. ApolloFortyNine

    テストされているモデルは、構成通りなら1万8千ドルだ。

    これが5090をお買い得に見せるとは思わなかった。

  7. akozak

    「総コスト$0」って……そのハードウェアはいくらなんだ?

  8. liuliu

    MLX関連の量子化モデルをベンチマークするときは、ちゃんとベンチマークの数値を公開する必要がある。これをそのまま元のモデルで得られるものだと受け取ってはいけない。MLXはかなり単純な量子化手法を使っているので、QATなしの低ビットでは、llama.cppのものほど品質が良くないのは当然だ。

この日のほかの記事

2026-09-21