Local LLM Intelligence // 2026.08

M5 Max 128GB を走らせる者たちの
完全地図

単一のコミュニティではなく、RedditをハブにX実測投稿者・ツール開発者・日本語圏発信者が放射状に連なるエコシステム。全員の実測データと一次リンクを偵察した。

13
実在確認済み人物
3
痕跡ゼロ・要検証
34+
実測tok/sデータ
38万+
oMLXコミュニティ行

核心 Findings

6波・30クエリ超の並列偵察で判明した、このコミュニティを理解する5つの事実。

最重要の訂正: 「Apple Silicon=メモリ帯域幅がボトルネック」という通説は Denseモデルでは正しいがMoEでは誤り。MoE(DeepSeek V4 Flash等)はDRAM帯域使用率16%程度に留まり、GPU演算側が律速。Zenn・kamo78氏のmactopテレメトリ実測が唯一の定量証明 → 一次記事
構造

ハブはReddit、心臓部はツール開発者

実測の集まる場はr/LocalLLaMA・r/LocalLLM。ただし最大の2016票スレを投稿したu/cryingnekoは、実はoMLXの開発者jundot氏本人。コミュニティの核は「使う者」ではなく「作る者」。

人物

@jun_songの「$2k/$4k/$7k」ガイドが事実上の基準

「~$2k: RTX3090+Qwen3.8-27B / ~$4k: DGX Spark+DeepSeek V4 Flash 2.5bit / ~$7k: M5 Max 128GB」という階層ガイドが引用・参照され続けている。

実測

122B MoEが65.8 tok/s、284Bが34 tok/s

Qwen3.5-122B-A10BはM4 Max 128GBで65.8 tok/s(M5なら同等以上)。DeepSeek V4 Flash 284BはIQ2XXS量子化81GBで34.1 tok/s。ラップトップでフロンティア級が動く時代。

論争

DGX Spark vs M5 Maxは「条件付き判定」に収束

帯域はM5が2.25倍(614 vs 273GB/s)だが、lmsys実測ではDGX Sparkはbatchingで20.5→368 tpsに線形スケール。単発decodeはMac、並列・訓練はDGX。論争の全定量証拠を整理した。

エコシステム 構造

4層構造。上から順に「見る層・試す層・作る層・支える層」。

層1: ハブ

Reddit

r/LocalLLaMA(ベンチ主戦場)・r/LocalLLM(導入相談)・r/oMLX(ツール別)。M5 Max 128GB検索で常時スレが立つ。

層2: 拡散

X (Twitter)

@jun_song・@bridgemindai・@trevorwood222等が実測スクショ付きで投稿。ハードウェアガイドやツール紹介が即座に波及する。

層3: 制作

ツール開発者

oMLX(cryingneko/jundot)・ds4(antirez/Redis作者)・LM Studio MLX runtime・exo分散推論。「作る者」が実測文化を牽引。

層4: 支援

日本語圏

Zenn kamo78(テレメトリ検証)・note・Qiita・itmedia等。冷却検証やエラー対処など「運用ノウハウ」層を供給。

調査限界 — 誠実な開示

限界1

X投稿の全文網羅は不可

xurlが未認証のため、X投稿は検索スニペット+第三者引用で再構成。@jun_song等の全投稿の時系列復元は不完全。

限界2

Redditは過去アーカイブ経由

Reddit本体がブロックするためArctic Shift API(Pushshift後継)で取得。リアルタイム最新コメントは欠ける可能性。

限界3

3名は実在確認できず

@C_of_Creativity / @ktam72 / @hasegawa — Web・X・Reddit・note・Zenn・Qiita全てで痕跡ゼロ。実在するなら非公開・別名・表記違い。フォロー前に直接確認を。

限界4

推定値と実測値の混在

llmcheck.netの一部数値は「estimated」マーク付き(帯域モデル推定)。本サイトは実測値のみを実測DBに掲載し、出典チップで区別。