インターネットやSNSのAIコミュニティで、「家庭用のパソコンで超巨大なAIがサクサク動く」と話題になっているツールが「Strata(ストラタ)」です。
これまで、賢い大型AIを動かすには企業が持つ巨大な専用サーバーが必要でした。しかしStrataの登場により、個人のパソコンでも本格的なAIを実用的なスピードで動かせるようになってきています。
ひとことで言うと
Strataは、通常なら企業の大型サーバーでしか動かない巨大なAIモデルを、普通の家庭用パソコンで動かすための仕組み(推論エンジン)です。
身近な例えで言うと、「トラックでしか運べない大量の荷物を、工夫して普通乗用車とトランクに無駄なく積み込み、スムーズに目的地まで運べるようにした賢い積み込みシステム」のようなものです。
Strataによって、私たちのAI利用は次のように変わります。
- 会社の機密データや個人情報を外に出さずに使える: すべてのやり取りが自分のパソコン内で完結し、インターネットの向こうにあるサーバーへデータが送信されません。
- 月額の利用料や通信制限を気にせず使い放題になる: 自分のパソコンの頭脳を使って動かすため、AIサービスの月額料金を払わずに何度でも質問できます。
- 手持ちのゲーミングPCが最高峰のAIマシンに化ける: 普段ゲームや動画編集に使っているパソコンを、そのまま賢いAIアシスタントとして活用できます。
詳しい仕組みや必要なパソコンの環境については、Strataとは?巨大AIを普通のパソコンで動かす仕組みと使い方・必要なPC環境でも解説されています。
Strataとは?
Strataは、開発者のNiko1221氏によって開発され、GitHubで無料公開されたオープンソースのAI推論エンジンです(根拠: GitHubのNiko1221/Strataリポジトリ)。
AIを動かす中心となるのは、Alibabaが開発した「Qwen3.8-Flash-Next」という最新のAIモデルです。このモデルは「1,250億パラメータ(AIの知識や思考の細かさを表す規模)」という桁違いの大きさを持っています。
私たちが普段よく使う「ChatGPT」などのサービスは、OpenAIなどの企業が持つ巨大なデータセンターでAIを動かし、インターネット越しに答えを受け取る仕組みです。一方のStrataは、AIの頭脳そのものを自分のパソコンの中にダウンロードして直接動かす「ローカルAI」の方式をとっています。
※パラメータとは: AIの頭脳の複雑さや記憶の容量を示す目安です。数字が大きいほど物知りで賢くなりますが、動かすために必要なパソコンのパワーも格段に大きくなります。
なぜ話題になっているのか?
Strataが世界中の開発者やAI愛好家の間で注目を集めている最大の理由は、「12GBという一般的なグラフィックボード(GPU)の容量で、1,250億規模の巨大AIが人間が読むより速いスピードで返事を返すから」です(根拠: PC Watchのニュース記事)。
これまで、1,000億を超えるような超巨大モデルをパソコンで動かそうとすると、数百万円する業務用の高性能機材を用意するか、返事が1文字ずつゆっくりとしか出てこない遅さに耐えるしかありませんでした。
しかしStrataを使うと、市販のゲーミングパソコン(例: GeForce RTX 5070搭載機)で、1秒間に約50〜90トークン(日本語なら数十文字、英文なら本を読むスピードを超える速さ)で文章を生成できます。この「圧倒的なコストパフォーマンスと実用的な速さ」が驚きをもって迎えられています。
仕組み・主な特徴
Strataはなぜ、普通のパソコンで巨大なAIを素早く動かせるのでしょうか。主な仕組みと特徴をまとめました(根拠: noteのnpaka氏による解説記事)。
1. パソコン全体のパーツで役割を分担する
Strataは、AIのデータを画面表示用のパーツ(GPUのVRAM)だけに詰め込もうとしません。
- GPU(グラフィックボード): いま一番よく使う重要な処理だけを担当
- メインメモリ(RAM): 出番を待つAIの知識データを一時保管し、CPUと協力して計算
- SSD(保存用ストレージ): さらに大きな参照データを保管し、必要な行だけを瞬間的に読み出し
このように、パソコンのあらゆる部品を総動員して計算を分担するため、高価な専用機材がなくても巨大AIが収まります。
2. 必要な「専門家」だけを素早く呼び出す(MoEの活用)
Qwen3.8-Flash-Nextは「MoE(Mixture of Experts: 専門家の集まり)」という仕組みを採用しています。2万4,576人もの専門家がAIの中に待機していますが、1つの言葉を返すために実際に働くのはそのうちたった10人ほどです。
Strataはこの特徴を活かし、よく使う専門家を一番動きの速いGPUに置き、たまにしか使わない専門家はメインメモリに置いてCPUで並行処理します。使っているうちに「どの専門家がよく使われるか」を自動で覚えて効率を高めていきます。
3. 先回りの予測で返答を早める(投機的デコード)
AIの中にある小さな予測アシスタントが「次はこういう文章が続くはず」と数文字先を予測し、本体のAIがそれをまとめて確認して採用する「投機的デコード(Speculative Decoding)」という技術を使っています。これにより、文章の質の高さを保ったまま、返事の速さを約1.6〜1.8倍に引き上げています。
4. 外部のAIツールやアプリとすぐ連携できる
Strataを起動すると、OpenAIやAnthropicの形式に対応した通信口(API)が手元のパソコンの中に作られます。これにより、プログラミング支援ツール(CursorやClaude Codeなど)の頭脳を、月額課金なしの自分のパソコンのAIに差し替えて使うことができます。
自分に関係ある? 向いている人・向いていない人
Strataは画期的なソフトウェアですが、すべての人に今すぐ必要なわけではありません。
向いている人
- ゲーミングPCや自作PCを持っている人: すでに必要なスペック(VRAM 12GB以上のGPU、32〜64GB以上のメモリ)が揃っていれば、無料で試せます。
- 絶対に外部へ漏らせない機密データを扱う人: 顧客データや開発中のプログラムコードを、安全なローカル環境でAIに分析させたい場合に最適です。
- AIの利用料金を節約したいヘビーユーザー: 毎日大量のプログラミング支援や文章作成をAIに任せている人に向いています。
向いていない人(普段のWebサービスで十分な人)
- 一般的なノートパソコンやスマートフォンだけで作業している人: 必要な部品が足りないため動作しません。
- 手軽さを最優先したい人: ChatGPTやClaudeのウェブサイトを開いてすぐに質問したい人は、公式のクラウドサービスを使う方が便利です。
使い方・始め方(触ってみたい人向け)
ここからは実際にStrataを自分のパソコンに導入して触ってみたい人向けの手順です。読み飛ばしても全体の仕組みは理解できます。
必要な動作環境
| 項目 | 必要なスペック | 備考 |
|---|---|---|
| グラフィックボード | NVIDIA RTX 20/30/40/50シリーズ、またはAMD Radeon RX 7000/9000シリーズ等 | VRAM 12GB以上が必要 |
| メインメモリ (RAM) | 32GB以上(推奨は64GB) | 32GBの場合は軽量なCoder版等を選択 |
| ストレージ空き容量 | 約80GB以上の空き容量 | 高速なSSD(NVMe推奨) |
| 対応基本ソフト (OS) | Windows 10 / 11、またはLinux | 最新ドライバの適用が必要 |
導入の手順
- ファイルのダウンロード: GitHubのStrataリポジトリからZIPファイルをダウンロードして解凍(または
git clone)します。 - 起動ファイルの実行:
– Windowsの場合: フォルダ内のSTART-HERE.batをダブルクリックします。
– Linuxの場合: 端末で./setup.shを実行します。 - 設定の選択: 画面の案内に従い、使いたいモデルの大きさや画像読み取り機能の有無を選びます(通常はEnterキーを押していくだけで推奨設定になります)。
- AIモデルの自動取得: 約70GBのデータが自動でダウンロードされます(途中で中断しても再開可能です)。
- ブラウザで利用開始: 準備が整うと、ウェブブラウザで
http://127.0.0.1:8080が自動で開き、画面上でチャットやパソコンの使用状況モニターが使えるようになります。
※注意: 初回起動時やAIモデルの読み込み時は、メモリに35〜55GBのデータを配置するため、1〜3分ほどパソコンの動作が重くなることがありますが正常な動作です。
外部のプログラミング支援ツールなどから接続する場合は、接続先URLに http://127.0.0.1:8080/v1 を指定して利用します。
注意点・現時点で分かっていないこと
- 一度に処理できるのは1つの質問のみ: Strataは同時に複数の人から質問を受ける用途には向いておらず、1回のリクエストを順番に処理します。
- メモリ32GB環境での制限: メインメモリが32GBの場合、専門家の数を削ってコード生成に特化させた「Coder版」モデルが推奨されます。一般的な日常会話や多言語処理では通常版より能力が劣る場合があります。
- AMD製グラフィックボードでの一部機能: Windows環境におけるAMDカードでの画像入力処理など、一部の環境や組み合わせは開発途上となっています。
まとめ
- Strataは、1,250億パラメータの巨大AI「Qwen3.8-Flash-Next」を家庭用PCで動かすための無料エンジンです。
- パソコンのグラフィックボード・メモリ・SSDを賢く連携させることで、市販のパーツでも驚くほど速い返答速度を実現しています。
- データがパソコンの外に出ないため、安全かつ無料でAIを使い放題にできるのが最大の魅力です。
- ゲーミングPCをお持ちで、機密性の高い作業をAIに任せたい人にとって、非常に強力な新しい選択肢となります。
よくある質問
プログラミングができない人でも使えますか?
はい、使えます。パソコンに必要な部品(グラフィックボードや大容量メモリ)が載っていれば、準備されたファイルをダブルクリックするだけでセットアップが進み、普段お使いのウェブブラウザからChatGPTのように文字で会話できます。
利用するのにお金はかかりますか?
Strata本体は無料のオープンソースソフトウェア(MITライセンス)として公開されています。利用料金や月額費用は一切かかりません。ただし、動かすためのパソコン本体や電気代、約70GB以上のモデルデータをダウンロードする通信環境が必要です。
ChatGPTなどのクラウドサービスと何が違うのですか?
ChatGPTはインターネット経由で会社のサーバーにデータを送って使いますが、Strataはすべての計算を手元のパソコンの中だけで完結させます。そのため、入力した文章や画像が外部のサーバーに送信されず、情報漏えいの心配がありません。
ノートパソコンでも動きますか?
一般的なノートパソコンでは動作が難しいです。画面の処理を行う専用の部品(VRAMが12GB以上あるNVIDIAまたはAMDのグラフィックボード)と、32GBから64GB以上の大きなメインメモリが必要となるため、デスクトップのゲーミングPCなどが主な対象となります。



