=AIの“レシピ(重み)”が公開されていて、誰でもローカルで動かせるAI
① オープンウェイトAIとは(わかりやすく)
AIは「重み(weights)」という学習済みの“頭の設定”で動いています。
- クローズAI(例:ChatGPT) →「料理は任せて!でもレシピは秘密ね」 →重みは非公開、クラウドでしか動かない
- オープンウェイトAI →「レシピ(重み)全部公開するよ。家でも作っていいよ」 →重みが公開されているので
- ローカルPC
- Raspberry Pi
- Jetson
- オフライン環境 で自由に動かせる
つまり: オープンウェイトAI=“AIのレシピが公開されていて、誰でも自分の端末で動かせるAI”
② 代表的な会社・プロジェクト(2026)
- Meta Llamaシリーズ。世界で最も普及。
- Mistral AI Mixtral。高速・軽量でローカル向き。
- Stability AI Stable Diffusion。画像生成の代表格。
- Google DeepMind Gemma。軽量で教育・研究向け。
- その他コミュニティ
- HuggingFace
- OpenBMB
- Qwen(Alibaba)
- Phi(Microsoft軽量モデル群)
③ 今後どうなる?(未来予測)
- ローカルAIが主流化 コスト・プライバシーの観点から、クラウド依存が減る。
- 教育・研究の標準に 中身が見える/改造できる/教材に使いやすい。
- 企業が“自社専用AI”を作る時代へ オープンウェイトをベースに自社データで微調整。
- 透明性の義務化(EU・日本) 説明可能性の要求により、クローズAIだけでは不十分。
- ロボット・IoT・エッジAIで必須技術に Raspberry Pi・Jetsonで動く軽量モデルが増加。
④ オープンウェイトAIの7大カテゴリ(重複整理済)
オープンウェイトAIは LLMだけではない。 2026時点では以下の7分野に体系化できる。
🧠 1. 言語モデル(LLM)
文章生成・要約・翻訳・RAG・チャット。
- Llama
- Qwen
- DeepSeek
- Gemma
- Mistral 用途:社内検索、教材AI、ローカルチャット
🎨 2. 画像生成モデル
Stable Diffusionが中心。
- Stable Diffusion
- Kandinsky
- OpenMMLab系 用途:教材図解、ロボット視覚データ生成
🔊 3. 音声モデル(TTS/ASR)
- Whisper(認識)
- Bark / OpenVoice(合成) 用途:教材読み上げ、ロボット音声
🎥 4. 動画生成モデル
- Open-Sora
- ModelScope Video
- AnimateDiff 用途:教材動画、ロボット動作シミュレーション
🧩 5. マルチモーダル(画像+言語)
- LLaVA
- Qwen-VL
- DeepSeek-VL 用途:ロボット視覚、図解説明
💻 6. コード生成モデル
- Code Llama
- DeepSeek Coder
- StarCoder 用途:Arduinoコード、Web教材作成
🤖 7. エージェント・推論特化
- DeepSeek-R1
- OpenBMB AgentLM 用途:ロボット制御、ワークフロー自動化
⑤ フィジカルAI向け“最適モデル”選定(校正版)
奥野さんの教材(Arduino・センサー・ロボット・ブラウザAI)に最適化すると、 軽量・高速・ローカル・マルチモーダルが必須条件。
🏆 総合ベスト構成(フィジカルAI向け)
DeepSeek-R1(推論)+ Qwen2-VL(画像理解)+ Stable Diffusion Turbo(図解生成)
🧠 1. LLM(推論・制御)最適:DeepSeek-R1
理由
- センサー値の解釈が得意
- ロボット制御の理由づけが強い
- 軽量版がローカル実行可能
- WebGPUでブラウザ実行できる派生多数
用途
- Arduinoコード生成
- センサー値の説明
- ロボット行動判断
- ブラウザ教材AI
🖼️ 2. 画像理解(カメラ+AI)最適:Qwen2-VL
理由
- ESP32カメラ画像を解析
- 図解教材との相性が抜群
- 物体認識が高精度
- 軽量版がローカル動作
用途
- ロボット視覚
- 防災教材の画像説明
- 図解自動生成
🎨 3. 画像生成(図解)最適:Stable Diffusion Turbo
理由
- 図解・アイコン生成が高速
- A4教材の挿絵量産
- GPU不要の軽量版あり
🔊 4. 音声:OpenVoice
教材読み上げ・ロボット音声に最適。
🎥 5. 動画:Open-Sora
ロボット動作の説明動画に最適。
📌 フィジカルAI向けモデル構成(表)
| 分野 | 最適モデル | 理由 | 教材での使い方 |
| LLM | DeepSeek-R1 | 推論が強い | Arduinoコード、センサー解釈 |
| 画像理解 | Qwen2-VL | カメラ画像の説明が高精度 | ロボット視覚、防災教材 |
| 画像生成 | Stable Diffusion Turbo | 図解生成が高速 | A4教材の挿絵 |
| 音声 | OpenVoice | 読み上げに最適 | ナレーション |
| 動画 | Open-Sora | 動作説明動画 | 動画教材 |