⏰ OpenRouter 期間限定無料モデル
| モデル | 期限 | コンテキスト | 入力/出力価格 |
|---|---|---|---|
| NVIDIA: Llama 3.3 Nemotron Super 49B V1.5 | 7月17日 | 131K | $0.40/M tokens |
| Meta: Llama 3.2 11B Vision Instruct | 7月17日 | 131K | $0.35/M tokens |
| Qwen: Qwen3 Next 80B A3B Instruct (無料) | 7月19日 | 262K | 無料 |
| Qwen: Qwen3 Coder 480B A35B (無料) | 7月19日 | 1M | 無料 |
| Venice: Uncensored (無料) | 7月19日 | 33K | 無料 |
| Meta: Llama 3.3 70B Instruct (無料) | 7月19日 | 131K | 無料 |
| Meta: Llama 3.2 3B Instruct (無料) | 7月19日 | 131K | 無料 |
| Nous: Hermes 3 405B Instruct (無料) | 7月19日 | 131K | 無料 |
| Tencent: Hy3 (無料) | 7月21日 | 262K | 無料 |
| OpenAI: GPT-5.3 Chat | 8月10日 | 128K | $1.75/M 入力, $14/M 出力 |
無料モデルは7月19〜21日に期限切れ。GPT-5.3 Chat(GPT-5.2からアップグレード)の無料枠は8月10日まで。
🤯 今週の大型モデルリリース
Anthropic: Claude Sonnet 5、Opus 4.8、Fable 5
AnthropicがOpenRouterで3つの新Claudeモデルを発表しました:Claude Sonnet 5($2/$10 100万トークンあたり)、Claude Opus 4.8($5/$25、高速版$10/$50)、Claude Fable 5($10/$50)。すべて1Mコンテキストウィンドウを搭載。これはAnthropic史上最大の同時モデルリリースであり、コスト効率重視から最前線インテリジェンスまで全スペクトラムをカバーしています。
OpenAI: GPT-5.6 Luna/Terra/Sol シリーズ公開
OpenAIのGPT-5.6シリーズがOpenRouterで利用可能になりました。3層の価格構造:
- GPT-5.6 Luna($1/$6 100万トークンあたり、1.05M ctx)— 最速、最もコスト効率が高い
- GPT-5.6 Terra($2.50/$15、1.05M ctx)— バランス性能
- GPT-5.6 Sol($5/$30、1.05M ctx)— フラッグシップ推論
各層のProバージョンは同価格で信頼性を強化。さらにGPT-5.3 Chat($1.75/$14、128K ctx)がGPT-5.2 Chatを置き換え、GPT-5.3 Codex($1.75/$14、400K ctx)がコード特化型バリアントとしてデビューしました。
Alibaba Qwen: 3.6 ファミリー全種と 3.7 Plus/Max 公開
AlibabaのQwenチームが大規模なモデルウェーブを投入:
- Qwen 3.7 Plus($0.32/$1.28 100万トークンあたり、1M ctx)
- Qwen 3.7 Max($1.25/$3.75、1M ctx)
- Qwen 3.6 Flash($0.19/$1.12、1M ctx)— 超高速推論
- Qwen 3.6 35B A3B($0.14/$1、262K ctx)— 高効率MoE
- Qwen 3.6 27B($0.45/$2.70、262K ctx)
- Qwen 3.6 Plus($0.33/$1.95、1M ctx)
- Qwen 3.6 Max Preview($1.04/$6.24、262K ctx)
Qwen 3.6 Flashは100万トークンあたりわずか$0.19で、市場で最も手頃な高性能モデルの一つです。
Google: Gemini 3.5 Flash
GoogleがGemini 3.5 Flash($1.50/$9 100万トークンあたり、1Mコンテキスト)をリリース — Gemini 3.x Flashラインの高速反復版で、高スループットアプリケーション向けに最適化されています。
⭐ GitHub トレンド: AI エディション
- AlephAITech/WorkBuddyGuide — WorkBuddy実践オープンソースガイド。⭐ 757
- William-Lu-stack/Flawless — Kubernetesとクラウドインフラ向けAI SRE運用ツール。⭐ 619
- yetone/kill-ai-slop — AI生成プロダクトの視覚的特徴を識別するガイドと検出ツール。⭐ 451
- QuantumByteOSS/quantumbyte — オープンソースアプリビルダーエンジン — 意図から動作するアプリへ。⭐ 307
- dongguatanglinux/grok-build-auth — xAI Grok Build OAuthプロトコル研究ツール。⭐ 228
🤗 HuggingFace 新規アップロード
注目すべき最近のアップロードには、Whisper large-v3-turboタイ語・英語音声認識アダプター、GGUF量子化Gemma-4-12bバリアント、カタルーニャ語モデル、SWE-bench特化モデル、新しいsafetensorsモデルなどが含まれます。
💡 主要トレンド
-
モデルリリースの雪崩 — 7月15日だけでAnthropic、OpenAI、Google、Alibabaが相次いで大型新モデルをリリース。各研究所がOpenRouter上で開発者の注目を競い、前例のないペースで最先端モデルを投入しています。Claude Sonnet 5、Opus 4.8、Fable 5、GPT-5.6×3層、GPT-5.3×2種、Qwen 3.7×2 + 3.6×5、Gemini 3.5 Flashという膨大なリリース数は、超規模モデル爆発の新段階に入ったことを示しています。
-
低価格帯の価格競争 — Qwen 3.6 Flashが$0.19/M、35B A3B MoEが$0.14/Mと、コスト効率の最先端を走っています。Qwen3 Coder(1M ctx)やLlama 3.3 70Bが7月19日まで無料で利用できることを合わせると、高性能モデルを実行する障壁はかつてなく低くなっています。
-
Anthropicのマルチモデル戦略 — Sonnet 5、Opus 4.8、Fable 5の同時リリースは、単一のフラッグシップではなく全価格帯をカバーするAnthropicの戦略を示しています。これはOpenAIのGPT-5.6 Luna/Terra/Sol階層化と軌を一にしており、業界が単一モデルリリースからモデルファミリー戦略へと収束していることを示唆しています。
-
無料モデル期間間近 — NVIDIA Nemotron、Meta Llama Vision、Qwen/Meta/Nous無料枠など複数の無料モデルが7月17-19日に期限切れとなります。移行計画や有料使用の予算調整が必要です。
本日のスナップショット
- OpenRouter 期間限定無料モデル: 10
- HuggingFace トレンドモデル: 10件の新規アップロード
- GitHub トレンドAIリポジトリ: 5
- 今週の主要モデルリリース: 15+(Anthropic 3、OpenAI 5、Qwen 7、Google 1)
- トップストーリー: Anthropic Claude Sonnet 5 + OpenAI GPT-5.6シリーズがOpenRouterに登場
対象期間 7月13〜15日。出典:OpenRouter、Hugging Face、GitHub。