ブログ
LLM APIのコストを下げる7つの方法(効果が大きい順)
LLM APIのコスト削減は、やる順番でほぼ決まります。効果が最大のモデル選定から、出力・推論トークン、キャッシュ、日本語対策まで、実測にもとづいて効果の大きい順に整理しました。
GPT-5.6 Terra vs Claude Sonnet 5:中位モデルの本命はどちらか
OpenAI の GPT-5.6 Terra と Anthropic の Claude Sonnet 5 を比較。どちらも「日常使いの主力」を狙う中位モデルです。性能・文脈長・使い分けの判断軸を解説します。
Gemini 3.7 Flash vs GPT-5.6 Luna:低価格・高速モデルの使い分け
Google の Gemini 3.7 Flash と OpenAI の GPT-5.6 Luna を比較。どちらも大量処理・低レイテンシ向けの低価格モデルです。入力モダリティとコストの違いから使い分けを解説します。
Grok 4.6 vs GPT-5.6 Terra:同価格帯の実力派を比較
xAI の Grok 4.6 と OpenAI の GPT-5.6 Terra を比較。ほぼ同じ価格帯に並ぶ2つの実力派モデルの、文脈長・得意分野・使い分けの判断軸を解説します。
Muse Glimmer 30B vs Qwen3.6 27B:30Bクラスのオープンモデルを円建てで比べる
Meta が8月10日に公開した Muse Glimmer 30B と、同じ30Bクラスの定番 Qwen3.6 27B を比較します。ベンチマークの読み方の注意点と、円建ての実コスト差、使い分けまで具体的に見ていきます。
Qwen3.8 Max vs Claude Opus 5:ベンチマークと実際の請求額で比べる
2026年8月に登場した Qwen3.8 Max と、7月公開の Claude Opus 5 を比較します。ベンチマークの読み方の注意点と、同じ作業を投げたときの円建ての差まで具体的に見ていきます。
Hermes vs OpenClaw:オープンソースのエージェント2つを1つのキーで使い分ける
オープンソースのエージェント Hermes と OpenClaw は、似ているようで役割が違います。それぞれの得意分野と、FastMetal に繋ぐ設定、常駐型エージェントを従量課金で回すときの注意点をまとめました。
オープンウェイトモデル禁止論争 — Anthropic と OpenAI の回答を読み解く
米国でオープンウェイトモデルの規制論が過熱。Anthropic の Amodei と OpenAI はどう答えたのか。禁止は現実的なのか、日本の開発者への影響を含めて整理します。
Claude Opus 5 vs GPT-5.6 Sol:最新フラッグシップ2モデルを比較
2026年7月に相次いで登場した Claude Opus 5 と GPT-5.6 Sol を、コーディング・エージェント性能・料金・弱点まで、実際の評判を交えて比較します。
DeepSeek V4 Pro vs Claude Opus 5:オープンの巨人 vs 最新クローズド旗艦
MITライセンスの巨大オープンモデル DeepSeek V4 Pro と、最新クローズド旗艦 Claude Opus 5 を、コスト・性能・弱点まで比較。コストを取るか、最高品質を取るか。