2 min read

2026 年 10 月前半の LLM 利用状況

あまりにも激動の時代なので、いつか振り返ることがあるかもしれないので、まとめておく。

サブスク

サブスクは Ollama Cloud と Cursor と Codex の三つ。

Ollama Cloud

Team プランを月 $500 で契約して、全員が Ollama Cloud のDeepSeek V4.1 Flash とGLM 5.3 Flash を利用する方針に切り替えた。

Ollama Cloud は月 $500 支払うと $1000 ドル分利用できる。さらにDeepSeek のピークが日本時間の 21:00-03:00 ということで、営業時間にかぶらないというメリットがあり、実質利用枠が 2 倍になった。

Cursor

Team プランの Premium シートを年間契約して利用している。ほぼ Auto (Cost) を利用している。込み入った作業をする場合は Grok 4.7 xhigh を利用している。GLM 5.3 や GLM 5.3 Flash が API 枠で利用できる用になったのも嬉しい。

Codex

ChatGPT Business プランの Premium シートを年間契約して利用している。これは Business プランの 5 倍の容量、さらに 5 時間制限がなくなるというプラン。

基本的には GPT 6.1 Sol Max で利用している。主に調査や設計用。

Claude Code

自分以外をのぞいて解約。自分は評価用として継続している。

API

Ollama Cloud

チャージが OpenAI などと違い、1 年でなくならない OpenCode や DeepSeek は一旦利用を停止し、全てOllama Cloud へ切り替えた。

エージェントハーネス

DeepSeek Harness (DSH)

DSH を fork して日本語化といくつかのプラグインを追加して利用している。また Ollama Cloud がサードパーティにないので追加した。ロングランは圧倒的に DSH が強いので長期の調査系は DSH 1択。

GitHub - shiguredo/deepseek-harness: DeepSeek Harness: Everything is a Plugin.
DeepSeek Harness: Everything is a Plugin. Contribute to shiguredo/deepseek-harness development by creating an account on GitHub.

OpenCode2

Cursor や Codex 以外の利用には OpenCode2 で統一している。攻めた構成ではなく、安定している感じではある。


ローカル LLM

DGX Spark 互換機 (Lenovo ThinkStation PGX) を 2 台購入して DeepSeek V4 Flash Vision Exp の公式モデルを vLLM で利用している。プレミアムサポート 3 年を契約している。

レシピは https://github.com/MiaAI-Lab/DeepSeek-v4-Flash-DSpark-2x-DGX-Spark を利用している。コンテキストを最大 512K 減らし、クロック数を 2200 に制限して利用している。これにより温度は 70 度行かずに安定的に動作している。

用途は GitHub Actions (Self-hosted runner) + Tailscale + OpenCode を利用して、自動でコードレビューやイシューレビューをしている。基本は勝手に優先順位を付けてレビューして回るが、優先的にレビュー依頼を出すこともでき、仕事上がりに「明日までにレビューしておいて欲しいコードやイシューを指示できる」仕組みを提供している。

電気代だけで 24 時間 365 日、文句を言わず働いてくれている。