GPT-5.6からGPT-6 SolとLunaを使い始めた頃は、普段の作業で困るような悪化を感じていませんでした。Solには今も不満がなく、その後に使い始めたGPT-6.1 Solでも同じです。良くなっているんだろうし、価格も安く感じるので、使い続けるつもりです。
ただ、2026年10月11日現在、仕事で使っているGPT-6 Lunaには不満が出てきました。GitHub Copilotで不具合の調査を頼むと、開いているファイルや画面だけを見て、すぐに終わってしまうことがあります。GPT-5.6 Lunaが気に入っていたので、同じ感覚で頼めると思っていました。
個人プロジェクトでは、質問しながら進めてくれるのがよかった
GPT-6を使い始めた頃、個人プロジェクトで印象に残ったのは、必要なことを質問しながら作業を進めてくれるところでした。記事の下書きを相談した時も、体験の核を決めるために必要なことを聞かれました。私が答える間にも、答えに依存しない資料確認や原稿整理が進みます。
返事を待つだけで止まらず、進められるところは進めてくれる。15〜30分ほど続くまとまった作業を任せる時にも、これは助かっています。
GPT-6 Solをエフォート「激高」にして使った時も、利用枠が急にひどく減る印象はありませんでした。以前より利用量の減り方が穏やかに感じることもあります。
CopilotのGPT-6 Lunaは、開いているところだけ見て終わることがある
私はGPT-5.6 Lunaが気に入っていたので、GPT-6 Lunaにも期待していました。費用だけでいえば不満はありません。5.6 Lunaと同じ感覚で使っていても、同じか少し安くなったと感じます。
仕事でGitHub Copilotに「この不具合を調べて、対応案をまとめて」と頼む時、5.6 Lunaはコードベース全体を自分から探して、まとめてくれていました。
ところが6 Lunaでは、開いているファイルだけを調べて「問題ありませんでした」と終わることがよくあります。開いている画面だけを見て、問題がないと判断されることもあります。
こちらは、画面・バッチ処理・設計を通して調べてほしい。今開いているところに問題がなくても、そこで調査を切り上げられると困ります。5.6 Lunaと同じ感覚で頼んでいるのに、見てほしい範囲まで進まない。仕事で使っていて、これはダメかもしれないと思うようになりました。
Issueの対応では、2時間ほど修正とテストを続けた
一方で、すぐに打ち切る時ばかりでもありません。
6 LunaにIssueの対応を任せた時は、検証も含めて、完了まで2時間ぐらい修正とテストを続けていました。この時は、最後まで粘ってくれる感じがありました。
ただ、単純に遅かっただけかもしれません。2時間続いたことだけで、仕事が早いとか、質が高いとはまだ言えない。調査をすぐに切り上げることもあれば、長く作業を続けることもあって、今のところLunaへの評価は揺れています。
GPT-6へ移る時期に、作業指示も見直した
ここで書く見直しは、個人プロジェクト側の話です。仕事で使っているCopilot側では、GPT-6向けのSkillsやガイドラインを更新していません。今のLunaへの不満に影響しているのかは、まだ切り分けられていません。
きっかけは、OpenAI DevelopersのGPT-6 Astra向け記事「Rethinking skills and prompts」でした。記事は、モデルの能力や使い方が変わるなら、Skillsの説明、AGENTS.md、タスクごとのプロンプトを見直し、不要に長い指示や適用範囲の広すぎる説明を整理しようと勧めています。Astra向けの記事なので、SolやLunaで同じ効果が出る証明としてではなく、私の設定を点検するきっかけとして読みました。
普段の作業指示やSkillsを見直し、2026年9月23日に14項目を修正しました。モデルを変えるだけでなく、AIに何を確認し、どこまで進めてほしいかも書き直しました。対象は、共通の作業指示、作業別の指示、ブログのガイドライン、記事執筆・図作成のSkillsです。
| 見直した点 | 変えたこと |
|---|---|
| 質問のタイミング | 会話や資料に答えがあれば聞き直さず進め、不足する核心だけを質問する。返事を待つ間も、答えに依存しない調査や整理を進める |
| 作業途中の原稿 | メモ・構成案・完成初稿・公開候補を区別し、途中段階では未確認事項を示して作業できるようにする |
| 許可と読み取り専用 | すでに許可した範囲を聞き直さず、読み取り専用の依頼では本文やレビュー済みフラグを変えないと明記する |
| 詳細ルールの置き場所 | 公開・計測・設定例などの詳しい基準をガイドラインに集約し、共通の作業指示から必要な箇所を参照する |
| 根拠と確認段階 | 原稿の段階に応じて確認項目を変え、数値や成果は元の記録と結び付ける。未確認の内容を実施済みとして書かない |
ここに挙げたのは14項目のうちの一部です。細かな図の要件や参照先の整理も含めて見直しました。個人プロジェクトで助かった質問や並行作業には、こうした作業指示の変更も関わっているかもしれません。
Solは使い続ける。Lunaには調査範囲への不満が残る
ここに書いたのは、同じタスク・設定・指示をそろえて比べた結果ではありません。個人プロジェクトでは作業指示も変えていますし、Copilotで調査が止まる原因も切り分けていません。
Solには、今も不満はありません。Lunaも、費用は納得しています。でも、仕事の不具合調査で、開いているファイルや画面だけを見て終わられるのは困る。画面・バッチ処理・設計を通して調べてほしいのに、5.6 Lunaの感覚で頼むと、物足りなくなってきました。
5.6 Lunaがやってくれていた調査を、6では指示に書き足す必要があるんだろうか。書き足したとしても、次のバージョンでまた動き方が変わるのか。そこも気になっています。
コーディングや調査のタスクでは、これまでどおりGPT-5.6 Lunaも並行して使っています。
Claude Haiku 5.5も出たので、使い始めました。Lunaより使い勝手がよければ、普段使いも考えています。
今回Claudeを試して印象に残ったのは、チャットウィンドウの「思考中」に文章が大量に出ていたことです。最初にかなり考えているのかな、と。最後に「これで行こう」というような方針や結論を示して、実際の作業を進めていました。こういう進め方も含めて、自分の仕事で使いやすいか確かめているところです。
確認した公式情報
- Rethinking skills and prompts for GPT-6 Astra(OpenAI Developers、2026年9月11日)(2026年10月11日再確認)
- GPT-6 Sol/Luna(2026年9月22日)とGPT-6.1 Sol(2026年9月29日)の発表: OpenAI API Changelog(2026年10月11日確認)
- Claude Haiku 5.5の発表: Introducing Claude Haiku 5.5(Anthropic、2026年10月7日)(2026年10月11日確認)

コメント