BLOG / AI & ENGINEERING
AIを試し、確かめ、形にする。
AI活用・仕様駆動開発・エンジニアリングの実践知
OpenAI Decisions API がパブリックベータに:公式仕様で埋まった「未公表」と Jev との再比較
OpenAI Decisions API が 2026 年 10 月 6 日にパブリックベータになり、公式ガイドと SDK が公開されました。predicate / choice / score の 3 つの質問型、確率と confidence、入力トークンのみの料金など、前回記事で「未公表」だった項目を公式仕様で埋め直し、TypeSafe Jev との比較を図解つきで更新します。
- 公開日
- 読了時間
- 15分で読めます
情報流出の『システム側の欠陥』を Claude Code で15分検査する — 問診と実測を突き合わせる privacy-check
個人情報流出の原因のうち、人の教育では止まらない『システム側の欠陥』を Claude Code で検査する手順をまとめます。組み込みの /security-review でできることと限界、フィールフロウが公開した ff-privacy-check の問診・確認・実測・所見の流れ、そして自社サイトの repo を実際に検査した所見を、問診の答えとコードが食い違った箇所も含めてそのまま載せます。
- 公開日
- 読了時間
- 9分で読めます
Claude Code の html-plan を試す:実装計画を「答えられる HTML」で受け取る
Claude Code に実装計画を頼むと、長い Markdown が返ってきて読み切れない。そんな悩みに向けた試作スキル html-plan を、同梱サンプルを実際に組み立てて確かめました。計画を「主張のツリー」として 1 枚の HTML にまとめ、判断が必要な箇所に選択肢を置き、回答を 1 つの返信にまとめて Claude へ戻せます。導入は 2 コマンドで、必要なのは node だけです。
- 公開日
- 読了時間
- 10分で読めます
OpenAI Decisions API を読む:Jev と並んだ「判断だけを返す AI」の使いどころ
OpenAI が DevDay 2026 で発表した Decisions API は、文章を生成せず、用意した候補から答えを選ぶ API です。何ができるのか、どんな場面で効くのか、TypeSafe の Jev と何が違うのかを、6 枚の図解と比較表で整理します。料金や試し方も、公表済みと未公表を分けて確認します。
- 公開日
- 読了時間
- 15分で読めます
Gemini 4 Argon登場:Googleは最上位争いに戻ったのか? Opus 5.5・Fable 5.1・GPT-6 Astra・GPT-6.1 Sol・Gemini 3.8 Flashとコーディング・文章作成を比較
Google DeepMindが新フラッグシップGemini 4 Argonを発表しました。出力上限100万トークン、導入価格はGPT-6.1 Solと同額。Gemini 4 ArgonとGemini 3.8 Flash・Claude Opus 5.5・Claude Fable 5.1・GPT-6 Astra・GPT-6.1 Solの計6モデルを、同じ評価環境のコーディングと文章・資料作成の公開評価、API単価と1タスクあたりの実費で比較し、仕事ごとの選び方を整理します。
- 公開日
- 読了時間
- 29分で読めます
GPT-6.1 Sol登場:Astra級の性能を5分の1の価格で? Opus 5.5・Fable 5.1・Grok 4.7とコーディング・文章作成を比較
OpenAIがGPT-6 Solの発表から7日でGPT-6.1 Solを投入しました。「Astraに迫る性能を5分の1の価格で」という主張は本当か。GPT-6.1 SolとGPT-6 Sol・GPT-6 Astra・Claude Opus 5.5・Claude Fable 5.1・Grok 4.7の計6モデルを、同じ評価環境のコーディングと文章・資料作成の公開評価、API単価とGitHub Copilotのクレジットで比較し、仕事ごとの選び方を整理します。
- 公開日
- 読了時間
- 24分で読めます















