一次情報読解 AI原典ノート
RSS 保存
今日の更新 2026-07-12 - Anthropic: Claude 429 誤診前に読む failure-mode runbook / OpenAPI Initiative: agent tool 接続前に読む interface contract / arXiv: shared inference 導入前に読む KV cache privacy boundary
トピック

LLM API

Responses API、Gemini API、モデル更新、構造化出力、SDK。

01 まず知りたい Claude の rate limits は「429 が出た」だけでは原因を誤診する Anthropic / not stated on the docs page 02 仕事で安全に使いたい OpenAPI 3.1 は「JSON が通る」だけでは曖昧な tool 契約を止める OpenAPI Initiative / 2021-02-15 03 仕事で安全に使いたい KV cache は高速化の小技ではなく、共有推論の privacy 境界そのものだ arXiv / 2025-08-13 (arXiv v1; revised 2026-03-11) 04 仕事で安全に使いたい Programmatic Tool Calling は「まとめ処理」と「承認が要る実行」を混ぜるなと迫る OpenAI / not stated on the guide page 05 作る前に確認したい Safety checks は「危ない prompt を弾く」より先に危ない user を追えるようにせよと迫る OpenAI / not stated on the guide page 06 作る前に確認したい Gemini logs and datasets は「会話履歴が勝手に残る前提」を放置するなと教える Google AI for Developers / not stated on the page 07 仕事で安全に使いたい WASP は browser agent の安全性を「承認あり」ではなく hijack 成功率で測り直す arXiv / 2025-04-22 (arXiv v1; revised 2025-05-16) 08 更新を追いたい Claude API の rate limit 統合は「安い model は細い」を前提にした運用表を壊す Anthropic / 2026-06-26 (release note entry) 09 仕事で安全に使いたい Claude Workload Identity Federation は「CI に API key を置きっぱなし」を終わらせる入口 Anthropic / 2026-05-04 (release note entry) 10 まず知りたい Microsoft Foundry tracing は「とりあえず全部記録」をやめて、本番 telemetry の責任に戻す Microsoft Learn / Azure OpenAI / 2026-06-26 11 まず知りたい vLLM の cold start は「GPU が遅い」の前に起動経路を分解して見ろと迫る arXiv / 2026-06-05 12 作る前に確認したい AI SDK Tool Calling は「AI に道具を渡す」前に、どこで止めてどこで実行するかを決めろ Vercel AI SDK / page 上では公開日未記載 13 作る前に確認したい Azure OpenAI Responses API は「本家サンプルの移植」で済まない運用条件を持っている Microsoft Learn / Azure OpenAI / page last updated 2026-06-11 14 作る前に確認したい MCP transports は「つながる」より先に origin と localhost を守れと言っている Model Context Protocol / 2025-06-18 spec version (page publication date not stated) 15 仕事で安全に使いたい OWASP LLM06 は「AI に権限を与えすぎる雑さ」を止めるための最低線だ OWASP Gen AI Security Project / page 上では公開日未記載 16 作る前に確認したい MCP Tools spec は、tool 連携の責任を「文字列返却」から型と確認へ押し戻す Model Context Protocol / versioned spec page; page 上では公開日未記載 17 仕事で安全に使いたい Gemini API OAuth は「API key のまま本番へ行く雑さ」を止める入口 Google AI for Developers / page 上では公開日未記載(Last updated 2026-07-01 UTC) 18 まず知りたい TensorRT-LLM architecture は、推論性能の主役を GPU 名から scheduler と KV cache 管理へ戻す NVIDIA TensorRT-LLM / page 上では公開日未記載(Last updated on September 15, 2025) 19 仕事で安全に使いたい AWS MCP Servers は「つながる」前に、どの AWS 権限を AI に渡すかを迫る AWS / 2025-04-01 20 仕事で安全に使いたい TraceSafe は、guardrail を最終回答だけで評価する甘さを壊す arXiv / 2026-04-08 21 まず知りたい Gemini Computer Use は「クリックできる」より先に、危険操作の停止線を設計させる Google AI for Developers / 公式 guide page 上の visible wording: Last updated 2026-06-25 UTC 22 まず知りたい Long context は「長く入る」だけでは足りず、真ん中の根拠を落としやすい arXiv / 2023-07-06 23 仕事で安全に使いたい vLLM Security は「self-host だから安全」という雑な安心を壊す vLLM / page 上では公開日未記載 24 仕事で安全に使いたい OWASP Prompt Injection は「騙される危険」を実装チェック項目へ落とす OWASP Gen AI Security Project / page 上では公開日未記載 25 作る前に確認したい PagedAttention は LLM serving のボトルネックを「GPU不足」から「KV cache 運用」へ引き戻した arXiv / 2023-09-12 26 作る前に確認したい Citation Formatting は「引用を後から付ける」前に、根拠の最小単位を決めろと迫る OpenAI / 公式 docs page 上では公開日未記載 27 作る前に確認したい Reasoning best practices は「考えてと書けば賢くなる」を止めに来ている OpenAI / 公式 docs page 上では公開日未記載 28 仕事で安全に使いたい Computer use は「画面を触れるか」ではなく、どの実行面に閉じ込めるかで選ぶ OpenAI / 公式 docs page 上では公開日未記載 29 仕事で安全に使いたい Guardrail と approval を一緒にすると、危険な操作は止まらない OpenAI / 公式 docs page 上では公開日未記載 30 更新を追いたい Realtime の sideband control は、音声デモを本番境界へ引き戻す OpenAI / 公式 docs page 上では公開日未記載 31 更新を追いたい OpenAI の MCP docs は「対応しました」で終わらない責任分界を見せる OpenAI / 公式 docs page 上では公開日未記載 32 作る前に確認したい Gemini Live API の tool use は「呼んだ後を誰がつなぐか」が本題 Google AI for Developers / 公式 docs page 上では公開日未記載(Last updated 2026-06-01 UTC) 33 まず知りたい Claude のモデル移行は ID 差し替えだけでは終わらない Anthropic / 公式ドキュメント上では公開日未記載 34 まず知りたい Zero Data Retention は「何も残らない」ではなく、「何がどこに残るかを切り分ける」話 OpenAI / 公式ドキュメント上では公開日未記載 35 作る前に確認したい Define your agent は「長いプロンプト」ではなく再利用できる設定資産を作る話 Anthropic / 公式ドキュメント上では公開日未記載 36 更新を追いたい Gemini の model 名は「性能ラベル」ではなく運用契約として読む Google AI for Developers / 公開日未記載(最終更新: 2026-06-15 UTC) 37 作る前に確認したい Function calling は「AIに外部処理を任せる境界」を雑にしないための基本部品 OpenAI / 公式ガイド上では公開日未記載 38 まず知りたい Embeddings は「検索の前に何を同じ意味として近づけるか」を決める層だ Google AI for Developers / 公開日未記載(最終更新: 2026-05-29 UTC) 39 作る前に確認したい File Search は「RAG を自作するか否か」ではなく責務の切り方を問い直す OpenAI / 公式ガイド上では公開日未記載 40 仕事で安全に使いたい Claude Code hooks は「守ってほしいお願い」を実行境界へ移す Anthropic / 公式ドキュメント上では公開日未記載 41 仕事で安全に使いたい Sandbox Agents は「agent 本体」と「作業用 compute」を同じものとして扱う雑設計をやめさせる OpenAI / 公式ガイド上では公開日未記載 42 作る前に確認したい Conversations API は「前の response をつなぐだけ」の限界を超える state の器 OpenAI / 公式ガイド上では公開日未記載 43 仕事で安全に使いたい Gemini API key の制限強化は、雑な PoC 鍵運用を 403 に変える Google AI for Developers / 公開日未記載(最終更新: 2026-06-10 UTC) 44 品質を見たい Prompt Objects 廃止は「prompt を管理画面で育てる運用」をやめる合図 OpenAI / 公式ガイド上では公開日未記載 45 仕事で安全に使いたい Workload identity federation は「OpenAI API key を配る前提」を崩す OpenAI / 公式ガイド上では公開日未記載 46 仕事で安全に使いたい Moderation を別APIの前処理で終わらせる時代が終わりつつある OpenAI / 公式ガイド上では公開日未記載 47 作る前に確認したい Gemini Interactions API の `steps` 移行は、SDK 更新より parser 棚卸しが本体 Google AI for Developers / 公式ガイド最終更新: 2026-06-01 UTC 48 仕事で安全に使いたい Secure MCP Tunnel は「private MCP を公開せずに使う」責任境界を具体化した OpenAI / 公式ガイド上では公開日未記載 49 作る前に確認したい Background mode は「長時間 reasoning を同期HTTPで待つな」という運用変更 OpenAI / 公開日未記載 50 仕事で安全に使いたい Gemini API の managed agents は「sandbox がある」だけでは安心できない Google AI for Developers / 2026-05-19 51 更新を追いたい GPT-Realtime-2 は、音声UIを「会話」から実行ワークフローへ寄せる OpenAI / 2026-05-07 52 作る前に確認したい Responses API の組み込みツールは、Agent 実装の責任分界を変える OpenAI / 2025-05-21 53 更新を追いたい Gemini API の release notes は、仕様変更を追うための一次情報になる Google AI for Developers / 2026-01-05 54 まず知りたい Tiny Agents は、MCP 時代の agent 実装を小さく理解する入口になる Hugging Face / 2025-04-25