本文へ移動
一次情報読解
AI原典ノート
記事
読み方
トピック
ソース
用語集
週刊
RSS
保存
夜間
週刊メール
今日の更新 2026-07-12 - Anthropic: Claude 429 誤診前に読む failure-mode runbook / OpenAPI Initiative: agent tool 接続前に読む interface contract / arXiv: shared inference 導入前に読む KV cache privacy boundary
トピック
LLM API
Responses API、Gemini API、モデル更新、構造化出力、SDK。
01
まず知りたい
Claude の rate limits は「429 が出た」だけでは原因を誤診する
Anthropic / not stated on the docs page
02
仕事で安全に使いたい
OpenAPI 3.1 は「JSON が通る」だけでは曖昧な tool 契約を止める
OpenAPI Initiative / 2021-02-15
03
仕事で安全に使いたい
KV cache は高速化の小技ではなく、共有推論の privacy 境界そのものだ
arXiv / 2025-08-13 (arXiv v1; revised 2026-03-11)
04
仕事で安全に使いたい
Programmatic Tool Calling は「まとめ処理」と「承認が要る実行」を混ぜるなと迫る
OpenAI / not stated on the guide page
05
作る前に確認したい
Safety checks は「危ない prompt を弾く」より先に危ない user を追えるようにせよと迫る
OpenAI / not stated on the guide page
06
作る前に確認したい
Gemini logs and datasets は「会話履歴が勝手に残る前提」を放置するなと教える
Google AI for Developers / not stated on the page
07
仕事で安全に使いたい
WASP は browser agent の安全性を「承認あり」ではなく hijack 成功率で測り直す
arXiv / 2025-04-22 (arXiv v1; revised 2025-05-16)
08
更新を追いたい
Claude API の rate limit 統合は「安い model は細い」を前提にした運用表を壊す
Anthropic / 2026-06-26 (release note entry)
09
仕事で安全に使いたい
Claude Workload Identity Federation は「CI に API key を置きっぱなし」を終わらせる入口
Anthropic / 2026-05-04 (release note entry)
10
まず知りたい
Microsoft Foundry tracing は「とりあえず全部記録」をやめて、本番 telemetry の責任に戻す
Microsoft Learn / Azure OpenAI / 2026-06-26
11
まず知りたい
vLLM の cold start は「GPU が遅い」の前に起動経路を分解して見ろと迫る
arXiv / 2026-06-05
12
作る前に確認したい
AI SDK Tool Calling は「AI に道具を渡す」前に、どこで止めてどこで実行するかを決めろ
Vercel AI SDK / page 上では公開日未記載
13
作る前に確認したい
Azure OpenAI Responses API は「本家サンプルの移植」で済まない運用条件を持っている
Microsoft Learn / Azure OpenAI / page last updated 2026-06-11
14
作る前に確認したい
MCP transports は「つながる」より先に origin と localhost を守れと言っている
Model Context Protocol / 2025-06-18 spec version (page publication date not stated)
15
仕事で安全に使いたい
OWASP LLM06 は「AI に権限を与えすぎる雑さ」を止めるための最低線だ
OWASP Gen AI Security Project / page 上では公開日未記載
16
作る前に確認したい
MCP Tools spec は、tool 連携の責任を「文字列返却」から型と確認へ押し戻す
Model Context Protocol / versioned spec page; page 上では公開日未記載
17
仕事で安全に使いたい
Gemini API OAuth は「API key のまま本番へ行く雑さ」を止める入口
Google AI for Developers / page 上では公開日未記載(Last updated 2026-07-01 UTC)
18
まず知りたい
TensorRT-LLM architecture は、推論性能の主役を GPU 名から scheduler と KV cache 管理へ戻す
NVIDIA TensorRT-LLM / page 上では公開日未記載(Last updated on September 15, 2025)
19
仕事で安全に使いたい
AWS MCP Servers は「つながる」前に、どの AWS 権限を AI に渡すかを迫る
AWS / 2025-04-01
20
仕事で安全に使いたい
TraceSafe は、guardrail を最終回答だけで評価する甘さを壊す
arXiv / 2026-04-08
21
まず知りたい
Gemini Computer Use は「クリックできる」より先に、危険操作の停止線を設計させる
Google AI for Developers / 公式 guide page 上の visible wording: Last updated 2026-06-25 UTC
22
まず知りたい
Long context は「長く入る」だけでは足りず、真ん中の根拠を落としやすい
arXiv / 2023-07-06
23
仕事で安全に使いたい
vLLM Security は「self-host だから安全」という雑な安心を壊す
vLLM / page 上では公開日未記載
24
仕事で安全に使いたい
OWASP Prompt Injection は「騙される危険」を実装チェック項目へ落とす
OWASP Gen AI Security Project / page 上では公開日未記載
25
作る前に確認したい
PagedAttention は LLM serving のボトルネックを「GPU不足」から「KV cache 運用」へ引き戻した
arXiv / 2023-09-12
26
作る前に確認したい
Citation Formatting は「引用を後から付ける」前に、根拠の最小単位を決めろと迫る
OpenAI / 公式 docs page 上では公開日未記載
27
作る前に確認したい
Reasoning best practices は「考えてと書けば賢くなる」を止めに来ている
OpenAI / 公式 docs page 上では公開日未記載
28
仕事で安全に使いたい
Computer use は「画面を触れるか」ではなく、どの実行面に閉じ込めるかで選ぶ
OpenAI / 公式 docs page 上では公開日未記載
29
仕事で安全に使いたい
Guardrail と approval を一緒にすると、危険な操作は止まらない
OpenAI / 公式 docs page 上では公開日未記載
30
更新を追いたい
Realtime の sideband control は、音声デモを本番境界へ引き戻す
OpenAI / 公式 docs page 上では公開日未記載
31
更新を追いたい
OpenAI の MCP docs は「対応しました」で終わらない責任分界を見せる
OpenAI / 公式 docs page 上では公開日未記載
32
作る前に確認したい
Gemini Live API の tool use は「呼んだ後を誰がつなぐか」が本題
Google AI for Developers / 公式 docs page 上では公開日未記載(Last updated 2026-06-01 UTC)
33
まず知りたい
Claude のモデル移行は ID 差し替えだけでは終わらない
Anthropic / 公式ドキュメント上では公開日未記載
34
まず知りたい
Zero Data Retention は「何も残らない」ではなく、「何がどこに残るかを切り分ける」話
OpenAI / 公式ドキュメント上では公開日未記載
35
作る前に確認したい
Define your agent は「長いプロンプト」ではなく再利用できる設定資産を作る話
Anthropic / 公式ドキュメント上では公開日未記載
36
更新を追いたい
Gemini の model 名は「性能ラベル」ではなく運用契約として読む
Google AI for Developers / 公開日未記載(最終更新: 2026-06-15 UTC)
37
作る前に確認したい
Function calling は「AIに外部処理を任せる境界」を雑にしないための基本部品
OpenAI / 公式ガイド上では公開日未記載
38
まず知りたい
Embeddings は「検索の前に何を同じ意味として近づけるか」を決める層だ
Google AI for Developers / 公開日未記載(最終更新: 2026-05-29 UTC)
39
作る前に確認したい
File Search は「RAG を自作するか否か」ではなく責務の切り方を問い直す
OpenAI / 公式ガイド上では公開日未記載
40
仕事で安全に使いたい
Claude Code hooks は「守ってほしいお願い」を実行境界へ移す
Anthropic / 公式ドキュメント上では公開日未記載
41
仕事で安全に使いたい
Sandbox Agents は「agent 本体」と「作業用 compute」を同じものとして扱う雑設計をやめさせる
OpenAI / 公式ガイド上では公開日未記載
42
作る前に確認したい
Conversations API は「前の response をつなぐだけ」の限界を超える state の器
OpenAI / 公式ガイド上では公開日未記載
43
仕事で安全に使いたい
Gemini API key の制限強化は、雑な PoC 鍵運用を 403 に変える
Google AI for Developers / 公開日未記載(最終更新: 2026-06-10 UTC)
44
品質を見たい
Prompt Objects 廃止は「prompt を管理画面で育てる運用」をやめる合図
OpenAI / 公式ガイド上では公開日未記載
45
仕事で安全に使いたい
Workload identity federation は「OpenAI API key を配る前提」を崩す
OpenAI / 公式ガイド上では公開日未記載
46
仕事で安全に使いたい
Moderation を別APIの前処理で終わらせる時代が終わりつつある
OpenAI / 公式ガイド上では公開日未記載
47
作る前に確認したい
Gemini Interactions API の `steps` 移行は、SDK 更新より parser 棚卸しが本体
Google AI for Developers / 公式ガイド最終更新: 2026-06-01 UTC
48
仕事で安全に使いたい
Secure MCP Tunnel は「private MCP を公開せずに使う」責任境界を具体化した
OpenAI / 公式ガイド上では公開日未記載
49
作る前に確認したい
Background mode は「長時間 reasoning を同期HTTPで待つな」という運用変更
OpenAI / 公開日未記載
50
仕事で安全に使いたい
Gemini API の managed agents は「sandbox がある」だけでは安心できない
Google AI for Developers / 2026-05-19
51
更新を追いたい
GPT-Realtime-2 は、音声UIを「会話」から実行ワークフローへ寄せる
OpenAI / 2026-05-07
52
作る前に確認したい
Responses API の組み込みツールは、Agent 実装の責任分界を変える
OpenAI / 2025-05-21
53
更新を追いたい
Gemini API の release notes は、仕様変更を追うための一次情報になる
Google AI for Developers / 2026-01-05
54
まず知りたい
Tiny Agents は、MCP 時代の agent 実装を小さく理解する入口になる
Hugging Face / 2025-04-25