本文へ移動
一次情報読解
AI原典ノート
記事
読み方
トピック
ソース
用語集
週刊
RSS
保存
夜間
週刊メール
今日の更新 2026-07-12 - Anthropic: Claude 429 誤診前に読む failure-mode runbook / OpenAPI Initiative: agent tool 接続前に読む interface contract / arXiv: shared inference 導入前に読む KV cache privacy boundary
トピック
オープンソースAI
Hugging Face、OSS agent、モデル配布、ローカル実行。
01
仕事で安全に使いたい
KV cache は高速化の小技ではなく、共有推論の privacy 境界そのものだ
arXiv / 2025-08-13 (arXiv v1; revised 2026-03-11)
02
仕事で安全に使いたい
MCP client 比較を読む価値は「どの coding agent を信じ過ぎないか」を先に決められること
arXiv / 2026-03-23
03
仕事で安全に使いたい
MCPSHIELD は「MCP対策」を断片論ではなく棚卸し表に戻そうとする
arXiv / 2026-04-07
04
仕事で安全に使いたい
MCP tool poisoning 論文は「正規 server だから安全」という雑な前提を壊す
arXiv / 2026-03-23
05
仕事で安全に使いたい
Capability Gates Are Not Authorization は「危ない tool を隠す」だけでは足りないと示す
arXiv / 2026-06-27
06
まず知りたい
vLLM の cold start は「GPU が遅い」の前に起動経路を分解して見ろと迫る
arXiv / 2026-06-05
07
仕事で安全に使いたい
Model Cards は「このモデル安全そうです」をやめて用途と失敗条件を書けと求めた源流
arXiv / 2018-10-05
08
更新を追いたい
Semantic Kernel の release は「小さな更新」に見える hardening を見逃すな
GitHub Releases / release dates vary on the page; checked items included 2026-06-17, 2026-05-28, and 2026-05-11 releases
09
まず知りたい
TensorRT-LLM architecture は、推論性能の主役を GPU 名から scheduler と KV cache 管理へ戻す
NVIDIA TensorRT-LLM / page 上では公開日未記載(Last updated on September 15, 2025)
10
仕事で安全に使いたい
vLLM Security は「self-host だから安全」という雑な安心を壊す
vLLM / page 上では公開日未記載
11
作る前に確認したい
PagedAttention は LLM serving のボトルネックを「GPU不足」から「KV cache 運用」へ引き戻した
arXiv / 2023-09-12
12
仕事で安全に使いたい
agent は一種類ではない。コードを書かせるか、JSON に閉じるかで責任が変わる
Hugging Face / 公式ドキュメント上では公開日未記載
13
まず知りたい
MCP Resources は「全部 tool にする雑設計」をやめるための基礎仕様
Model Context Protocol / 2025-06-18
14
まず知りたい
Tiny Agents は、MCP 時代の agent 実装を小さく理解する入口になる
Hugging Face / 2025-04-25
15
まず知りたい
MCP は tool だけではない。resources と prompts を含む設計として読む
Model Context Protocol / ドキュメントページ