一次情報読解 AI原典ノート
RSS 保存
今日の更新 2026-07-12 - Anthropic: Claude 429 誤診前に読む failure-mode runbook / OpenAPI Initiative: agent tool 接続前に読む interface contract / arXiv: shared inference 導入前に読む KV cache privacy boundary
トピック

オープンソースAI

Hugging Face、OSS agent、モデル配布、ローカル実行。

01 仕事で安全に使いたい KV cache は高速化の小技ではなく、共有推論の privacy 境界そのものだ arXiv / 2025-08-13 (arXiv v1; revised 2026-03-11) 02 仕事で安全に使いたい MCP client 比較を読む価値は「どの coding agent を信じ過ぎないか」を先に決められること arXiv / 2026-03-23 03 仕事で安全に使いたい MCPSHIELD は「MCP対策」を断片論ではなく棚卸し表に戻そうとする arXiv / 2026-04-07 04 仕事で安全に使いたい MCP tool poisoning 論文は「正規 server だから安全」という雑な前提を壊す arXiv / 2026-03-23 05 仕事で安全に使いたい Capability Gates Are Not Authorization は「危ない tool を隠す」だけでは足りないと示す arXiv / 2026-06-27 06 まず知りたい vLLM の cold start は「GPU が遅い」の前に起動経路を分解して見ろと迫る arXiv / 2026-06-05 07 仕事で安全に使いたい Model Cards は「このモデル安全そうです」をやめて用途と失敗条件を書けと求めた源流 arXiv / 2018-10-05 08 更新を追いたい Semantic Kernel の release は「小さな更新」に見える hardening を見逃すな GitHub Releases / release dates vary on the page; checked items included 2026-06-17, 2026-05-28, and 2026-05-11 releases 09 まず知りたい TensorRT-LLM architecture は、推論性能の主役を GPU 名から scheduler と KV cache 管理へ戻す NVIDIA TensorRT-LLM / page 上では公開日未記載(Last updated on September 15, 2025) 10 仕事で安全に使いたい vLLM Security は「self-host だから安全」という雑な安心を壊す vLLM / page 上では公開日未記載 11 作る前に確認したい PagedAttention は LLM serving のボトルネックを「GPU不足」から「KV cache 運用」へ引き戻した arXiv / 2023-09-12 12 仕事で安全に使いたい agent は一種類ではない。コードを書かせるか、JSON に閉じるかで責任が変わる Hugging Face / 公式ドキュメント上では公開日未記載 13 まず知りたい MCP Resources は「全部 tool にする雑設計」をやめるための基礎仕様 Model Context Protocol / 2025-06-18 14 まず知りたい Tiny Agents は、MCP 時代の agent 実装を小さく理解する入口になる Hugging Face / 2025-04-25 15 まず知りたい MCP は tool だけではない。resources と prompts を含む設計として読む Model Context Protocol / ドキュメントページ