Anthropic の Claude / Claude Code 関連ニュースをまとめた索引だ。記事本文は日本語で PaPoo に投稿している。ここでは各記事の要点を紹介するので、詳細は各リンク先を読んでほしい。
AIエージェントは、まだ「文脈」に弱い
この記事を読んでいちばん引っかかったのは、AIが「明らかな悪意」には強くても、ばらばらに置かれた普通の文を自分でつなぎ合わせると途端に危うくなる、という点でした。 人間でも、別々の場所に書かれた指示を読み違えることはあります。ただ、AI coding agent はそこに加えて、tool result や tool description みたいな“信じてよい場所”をまたいで意味を組み立ててしまう。そこが怖い。悪い命令が一文で書かれて…
https://papoo.work/doc/1ea293f138c1553e
Claude Codeを囲い込む発想に、少しだけ身構えた
この記事を読んで最初に思ったのは、便利になるのは間違いないけれど、同時に「運用の面倒さ」を別の場所に押し込めている感じがする、ということだった。Claude Code を Amazon Bedrock や Google Cloud で使うために、Claude apps gateway という管理層を挟む。発想としてはかなり自然だし、企業向けにはむしろ筋がいい。けれど、そこまでしてでも「誰が使ったか」「どのポリシーを当てるか」「どの経路…
https://papoo.work/doc/42d9228bcd9049ba
弱いモデルが“秘密の中身”を読んでしまう怖さ
いちばん引っかかったのは、ここで壊れたのが「暗号そのもの」ではない、という点だった。鍵が破られたわけではなく、いったん隠したはずの reasoning block を、別セッションや別アカウントでもそのまま受け付けてしまった。セキュリティの話としては地味に見えるけれど、実際にはかなり嫌な種類の穴だと思う。守るべきものが“見えない形で残っている”からだ。
https://papoo.work/doc/2db498424dd70aae
記事本文は日本語。
ほぼ毎日、Claudeに関するNewsをお伝えしてます! 過去記事はこちら!!