>>52

> 12月までに導入しないとEUの市場を捨てることになる
Claudeとは異なる手法で実装してもEUで商売できる(むしろClaudeは前のめりなので他は異なる実装をすると考えるのが自然)という話をしている

> 秘密鍵は無限にあるから、ツール公開はされるぞ
秘密鍵空間が膨大であることと、実際に使用している秘密鍵が特定されたときのリスクとは別問題なんだけど……
ていうか、48を読み返した感じだと秘密鍵を乱数の種かなんかと誤解してる? 暗号化解読のためのパスワードに相当するから、モデルごとにそんな何個も持たんわ

もちろん、漏洩リスクを減らす方法なんていくらでもあるけど、一般向けの検出器を公開してくれるというのは希望的観測

> 5千文字のなかに数千のレベルで埋め込まれるらしいから
実装に関する具体的な話も無いのに「5000文字の中に~」と断言できるソースはなんだって感じだけど、別に1個検出されたら即アウトなAIマークが挿入されるわけじゃないです……
仮に「5000文字の中に数千個」だとして、それらは独立して識別可能な存在ではなくて、数千個存在することによって生じる統計的な偏りによってはじめて識別可能になるんです
これらは例えば、漢字を開いたり句読点を調整したりするだけでボロボロ壊れていくんで、他のLLMを通すだけで識別不可能になる可能性は十分にあります

……てか、単独で識別可能なマークがその密度で存在したら手書きの文章にも偶然紛れ込むだろ
こちらが雑な説明で済ませた部分に踏み込んだから理解できてる人かと思って話進めたけど、読み返したら基礎の基礎から勘違いしまくりじゃんか

(※既存の LLM watermark を使う前提でレスしてるけど、別にそういう公式発表はないので、たぶんそうだろうと類推しているだけです)