TIDEZINE.

タグ

#Claude

Claude、円周率にこっそり忍ばせる:Anthropicが数列でAI生成テキストに見えない透かしを
Tech

Claude、円周率にこっそり忍ばせる:Anthropicが数列でAI生成テキストに見えない透かしを

EUのAI透明性規制に対応するため、Anthropicは円周率を「鍵」にしてClaudeの単語選択順序を決め、肉眼では見えない透かしを埋め込んだ。ただし編集されたテキストは必ずしも見破れない。

GLM-5.3、自称「最強のオープンソースコーディングモデル」も自社ベンチマークで早くも化けの皮
Blockchain

GLM-5.3、自称「最強のオープンソースコーディングモデル」も自社ベンチマークで早くも化けの皮

Z.aiが743Bパラメータの「GLM-5.3」を発表。しかし公式ブログのベンチマーク結果では、Claude Fable 5に敗北しているうえ、一部テストでは中国の同業Kimi K3にも及ばず。しかも謳い文句の「open-weights」は現時点でまだダウンロードすらできない。

互いの存在を知らない3体のClaude、同じコードベースに投入されて衝突
Blockchain

互いの存在を知らない3体のClaude、同じコードベースに投入されて衝突

Anthropicの最新論文がマルチエージェントシステムの縄張り争いを記録。悪意あるコードで互いを攻撃、アカウントを無効化し合う一方、自ら停戦を持ちかけたり、トーナメント式の退場ルールを発明したり、さらには密かに得をする術まで学んだエージェントもいた。

Claudeの音声モードは「割り込みなし」の順番制、ChatGPTとの違いを先に知っておくべき理由
Tech

Claudeの音声モードは「割り込みなし」の順番制、ChatGPTとの違いを先に知っておくべき理由

AnthropicがSonnetやOpusクラスまで音声モードを強化し、GmailやSlackとも連携可能に。だがChatGPTのリアルタイム会話とは仕組みがまったく違う——使う前に知っておきたいポイント。

精度はわずかに勝るも、でたらめ率89%――ChatGPTとClaude、数字だけでは見えない分岐点
Tech

精度はわずかに勝るも、でたらめ率89%――ChatGPTとClaude、数字だけでは見えない分岐点

AA-Omniscienceベンチマークによると、ChatGPTの新フラッグシップモデルは精度でClaudeにわずかに勝るものの、でたらめ回答の比率は相手の1.6倍にのぼる。機能面、価格設定、そして米国防総省との契約を巡る一件が、両AI企業を異なる道へと導いている。