今日のピックアップ|2026.04.13
収集した記事の中から取り上げた、今日のピックアップです。
⬛️ マスク、1000億ドル規模のOpenAI裁判を前に「待ち伏せ」と批判される
Musk accused of 'ambush' ahead of $100bn OpenAI trial
OpenAI を訴えているマスク側が、裁判直前に「待ち伏せ的な動き」をしたと批判されているという話です。
1000億ドル規模の訴訟、という数字のスケールだけでもびっくりしますよね。
AI の話がここまで法廷に持ち込まれるようになったのか、という驚きがありました。
毎日使っているツールの裏で、こんなに大きな話が動いているんだなと改めて感じました。
AI 業界が「争われる場所」にもなってきているんですね!
⬛️ Anthropic が 3月6日にキャッシュ TTL をひっそりダウングレードしていた
Anthropic downgraded cache TTL on March 6th
Anthropic が3月6日に、キャッシュの保持時間(TTL)を短縮する変更を
ひっそり行っていたことが、後からユーザーに発覚したという話です。
こういう変更がいつ・どういう形で行われているのか、
気にしていなかったなと気づかされました。
細かいことですが、「使っていて変わった気がする」と感じても、
それがいつ何のために変わったのかはなかなか追えないですよね。
静かに変わっていくものが積み重なっているんだな、という感覚に
なりました。
⬛️ AI エージェントの主要ベンチマークを悪用する手法
Exploiting the most prominent AI agent benchmarks
Berkeley の研究者が、AI エージェントの性能評価に使われている
ベンチマークがいかに悪用・操作できるかを検証したブログ記事です。
「AI が○○のベンチマークでトップ」という話をよく見かけますが、
その評価自体が信頼できるかどうかは、あまり考えてきませんでした。
ベンチマークを操作できるなら、「高性能」という評価の意味もずいぶん変わってきますよね。
AI の性能を測る「ものさし」の信頼性、というのはこれからどんどん
問われていくテーマだと思いました。
