見出し画像

今日のピックアップ|2026.04.13

収集した記事の中から取り上げた、今日のピックアップです。


⬛️  マスク、1000億ドル規模のOpenAI裁判を前に「待ち伏せ」と批判される

Musk accused of 'ambush' ahead of $100bn OpenAI trial

OpenAI を訴えているマスク側が、裁判直前に「待ち伏せ的な動き」をしたと批判されているという話です。

1000億ドル規模の訴訟、という数字のスケールだけでもびっくりしますよね。

AI の話がここまで法廷に持ち込まれるようになったのか、という驚きがありました。

毎日使っているツールの裏で、こんなに大きな話が動いているんだなと改めて感じました。

AI 業界が「争われる場所」にもなってきているんですね!


⬛️  Anthropic が 3月6日にキャッシュ TTL をひっそりダウングレードしていた

Anthropic downgraded cache TTL on March 6th

Anthropic が3月6日に、キャッシュの保持時間(TTL)を短縮する変更を
ひっそり行っていたことが、後からユーザーに発覚したという話です。

こういう変更がいつ・どういう形で行われているのか、
気にしていなかったなと気づかされました。

細かいことですが、「使っていて変わった気がする」と感じても、
それがいつ何のために変わったのかはなかなか追えないですよね。

静かに変わっていくものが積み重なっているんだな、という感覚に
なりました。


⬛️  AI エージェントの主要ベンチマークを悪用する手法

Exploiting the most prominent AI agent benchmarks

Berkeley の研究者が、AI エージェントの性能評価に使われている
ベンチマークがいかに悪用・操作できるかを検証したブログ記事です。

「AI が○○のベンチマークでトップ」という話をよく見かけますが、
その評価自体が信頼できるかどうかは、あまり考えてきませんでした。

ベンチマークを操作できるなら、「高性能」という評価の意味もずいぶん変わってきますよね。

AI の性能を測る「ものさし」の信頼性、というのはこれからどんどん
問われていくテーマだと思いました。




サイトマップはこちらから ↓