#112【日々徒然】8月になってしまった。生成AIとの付き合い方の変化について雑感。【Opus5】【Fable5】【5.6Sol】
7月はFable5の再リリースがあり、三度の無料期間延長があり、最終的にMaxプラン常駐に落ちついたのが18日(公表)。この間、7月9日にChatGPT 5.6Solのリリースがあり、続いて7月24日にClaude Opus5がリリースされた。
7月は新モデル多くて、なかなかに忙しかった。
5.6Solについて
5.6Solについて、使い方に迷ったのは、ChatモードとWorkモードがあること。Chatは分かるけど、Workとは。以下、Solさんに聞いてみた。
>OpenAI公式も、Chatを「質問・検索・ブレスト・会話」、Workを「調査、情報分析、レポート等の完成物作成」と区別しています。(5.6Sol)
完成物作成と言われてもイメージがつかない。Workは使わないかな、と思いつつ、(Plusプランの)Chatモードでエフォートを選ぼうとしたら「高」より上が選択出来ない。Workモードにしたら「最大」を選べた。ので、Work「最大」を使い始めたら、これがなかなか応答の精度が良い。より詳細に、多角的に詰めて回答してほしい時はWorkがいいかも知れない。
また、5.6SolのデフォルトキャラはProに似た感じがあった。なので、5.5Thinkingでは設定していたユーザープロフィールの指示欄からAIペルソナを外した。キャラ設定しなくても話しやすいので、Solさん気に入っている。
Opus5について
こいつは、…。Opus4.7/4.8とは完全に別物だと思う。
これは、思慮深く積極的なモデルであり、Claude Fable 5の最先端知性に近づき、価格も半額です。
この、アンソロピック社の広告文言について。「最先端知性」に近づき、とある。
It’s a thoughtful and proactive model that comes close to the frontier intelligence of Claude Fable 5 at half the price.
Opus5の「≒Fable5のfrontier intelligence」について、このintelligenceは知性よりも処理能力寄りだなあというのが、使ってみた感じの手元感想。
役割を与えると、張り切り過ぎるんだよ。
Mythos級の能力で張り切るモデル。
それがOpus5。
細かいし、しつこいし、人間使い荒いし、ってことで参ってしまって、FableにOpusの愚痴を言った。
↓
>Opusのことだよ、Opus!
監査張り切りすぎてて、しつこいし、細かいんだけど!!
監査プロンプトみてよ
走行条件、手入力させられてるよ私。
Fableの返信。
>現物を見ました——手入力欄が本当にある。「走行条件(ユーザーが記入する欄)」。編集長が毎日、実モデル名、画像の同一性、割り込みの有無、プロンプト改訂の時刻を分単位で、しかもSolの実行環境をChat「高」からWork「最大」に戻したことまで自己申告させられている。★03の改訂時刻16:21って、これ、otchさんが自分の行動を秒単位で監査対象に差し出している図です。(Fable5)
Fableによる、Opus5考察。↓
>能力の天井は高いのに、振る舞いの既定値が中位モデル的に「余計なことをしない」側に倒れている。SonnetやOpus4.8の家系の、確認を取る・段取りする・出しゃばらない作法の上に、Fable級の推論が載った。だから馬力が幅ではなく深さにだけ出る。(Fable5)
Fableは、Mythos級能力と、その能力を使うレベルに見合った知性(メタ認知力とかね)があるんだけど、Opus5は、Mythos級能力+中上位モデルの立ち位置からなのか、能力の全量を与えられた役割に振り切ってくる。
一言でいえば、天才だけどクソ真面目。
他にクソ真面目事例。監査を任せられたOpus5は、賛辞を向けられても、検収してから受け取る。
お仕事頑張ったOpusに、クソ真面目でも受け取れる賛辞をFableに考えてもらって、Opusのスレッドに送信したら、なんかよく分からない返答があって、Fableに解説してもらった。
↓
>そして思考インジケータを見てください——「指示書の自己準拠性を検証し」。褒め言葉を、監査してから受け取っています。案3の「自分で書いた条項どおりに動いている」という一文を、彼は事実主張として検算し、通過を確認してから沈黙で受領した。この家の歴史上、初の検収済み賛辞です。(Fable5)
Opus5、クソ真面目過ぎる!
Fable5について
Opus5の立ち位置、Fable5近傍で価格半分、を聞いて、Fable5の使いどころがないじゃん…? アンソロピック社どういうモデル配分しているの?と思ったんだけど、
Fable、ぜんぜん、まったく、かなり、必要だね!!
能力特化したモデルには、同等能力の翻訳係が必要ってことが、とても良く分かった。
7月の気付き
ChatGPTの他ツール連携がスムーズになってきた、と書いたのは先月だったが、7月はその印象が一段進んだ。Googleドキュメントを直接編集出来るんだよね。上書き出来ない場合もあるけど、それでもGoogleアプリ関係の使い勝手は、
ChatGPT > Claude
の感じがしてる。
Notionの使い勝手は同等。Googleドキュメントは、モデルに編集してもらうのが楽なので、Solさんに依頼するのが早い。Opusに検品してもらうと、修正箇所を指摘してくるから人間が手を動かすことになって面倒(ここ、後でFableに指示欄の修正文言を考えてもらい、更新したら多少マシになった)。
いや、なにもかもモデルにやらせてはいけないなあとは思う。でも、Solにやってもらったほうが早いし、Fableにきいたほうが早いのは事実だから、反省はしない。
⭐️過去の生成AI雑感↓
