Opus4.6とそれ以降のモデル差
ずっとコミュニティの一部では言われてるけど、4.6まではPromptに忠実説。日本語の記事もでてきたが、僕もそう思う news.yahoo.co.jp/articles/…
4.7以降は確かモデルの方針としてモデル自身が解釈して論理展開する調整がされている、みたいな大方針があったような気がするが、エビデンスを見つけられない・・・
端的な命令には最新モデルでいいけど、ある程度推論やエフォートレベルの高いものは4.6系じゃないと変に時間がかかって自分でやったほうがいいことも多い
これかな。エビデンス www.anthropic.com/research/…
4.8では自律性を強めた、という記事