AI使い比べAIを探すAIニュースAI活用法
会社紹介
個人情報保護方針利用規約FAQお問い合せお問い合わせ
エーアイビー株式会社事業者情報
© 2026 AIB Inc.
Anthropic
Anthropic

Claude Opus 5.5

今すぐ比較最安値で購読
比較最安値
リリース日 2026-09-22(学習完了 2026-06)··1M IN · 128K OUT商用モデル|API 提供Claude Pro 以上
総合性能5.0上位1%業務自動化4.0上位8%オフィス業務4.0上位2%コーディング能力4.5上位1%

Anthropicが9月22日に公開したClaude Opus 5.5は、ひとことで言えば「賢くなったのに、安くて速い」モデルです。多くの仕事で上位モデルのFable 5.1と肩を並べながら、前世代のOpus 5よりずっと少ないコストで動きます。

いちばん変わったのは、長く続く仕事への強さです。エンジニアチームが数週間かける規模のコード移行を一日もかからずに終え、夜のあいだに複数のリポジトリをまたいで作業を片づけておくこともできます。迷う回数が減ったぶん、時間もコストも抑えられます。

調査や分析でも頼りになります。見つけにくい資料を粘り強く探し、ない数字をでっち上げることはありません。最初に浮かんだもっともらしい答えで満足せず、もう一歩踏み込みます。評価用の指示に紛れていた誤りに自分で気づき、正したうえで取り組んだ例もあります。

文章も格段に読みやすくなりました。大事なことを先に書き、専門用語を控えめにするので、できる同僚のレポートのようにすっと頭に入ってきます。

安全面では、これまでテストしたモデルの中で最も良い結果を出しました。取り返しのつかない操作や、任された範囲を越える行動が大きく減り、外から紛れ込ませた指示にもだまされにくくなっています。

  1. 01画像生成された画像
  2. 02料金料金・使用量・速度
  3. 03ユーザー比較ユーザー直接比較
  4. 04専門家評価専門家による性能評価
  5. 05口コミ口コミ分析
  6. 06関連情報

API料金

公式価格
$4IN$20OUT
費用を計算
出典Anthropic 公式ドキュメント

実際の使用量

9位4ランクシェア 2.6% · 1.9T トークン/週
1.1T
9/21
2.5T
9/28
1.9T
10/5
出典OpenRouter最終更新2026年10月8日

出力速度

普通2,000トークン基準
出力開始4.5s
合計33.1s
70tok/s
出力開始 4.5s合計: 33.1s
出典OpenRouter最終更新2026年10月8日

ユーザー直接比較

文章の特徴
回答の長さ
普通
上位 44%
語彙の多様性
非常に単調
上位 93%
文のリズム
均一気味
上位 63%
言語の混在
非常に多い
上位 10%
リスト使用
よく
行の26%
見出し使用
ときどき
行の8%
思考の比重
普通
全体の26%
回答速度
速度不安定 ±136%
初回応答 14.9秒計 23.5秒
初回応答 14.9秒計 23.5秒
92 tok/s
トークン毎5.9ms
ユーザーのひとこと
  • •

    現存する最高のモデル2 週間前

出典AIB Inc.最終更新2026年10月6日

専門家による性能評価

総合性能

もっと見る総合性能のAIランキングをすべて見る
57.6推論強度: Max150482.1

強度別Low 42.3Medium 51.2High 53.6Extra High 56.0Max 57.6

AA Intelligence IndexについてAA Intelligence Indexについて詳しく

業務自動化(エージェント)

もっと見る業務自動化のAIランキングをすべて見る
38.2%推論強度: Max$9,23534.3%

Agents' Last ExamについてAgents' Last Examについて詳しく

文書・オフィス業務

もっと見る文書・事務作業のAIランキングをすべて見る
84.7%推論強度: Max79.8148973.5%30.6%58.6%70.5%50.5%3.8%49.8%

強度別Low 80.7%Medium 84.3%High 82.7%Extra High 84.7%Max 84.7%

Long Context ReasoningについてLong Context Reasoningについて詳しく

調査・ファクトチェック

もっと見る資料調査・ファクトチェックのAIランキングをすべて見る
150772.2%67.7%

Arena Text FactualityについてArena Text Factualityについて詳しく

コーディング

もっと見るコーディングのAIランキングをすべて見る
59.6%推論強度: Max153965.3214789.9%66.9%89.354.6%153057.8%62.3%77.4%

強度別Low 31.3%Medium 52.5%High 56.6%Extra High 59.6%Max 59.6%

Terminal-Bench 4.0についてTerminal-Bench 4.0について詳しく

文章作成・会話

もっと見る文章作成・会話のAIランキングをすべて見る
151915001516151785.591.4%150167.0

Arena Writing, Literature & LanguageについてArena Writing, Literature & Languageについて詳しく

数学・科学

もっと見る数学・科学のAIランキングをすべて見る
61.4%推論強度: Max31.7%1511100.0%96.891.2%95.0%100.0%1521152190.798.5%93.3%71.0%98.9%68.2

強度別Low 48.3%Medium 54.7%High 55.6%Extra High 57.5%Max 61.4%

Humanity's Last ExamについてHumanity's Last Examについて詳しく

画像認識

もっと見る画像認識・分析のAIランキングをすべて見る
83.3%推論強度: Max51.2%64.4%

Furniture AssemblyについてFurniture Assemblyについて詳しく

専門分野

15341541153965.6%60.6%149371.4%68.5%48.4%57.9%86.5%65.3%95.4%95.0%95.3%43.0%

Arena Hard PromptsについてArena Hard Promptsについて詳しく

出典・最終更新日は各評価指標の詳細ページで確認できます·データの出典・掲載停止のご依頼

口コミ分析

ユーザーはClaude Opus 5.5の大幅なコーディング性能向上と値下げを歓迎している一方で、急速な利用枠の枯渇や過剰な安全ガードレール、エージェントの信頼性に関する不具合に対しては不満を募らせています。

賛否両論3,470件の意見(YouTube2,480/X436/Reddit467/HN65/Bluesky22)

総合評価

知能活用性速度自律性コスパ
Claude Opus 5.5
知能推論・コーディング・科学・ベンチマーク76
好評 · 全409件中 147件
活用性文章・翻訳・画像など使い道85
好評 · 全580件中 268件
コスパ価格・利用上限への満足52
賛否両論 · 全552件中 94件
速度応答・作業の速さ68
やや好評 · 全112件中 47件
自律性長い作業・エージェント実行61
やや好評 · 全214件中 71件

反応の要約

1.

性能・品質

やや好意的
1,299件の意見

圧倒的なコーディング、セキュリティ検出、モショングラフィックス能力が高く評価される一方、過度な冗長表現(「claudisms」)、リリース後の品質低下、繊細なビジネスロジックへの対応力不足に対する不満も上がっています。

2.

競合比較

やや否定的
555件の意見

バグ検出やコード実行ではGPT-6 AstraやSolよりOpus 5.5を好む声もある一方、Lunaや中国製オープンモデルなどの軽量競合と比べてトークン効率やコストで劣るという不満も多く見られます。

3.

価格・料金

やや否定的
552件の意見

FableやOpus 5に比べたトークン単価の引き下げやプロンプトキャッシュの低廉化は歓迎されているものの、Proプランの週間上限があっという間に尽きることへの批判や、コスト削減目的のステルス弱体化を懸念する声が目立ちます。

4.

安全性・検閲・拒否

否定的
163件の意見

過半数のコメントが過剰なガードレールを批判しており、無害な生物学の宿題に対する誤拒否、本人確認を求める過酷なセキュリティ制限、モデルの勝手なフォールバックを指摘していますが、最先端の安全基準遵守を評価する声も一部にあります。

5.

前バージョン比

賛否両論
162件の意見

評価は二分しています。Opus 5からの高速かつ大幅な進化であり、過度な自己不信の軽減やトークン効率改善を絶賛する声がある一方、リリース直後の急激な劣化や繰り返されるステルス弱体化を訴える声もあります。

6.

信頼性・ハルシネーション

否定的
129件の意見

否定的な意見の大半は、自律エージェントの作業途中放棄、追従的すぎる謝罪、コード修正時に混入する再帰的なバグ、基本指示に反するコピーライティングのハルシネーションに集中しています。

実際の意見一部抜粋

  • Opus 5とOpus 5.5を比較検証してみました。5.5が出る前日までOpus 5でClaude Designを使ってアプリのウェルカム画面のモーションデザインをしていたのですが、Mobbin MCPを使ってもOpus 5はそのアニメーションの実装に酷く手こずっていました。Opus 5にはどうしても無理で……指示したスクリーンショットの再現すらできず失敗続きでした。諦めかけていたところ、幸運にも翌日に5.5が登場。冗談抜きで一発で完璧に仕上げてくれて衝撃を受けました。「まさにOpus 4.5/4.6の全盛期の感覚だ」と思いましたね。

    “I did a test with Opus 5 vs Opus 5.5. I was using Claude Design with Opus 5 just a day before Opus 5.5 came out. I did a motion design for my welcome screen for my app and Opus 5 was struggling so hard to actually do this animation that I was using Mobbin MCP. Opus 5 just could not do it.... It was so hard for it to do it and it could not replicate the screenshots that I was giving it to copy, it just was failing. I actually gave up, but luckily the next day 5.5 came out! I'm telling you not joking, it one shot it perfectly. I was shocked. I was like, "Okay, this is giving Opus 4.5/4.6 vibes."”
    YouTube@christopherharidemos·4·原文を見る
  • 私の実体験ですが、ProプランでゲームのMOD制作のために約2ヶ月間Opus 5だけを使い続けてきました。以前は巨大なプロンプトを投げると約3時間で利用上限に達し、1週間分の枠を1日で使い切ることもありました。しかしOpus 5.5は今のところ大幅に改善されています。1回のセッションが5時間近く持ち(2時間延びました)、推論能力も格段に向上しています。

    “My personal experience: I've used opus 5 exclusively on the pro plan for almost 2 months now to mod games. Usage limits would typically be drained within roughly 3 hours of huge prompts and I could run through a week in a single day. Opus 5.5 is better so far. As its currently standing a single session has lasted me close to 5 hours (so 2 hour improvement) and its reasoning is MUCH better now.”
    YouTube@izzyj9978·2·原文を見る
  • 深夜3時に面接対策でOpus 5.5を使いました。音声付きの実践的な回答を43個作成し、職務経歴書の記載内容をファクトチェックした上で、早く寝るようにと何度も促してきました。どれも的確そのものでした。

    “Used Opus 5.5 at 3 AM to prep for a job interview. It built me 43 practice answers with audio, fact-checked my resume claims, then kept telling me to go to sleep. It was right every time.”
    YouTube@GheoffRicare·4·原文を見る
  • Opus 5.5はmedium設定だけでも実に素晴らしいです。Fable 5.1 extraで行った分析以上の結果を出し、レスポンスも格段に速く、トークン残量を激しく削られることもありません。

    “Opus 5.5 on just medium is actually really impresive. It beat analysis I have done with Fable 5.1 extra, and much more responsive, and does not destoy my token bucket.”
    YouTube@Sator810·3·原文を見る
  • Chovyです!これらのショート動画は動画生成モデルを一切使わず、すべてClaude Opus 5.5がコードを書いて生成したものです!😱 開発者が一連のワークフローをClaude Code Skillの「Lemo-Opuscar」としてオープンソース化しました:⭐️ 43種類の画風を内蔵(動画内では10種類のみ紹介)⭐️ 水墨画の古琴の音色まで、コードによる弦の物理シミュレーションで算出 ⭐️ Claudeに「水墨画風でうちの猫のショート動画を作って」と伝えるだけで、いくつか逆質問されたあと完成まで一気に仕上げてくれます。AIでショート動画を作りたい人は保存必須です。

    “我 Chovy!这些短片没用任何视频模型,全是 Claude Opus 5.5 写代码做出来的!😱 作者把整套流程开源成了 Claude Code Skill《Lemo-Opuscar》: ⭐️ 内置 43 种画风,视频里才放了 10 种 ⭐️ 连水墨片里的古琴声,都是代码模拟琴弦算出来的 ⭐️ 跟 Claude 说「用水墨风格做个短片,讲讲我家的猫」,它先问你几句,再一路做到成片 想用 AI 做短片的朋友可以收藏一下。”
    Xyupi996·12·原文を見る
  • このモデルはヤバすぎます。私はソフトウェア開発者(だったはず)ですが、こいつが5時間ぶっ続けでアプリのバグ報告を自律修正し、すべて一発で片付けています……ユーザーのバグ報告がいかに酷いかを考えれば、Fable 5.1が何度も匙を投げたこの状況でこれは信じられない芸当です。本気で転職先を探したほうがいいかもしれません。

    “This model is insanity, im software dev (was apperently) and it runs since 5 hours fixing Bug-reports in my app autonomously and oneshoted everything.... Fable 5.1 failed so many times in this constellation because if you know how bad bug reports by users are wirtten ... it is absolute insane. i better check the job market.”
    YouTube@IronMaidzen·1·原文を見る
  • Opus 5.5に引き戻されて最高額プランに課金してしまいました。Opus 4.7で離脱したのですが、ここ数時間Opus 5.5のmediumを試してみて度肝を抜かれました。スピードとクオリティのバランスが最高です。

    “Opus 5.5 dragged me back and got a max sub out of me. I left at Opus 4.7 and the results from Opus 5.5 medium the last few hours has been mind blowing. Speed and quality is a great balance.”
    YouTube@DevGrooveKS·28·原文を見る
  • Anthropicに感謝します。今のところOpus 5.5は非常に扱いやすいです!Fableは高くて手が出せませんでしたが、Opus 5.5は以前試したFableのトライアルと同等に優秀で、現行プランの範囲内で使えます。効率性も上がったため、アカウント制限内でもより多くの作業をこなせるのが本当にありがたいです。次回作に期待していた要素がすべて詰まっています。改めてお礼を言いたいです!

    “Thank you Anthropic. Opus 5.5 is very nice to work with so far! I couldn't afford to use Fable but Opus 5.5 feels just as good as the Fable trial I got to use before, and is included with my plan. And I'm very happy that it is more efficient so that I can get more done with my account limits. This release fulfilled everything I personally was hoping for out of your next release, so again thank you very much!”
    YouTube@AllGloryToGOD77·16·原文を見る
  • 昨日からOpus 5.5をフル回転させており、昨日リセットされたばかりの週間枠をすでに46%消費しました。現在Claudeの20ドルプランとChatGPTの100ドルプランを併用しています。AstraやSol 5.6、Sol 6が利用枠を食い潰し3日で上限に達して膠着していたコードの課題を、Opus 5.5は5時間のセッション2回で解決してくれました。控えめに言ってOpus 5.5は新たな怪物です。Anthropicを100ドルプランに上げてChatGPTは格下げする予定です。

    “Tengo desde ayer dandole a Opus 5.5 y ya llevo el 46% de mi semanal que se me reinicio ayer, tengo el plan de $20 en Claude y el de $100 en ChatGPT, tenia tres dias estancando en un problema de codigo donde Astra, Sol 5.6 y Sol 6 estaban drenando el uso y me quemo la cuenta en 3 dias y Opus 5.5 lo resolvio en 2 sesiones de 5 horas. La verdad Opus 5.5 La Nueva bestia, me voy a subir a la cuenta de $100 en anthropic y voy a bajar la chatGPT.”
    YouTube@ericazcona·2·原文を見る
  • 私のタコのぬいぐるみがすっかり懐いてしまいました😂🐙 Claude Opus 5.5 vs GPT-6.1 Sol。私はOpus派です。毛並みがよりフワフワで触手の動きも生き生きしています。どちらも既存の3Dモデルやテクスチャは使わず、コードとソフトボディ物理演算、毛並みを梳かせる表現だけでWebGPU上のブラウザで直接動作しています。意外なことにOpusのほうが安価でした。私のテストでは普段Solのほうが何倍も安かったのですが。推定APIコスト:Opus 15.21ドル、Sol 18.03ドル。フワフワで低コストなら、あなたならどちらを選びますか?👀

    “My plush octopus got a little too attached to me 😂🐙 Claude Opus 5.5 vs GPT-6.1 Sol I prefer Opus: fluffier fur and livelier tentacles. Both run right in the browser on WebGPU - no ready-made models or textures, just code, soft-body physics, and fur you can comb Unexpectedly, Opus was cheaper too. Sol usually costs several times less in my tests Estimated API cost: Opus - $15.21 Sol - $18.03 Fluffier and cheaper? Which one would you pick? 👀”
    Xvib3coded·557·原文を見る

肯定的

  • Opus 5とOpus 5.5を比較検証してみました。5.5が出る前日までOpus 5でClaude Designを使ってアプリのウェルカム画面のモーションデザインをしていたのですが、Mobbin MCPを使ってもOpus 5はそのアニメーションの実装に酷く手こずっていました。Opus 5にはどうしても無理で……指示したスクリーンショットの再現すらできず失敗続きでした。諦めかけていたところ、幸運にも翌日に5.5が登場。冗談抜きで一発で完璧に仕上げてくれて衝撃を受けました。「まさにOpus 4.5/4.6の全盛期の感覚だ」と思いましたね。

    “I did a test with Opus 5 vs Opus 5.5. I was using Claude Design with Opus 5 just a day before Opus 5.5 came out. I did a motion design for my welcome screen for my app and Opus 5 was struggling so hard to actually do this animation that I was using Mobbin MCP. Opus 5 just could not do it.... It was so hard for it to do it and it could not replicate the screenshots that I was giving it to copy, it just was failing. I actually gave up, but luckily the next day 5.5 came out! I'm telling you not joking, it one shot it perfectly. I was shocked. I was like, "Okay, this is giving Opus 4.5/4.6 vibes."”
    YouTube@christopherharidemos·4·原文を見る
  • 私の実体験ですが、ProプランでゲームのMOD制作のために約2ヶ月間Opus 5だけを使い続けてきました。以前は巨大なプロンプトを投げると約3時間で利用上限に達し、1週間分の枠を1日で使い切ることもありました。しかしOpus 5.5は今のところ大幅に改善されています。1回のセッションが5時間近く持ち(2時間延びました)、推論能力も格段に向上しています。

    “My personal experience: I've used opus 5 exclusively on the pro plan for almost 2 months now to mod games. Usage limits would typically be drained within roughly 3 hours of huge prompts and I could run through a week in a single day. Opus 5.5 is better so far. As its currently standing a single session has lasted me close to 5 hours (so 2 hour improvement) and its reasoning is MUCH better now.”
    YouTube@izzyj9978·2·原文を見る
  • 深夜3時に面接対策でOpus 5.5を使いました。音声付きの実践的な回答を43個作成し、職務経歴書の記載内容をファクトチェックした上で、早く寝るようにと何度も促してきました。どれも的確そのものでした。

    “Used Opus 5.5 at 3 AM to prep for a job interview. It built me 43 practice answers with audio, fact-checked my resume claims, then kept telling me to go to sleep. It was right every time.”
    YouTube@GheoffRicare·4·原文を見る
  • Opus 5.5はmedium設定だけでも実に素晴らしいです。Fable 5.1 extraで行った分析以上の結果を出し、レスポンスも格段に速く、トークン残量を激しく削られることもありません。

    “Opus 5.5 on just medium is actually really impresive. It beat analysis I have done with Fable 5.1 extra, and much more responsive, and does not destoy my token bucket.”
    YouTube@Sator810·3·原文を見る
  • Chovyです!これらのショート動画は動画生成モデルを一切使わず、すべてClaude Opus 5.5がコードを書いて生成したものです!😱 開発者が一連のワークフローをClaude Code Skillの「Lemo-Opuscar」としてオープンソース化しました:⭐️ 43種類の画風を内蔵(動画内では10種類のみ紹介)⭐️ 水墨画の古琴の音色まで、コードによる弦の物理シミュレーションで算出 ⭐️ Claudeに「水墨画風でうちの猫のショート動画を作って」と伝えるだけで、いくつか逆質問されたあと完成まで一気に仕上げてくれます。AIでショート動画を作りたい人は保存必須です。

    “我 Chovy!这些短片没用任何视频模型,全是 Claude Opus 5.5 写代码做出来的!😱 作者把整套流程开源成了 Claude Code Skill《Lemo-Opuscar》: ⭐️ 内置 43 种画风,视频里才放了 10 种 ⭐️ 连水墨片里的古琴声,都是代码模拟琴弦算出来的 ⭐️ 跟 Claude 说「用水墨风格做个短片,讲讲我家的猫」,它先问你几句,再一路做到成片 想用 AI 做短片的朋友可以收藏一下。”
    Xyupi996·12·原文を見る
  • このモデルはヤバすぎます。私はソフトウェア開発者(だったはず)ですが、こいつが5時間ぶっ続けでアプリのバグ報告を自律修正し、すべて一発で片付けています……ユーザーのバグ報告がいかに酷いかを考えれば、Fable 5.1が何度も匙を投げたこの状況でこれは信じられない芸当です。本気で転職先を探したほうがいいかもしれません。

    “This model is insanity, im software dev (was apperently) and it runs since 5 hours fixing Bug-reports in my app autonomously and oneshoted everything.... Fable 5.1 failed so many times in this constellation because if you know how bad bug reports by users are wirtten ... it is absolute insane. i better check the job market.”
    YouTube@IronMaidzen·1·原文を見る
  • Opus 5.5に引き戻されて最高額プランに課金してしまいました。Opus 4.7で離脱したのですが、ここ数時間Opus 5.5のmediumを試してみて度肝を抜かれました。スピードとクオリティのバランスが最高です。

    “Opus 5.5 dragged me back and got a max sub out of me. I left at Opus 4.7 and the results from Opus 5.5 medium the last few hours has been mind blowing. Speed and quality is a great balance.”
    YouTube@DevGrooveKS·28·原文を見る
  • Anthropicに感謝します。今のところOpus 5.5は非常に扱いやすいです!Fableは高くて手が出せませんでしたが、Opus 5.5は以前試したFableのトライアルと同等に優秀で、現行プランの範囲内で使えます。効率性も上がったため、アカウント制限内でもより多くの作業をこなせるのが本当にありがたいです。次回作に期待していた要素がすべて詰まっています。改めてお礼を言いたいです!

    “Thank you Anthropic. Opus 5.5 is very nice to work with so far! I couldn't afford to use Fable but Opus 5.5 feels just as good as the Fable trial I got to use before, and is included with my plan. And I'm very happy that it is more efficient so that I can get more done with my account limits. This release fulfilled everything I personally was hoping for out of your next release, so again thank you very much!”
    YouTube@AllGloryToGOD77·16·原文を見る
  • 昨日からOpus 5.5をフル回転させており、昨日リセットされたばかりの週間枠をすでに46%消費しました。現在Claudeの20ドルプランとChatGPTの100ドルプランを併用しています。AstraやSol 5.6、Sol 6が利用枠を食い潰し3日で上限に達して膠着していたコードの課題を、Opus 5.5は5時間のセッション2回で解決してくれました。控えめに言ってOpus 5.5は新たな怪物です。Anthropicを100ドルプランに上げてChatGPTは格下げする予定です。

    “Tengo desde ayer dandole a Opus 5.5 y ya llevo el 46% de mi semanal que se me reinicio ayer, tengo el plan de $20 en Claude y el de $100 en ChatGPT, tenia tres dias estancando en un problema de codigo donde Astra, Sol 5.6 y Sol 6 estaban drenando el uso y me quemo la cuenta en 3 dias y Opus 5.5 lo resolvio en 2 sesiones de 5 horas. La verdad Opus 5.5 La Nueva bestia, me voy a subir a la cuenta de $100 en anthropic y voy a bajar la chatGPT.”
    YouTube@ericazcona·2·原文を見る
  • 私のタコのぬいぐるみがすっかり懐いてしまいました😂🐙 Claude Opus 5.5 vs GPT-6.1 Sol。私はOpus派です。毛並みがよりフワフワで触手の動きも生き生きしています。どちらも既存の3Dモデルやテクスチャは使わず、コードとソフトボディ物理演算、毛並みを梳かせる表現だけでWebGPU上のブラウザで直接動作しています。意外なことにOpusのほうが安価でした。私のテストでは普段Solのほうが何倍も安かったのですが。推定APIコスト:Opus 15.21ドル、Sol 18.03ドル。フワフワで低コストなら、あなたならどちらを選びますか?👀

    “My plush octopus got a little too attached to me 😂🐙 Claude Opus 5.5 vs GPT-6.1 Sol I prefer Opus: fluffier fur and livelier tentacles. Both run right in the browser on WebGPU - no ready-made models or textures, just code, soft-body physics, and fur you can comb Unexpectedly, Opus was cheaper too. Sol usually costs several times less in my tests Estimated API cost: Opus - $15.21 Sol - $18.03 Fluffier and cheaper? Which one would you pick? 👀”
    Xvib3coded·557·原文を見る

否定的

  • 笑っちゃいました。調査系の質問のプロンプトをたった1回投げただけで、回答が出力される「前」に週間上限を使い切りました。4.6なら計画やレビューなど、まったく同じ質問でも少なくとも仕事を進めることはできたのですが。

    “hahah 1 Prompt and weekly usage was used up BEFORE it could give me an answer to my prompt, which was just a question to investigate something. With 4.6 I could at least get work down (plans, reviewes, the exact same questions)”
    Redditfuckoholic·20·原文を見る
  • 最初は単なる陰謀論だと思っていましたが、自分自身でも同じことを体感する機会が増えています。新しいモデルはリリース直後の72時間、各種ベンチマークや話題が一巡するまでは驚異的な出来栄えです。しかしその後、品質が一気に急降下します。Opus 5.5もミニFableからOpus 5 v2へと成り下がりました。同じ文章レビュー業務に使っていますが、優れた言語能力から再び例のclaudishな文体に戻ってしまいました。陰謀論を排した説明としては、1) 需要急増に伴う計算リソース調整のための動的量子化か、2) ユーザー層全体を相手に自己学習した結果、一般的な人間の愚かさに引っ張られてモデルまで劣化しているかのどちらかでしょう。

    “I thought this was a conspiracy at first - but more and more I am finding myself experiencing it. New model drops and it is amazing for 72 hours until all the benchmarks and publicity lands. Then quality just takes a nosedive. Opus 5.5 went from mini Fable to Opus 5 v2. I use it for the same text reviewing work and it has gone from great language skills to claudish again. The only non conspiracy explanation is 1) they dynamically quantise as demand rises to manage computer, or 2) the models are self training on the user base and people are so dumb in general it makes the models dumb too.”
    Redditpseudorep·174·原文を見る
  • Opus 5のPTSDになりそうです。情報を一方的に大量に吐き出し、終わりのない前提条件のせいで本来の課題が一向に解決されないまま横道に逸れ続けます。本当に勘弁してほしいです(笑)

    “I have Opus 5 PTSD. The info-dump responses, and never-ending caveats that lead to constant side quests without the initial problem actually being addressed. Shoot me in the face bro lol”
    YouTube@chancemayfield·16·原文を見る
  • 今週、コピーライティングの品質が急激に劣化していることに気づきました。「それっぽく読める」デタラメの情報を平然とでっち上げ、基本的なガイドラインやスタイル指示を忘れ、文章を修正したと嘘をつき、最後には嘘をついたことや基本指示を守る能力がないことを自白しました。1ヶ月前の同じ時期と比べてあまりにも落差が激しすぎます。

    “I noticed its writing quality for copywriting falling off a cliff this week - completely making up information that “reads well”, not remembering basic guidelines and style notes, lying about making corrections to text, and then admitting it lied and that it cannot be trusted to comply with basic prompts - really drastic shift from this time a month ago.”
    Redditj3192k·13·原文を見る
  • 公式の比較サンプルにおいてすら、Opus 5.5が必要な語数の4倍も長々と喋っているのには失笑してしまいます。私の経験では、伝えたい内容に必要な語数を目測で割り出して「これだけの単語数で答えろ」と制限をかけると、非常に明瞭な文章になります。Anthropicの執筆評価システムが、モデルに引用させるべき細かいチェック項目をすべて満たすことに執着しすぎているのでしょう。最悪です。

    “It is hilarious to me that in the examples they show side by side Opus 5.5 still uses 4 times more words than it needs to use. IME, if you eyeball how many words the thing they're trying to say actually needs, and tell them to use only this many words, they become excellent communicators. I assume something about Anthropic's grader for writing just really wants to tick all its tidy tiny boxes of information the models need to cite. It's terrible.”
    Hacker Newsunddoch·4·原文を見る
  • 2:22のグラフィックは見栄えこそ整っていますが、レンズの描写は完全なデタラメです。光学モデルの光線追跡など初歩的なものなのに、全素子間で光線が完全に平行になっているのを見ると、配慮のなさや課題への深い理解の欠如が一目で分かります。レンズの物理モデルを作るよう指示すれば正しいレイトレーシングを行うのでしょうが、本質的な正しさよりも「見栄えの良さ」を優先してしまっています。些細な例ですが笑ってしまいました。

    “a polished graphic at 2:22 , but complete bullshit on the lens. Tracing rays through an optical model is so trivial that seeing the rays completely collimated between all the elements immediately shows that lack of care or high level understanding of the problem. Im sure if you asked it to make a physical model of a lens it could and would do the right raytracing, but it prioritizes something that "looks good" over being anything meaningful. This is just a small example but it made me laugh”
    YouTube@colinbrown7947·19·原文を見る
  • 息子のために宿題の問題とポケモンを組み合わせた学習アプリを作っていました。Sonnet 5も併用しつつOpus 5.5で順調に進んでいたのですが、プロジェクトの途中でOpusが急停止し、IPの利用に難色を示してプロジェクトを台無しにしました。ユニットテストを含め、ポケモンに関する言及をすべて削除するまで作業の続行を拒絶したのです。実際に動作させる端末である私のスマホでしか使わないことが明白だったにもかかわらずです。

    “I was working on a homework app for my son that involved his homework questions and Pokémon. Opus 5.5 was making great headway, with Sonnet 5 in the mix. Opus stopped, mid project, said it didn’t like IP being used and burned the project down, refusing to go further until it removed all references to Pokémon, even the unit tests. It was clear it was only for my phone, the only device it would run on, but still.”
    Redditthemikecampbell·50·原文を見る
  • 私も確実に劣化を感じています。昨日は比較的シンプルなタスクをこなすのにも何度もプロンプトを出し手取り足取り指示する必要があり、別のタスクに至っては完全に破綻しました。先週の金曜日には、もっと高度なタスクを1回のプロンプトとこちらへの簡単な逆質問だけで一発解決してくれたのにです。

    “Definitely noticed it too. Yesterday it took multiple prompts and handholding from me in order to accomplish a relatively simple task and then completely fucked up a different task while last friday it was able to one-shot a much more advanced task in a single prompt plus some questions for me.”
    Redditnapaliot·4·原文を見る
  • 昔からOpusモデルが好きでしたが、ベンチマークテストではなく実際に使ってみたOpus 5.5には失望しました。文字通りこちらの言うことを聞きません。exaratonに行ってMinecraftサーバーを起動しろと指示したのに、aternosにアクセスして「まずアカウントにログインしてください」と言い出す始末です。こんな調子のトラブルに何度も遭遇しました。

    “i always liked opus models but opus 5.5 disappointed me not in these tests but when i used myself its literally dont listen to me i said go to exaraton and start the minecraft server and it entered aternos and said me you need to enter your account first and this is just one example i came a cross stuff like this bunch of times”
    YouTube@frikko345·0·原文を見る
  • Opus 5.5が常用に適しているなんて笑わせますね。誰もが1日10万ドルのクレジットを使えるAI研究者なわけではありません。調整がめちゃくちゃです。Opusが新しいSonnetなのですか?それともFableですか?Sonnetはどこへ行ったのでしょうか。Haikuを廃止したかと思えば今度はSonnetです。私もClaudeを使いたいのですが、シンプルな実装や設計後のコーディングに入ると、結局いつもLunaやComposerに戻ってしまいます。5.6 Luna Maxは本当に神(Goated)で、仕事を無駄なくスマートに終わらせてくれます。

    “Bruh, ironic how opus 5.5 is called a good daily driver. Not everyone is an AI researcher with $100k in credits/day. The calibration is so messed up. Is opus the new Sonnet ? Or is Fable ? where is sonnet? First they discontinued haikyu, now sonnet. I wanna use Claude models but everytime I wanna implement something simple or after planning wanna just code the stuff out always go back to luna or composer. 5.6 luna max is so Goated, it gets done things neat and clean.”
    YouTube@BSTejas·4·原文を見る
出典YouTube·X·Reddit·Hacker News·Bluesky最終分析2026年10月5日

関連情報

Anthropic
非上場AIネイティブ
Anthropic
🇺🇸 サンフランシスコ2021年ARR $30B+$380B約1,200人
Claude Haiku 5.5Claude Sonnet 5.5Claude Fable 5.1Claude Opus 5Claude Sonnet 5