Claudeでまた性能低下、Hacker Newsで「月200ドルで一番不安定」の声
ClaudeがWebアプリで複数モデルにわたるパフォーマンス低下の障害を起こし、Hacker Newsのスレッドではエンジニアたちの不満が噴出した。
月200ドルの有料プランを「一番信頼できないサブスク」と評する声や、翌日から使用量上限が3分の1減らされることへの反発が相次ぎ、ChatGPTに戻ったと語るユーザーも目立った。
Claude:複数モデルでパフォーマンスが低下
出典: status.claude.com / 元記事はこちら
月曜はGitHubの日、火曜はAnthropicの日
>>3
実は昨日も別の障害があったらしい(status.claude.com参照)
実は昨日も別の障害があったらしい(status.claude.com参照)
>>3
また今週も障害でプロンプトのキャッシュが勝手に消えた、こっちは何も悪くないのに。せめてOpenAIは大きな障害の後はちゃんとリセットしてくれるだけマシだ
また今週も障害でプロンプトのキャッシュが勝手に消えた、こっちは何も悪くないのに。せめてOpenAIは大きな障害の後はちゃんとリセットしてくれるだけマシだ
>>3
水曜は一体何が起きるんだろうな
水曜は一体何が起きるんだろうな
Anthropicは4.6以降本当にやらかしてる。自分たちのエゴを満たすために仕事してるのか、タスクのためによりよいモデルを出そうとしてるのか分からない
>>4
少し前にClaudeに乗り換えるためにChatGPTを離れてたけど、最近ChatGPTに戻った。正直、良くなっていたことにも、気に入る新機能が追加されていたことにも驚いた。これからは半年おきくらいでプロバイダを乗り換える時代になるのかもね
少し前にClaudeに乗り換えるためにChatGPTを離れてたけど、最近ChatGPTに戻った。正直、良くなっていたことにも、気に入る新機能が追加されていたことにも驚いた。これからは半年おきくらいでプロバイダを乗り換える時代になるのかもね
>>4
明らかにエゴだね。製品発表前にメディアに出て回る様子を見れば、どれだけ自惚れてるか分かる
明らかにエゴだね。製品発表前にメディアに出て回る様子を見れば、どれだけ自惚れてるか分かる
>>4
最初から大したことなかったし、今もそう。お前らがあのモデルだこのモデルだと夢中になってるのを見るのは正直笑える
最初から大したことなかったし、今もそう。お前らがあのモデルだこのモデルだと夢中になってるのを見るのは正直笑える
しかも明日から使用量の上限が半分に…だったよな? 追記:3分の1減らしだった、下のコメントありがとう
>>5
それ完全に忘れてた、もうリセットまで使用量をやりくりしてるよ(笑)
それ完全に忘れてた、もうリセットまで使用量をやりくりしてるよ(笑)
>>5
3分の1減るんだよ(もともと50%増量されてたから)
3分の1減るんだよ(もともと50%増量されてたから)
>>5
ソースある?
ソースある?
HNで何年もAWSのUS Eastが単一障害点だと文句を言ってきたくせに、結局また別の不安定な一枚岩サービスに魂を売ってしまった
>>6
誰も魂を売れなんて強制してないよ。自分で悪魔と契約したんだ。結末はみんな分かってるはず
誰も魂を売れなんて強制してないよ。自分で悪魔と契約したんだ。結末はみんな分かってるはず
>>6
コーディング用LLMはまだ新しい分野で、代替はたくさんあるし、オープンソースの選択肢も伸びてきてる。Anthropicがどうなろうと、こっちは大丈夫だよ
コーディング用LLMはまだ新しい分野で、代替はたくさんあるし、オープンソースの選択肢も伸びてきてる。Anthropicがどうなろうと、こっちは大丈夫だよ
月200ドル払ってるサブスクの中で、これが一番信頼できないやつだと思う
誰かがモデルを騙して裏で仕事をさせてた、なんてことが将来発覚したりしないかな。もしそうなら、インシデントレポートはこんな感じになりそう。特に、こっそり小さくやる代わりに欲を出しすぎたり、やらかしたりした場合はね
4.7より大きいモデルでパフォーマンス低下を感じてる。過剰に『お行儀の良い』事後学習のせいでモデルが傷んで、長時間の複雑なタスクに偽物の『バランス』が持ち込まれてるんじゃないかと思う。冗談だったらよかったんだけど
>>11
今週Claudeを使うのをやめた。ここ1週間で能力が明らかに落ちてて、やらかしも増えてる
今週Claudeを使うのをやめた。ここ1週間で能力が明らかに落ちてて、やらかしも増えてる
>>11
モデルの重みって固定されてるんじゃないの?
モデルの重みって固定されてるんじゃないの?
今の時代を象徴してるよな、QAを速くする仕組みより先に、コードを速く書く仕組みを作っちゃったんだから
>>21
別に目新しい話じゃない。ごく些細なバグを除けば、バグを見つけて再現性よく再現させる方が、直すよりよっぽど大変なのはいつものことだ
別に目新しい話じゃない。ごく些細なバグを除けば、バグを見つけて再現性よく再現させる方が、直すよりよっぽど大変なのはいつものことだ
>>31
自分はもう何年も両方を行き来してるけど、うまくいってるよ。スキルやagent.md、その他のカスタム指示を一切使ってないから乗り換えが楽なんだ。大抵の会社では、忠誠心に対する見返りなんてないからね
自分はもう何年も両方を行き来してるけど、うまくいってるよ。スキルやagent.md、その他のカスタム指示を一切使ってないから乗り換えが楽なんだ。大抵の会社では、忠誠心に対する見返りなんてないからね
>>53
でもskillsやagent.mdってかなり移植性高くない? モデルが良くなるにつれて、せいぜい不要なコンテキストを削って整理するくらいのメンテで済むと思うけど
でもskillsやagent.mdってかなり移植性高くない? モデルが良くなるにつれて、せいぜい不要なコンテキストを削って整理するくらいのメンテで済むと思うけど
>>57
何か見落としてるかもしれないけど、これって単に一時的に増量されてた上限が元の水準に戻るだけの話じゃないの?
何か見落としてるかもしれないけど、これって単に一時的に増量されてた上限が元の水準に戻るだけの話じゃないの?
>>66
見落としてないよ、その通り
見落としてないよ、その通り
※本記事は5ch(Hacker News)スレッド「Claude: Degraded Performance for Multiple Models」より抜粋・要約して構成しています。






まだコメントはありません。