OpenAIの数学的「ブレークスルー」に会話データ学習の疑惑、Hacker Newsで議論

姉妹サイトの新着

他サイトの新着

Hacker Newsで、OpenAIが発表した数学分野の「独自のブレークスルー」を巡り、実際にはユーザーとの会話データを学習に使っていたのではないかとする研究者の指摘が話題になった。対象とされているのはナビエ・ストークス方程式など数学の難問に関する社内モデルの成果で、投稿者によれば同様の指摘をした研究者は今回が初めてではないという。あわせて、OpenAIの「みんなのためにモデルを改善する」というオプトアウト設定がアプリ更新のたびに勝手に有効へ戻るとの報告も紹介され、学習データの扱いそのものへの不信感がスレッドの議論の軸になった。

また別の研究者が指摘:OpenAIはユーザーとの会話データで学習させておきながら、それを独自のブレークスルーだと発表していた

出典: bsky.app / 元記事はこちら

5 海外の名無しさん 2026-09-10 13:17
元になったMastodonの投稿はこちら:https://mathstodon.xyz/@andreasthom/117240535270608201
6 海外の名無しさん 2026-09-10 13:42
『みんなのためにモデルを改善する』ボタンをオフにすれば自分のデータは学習に使われないと本気で信じてる人がいるのか。どうしてそこまで信用できるんだ。あの文言自体、罪悪感を煽る言い回しだろ
26 海外の名無しさん 2026-09-10 13:53
>>6 偶然にも、OpenAIのTiboが昨日こんなツイートをしていた:https://x.com/thsottiaux/status/2097746417012166816
8 海外の名無しさん 2026-09-10 13:52
この問題の核心は、みんな『数の中に紛れれば匿名だ』と思い込んでいることだと思う。でも企業にとって興味深いデータなら、簡単に抜き出せる技術はもうある
29 海外の名無しさん 2026-09-10 14:11
>>8 それはさすがに甘い考えだ。この10年で最も成功した企業は、まさに……利用データを売ることで成功してきた。2026年にもなって、車が自分や子どもが吸う空気を実際に汚染しているとも知らずに運転している人がいるんじゃないかと思えてくる
9 海外の名無しさん 2026-09-10 13:36
今の法解釈では、人間の実質的な関与なしにLLMだけで生成されたもの(OpenAIが投稿で主張していたのはまさにこれ)は完全にパブリックドメインになる。だからOpenAIが何を『主張』しようと、それが現実になるわけじゃない。むしろ自分が元の著者なら、あの40万行のLeanの証明をそのまま自分の名前とライセンスで再公開してやる
30 海外の名無しさん 2026-09-10 13:49
>>9 パブリックドメインというのは『誰でも著作権を主張できる』という意味じゃない。むしろ『誰も主張できない』という意味だ
11 海外の名無しさん 2026-09-10 13:59
OpenAIはどうすれば信頼されるようになれるんだろうか
12 海外の名無しさん 2026-09-10 14:05
別のハーネス(実行環境)を使った場合はどうなるんだ? オンラインでオプトアウトすればそれで十分なのか?
13 海外の名無しさん 2026-09-10 13:52
世間知らずな研究者が多すぎる。いまだに『オプトアウト』ボタンを信じている。ナビエ・ストークス方程式は社内モデルで解かれたことになっているが、それがBuckmasterやLepögeらとのチャットで学習されていないと証明するのは無理だろう。AI業界が、トレントでIPを盗み、取れる監視契約は片っ端から取りに行く汚いテック業界だということを、研究者たちは分かっていない
15 海外の名無しさん 2026-09-10 13:18
解決策は地味だがすでに知られている。BIG-benchはまさにこのためにカナリアGUIDを用意しており、汚染除去に使うn-gramの閾値を公開する(GPT-3では13-gramだった)。閾値を開示しないなら、その主張自体が無効だ
33 海外の名無しさん 2026-09-10 13:31
>>15 カナリア文字列はもともと、他の論文での意図しないスクレイピングや分析を防ぐためのもので、ユーザーデータでの直接学習を防ぐためのものじゃない。それにBIG-bench自体、今ではあまり使われなくなっていて、BIG-bench Hardなどのバリエーションのほうが主流だ
16 海外の名無しさん 2026-09-10 13:07
でも、どっちを信じる? 複数の独立した研究者たちか、それとも2年前に著しい不誠実さを理由に一度解任されたCEOか
34 海外の名無しさん 2026-09-10 13:22
>>16 どっちも信じないかな。競争にさらされている研究者も誇張や自己顕示に走りがちだし、CEOはそれに輪をかけてだいたいサイコパスだ。ブレークスルーを狙う研究者を組織的にスパイしているというよりは、単に多くの人が似たようなアプローチで同じ答えを探しているだけだと思う
35 海外の名無しさん 2026-09-10 13:51
>>16 サム・アルトマンに『空は青い』と言われても、一応自分の目で確かめたほうがいい。彼自身が得をするような際どい主張をしたときに、それを鵜呑みにする人がいないことを願うよ
19 海外の名無しさん 2026-09-10 14:02
>>2 今どき動画だってかなり精巧に偽造できる時代だ。スクリーンショットの捏造なんて7歳児レベルのスキルだよ
20 海外の名無しさん 2026-09-10 13:41
>>3 これを見てほしい:https://news.ycombinator.com/item?id=49643556 引用:『何度もリセットしたが、前回は日時までしっかり記録しておいた。それなのに、今確認したら再びオンに戻っていて驚いた』
39 海外の名無しさん 2026-09-10 14:12
>>20 それは知らなかった。本当だとしたら、かなり怪しい仕様だ
40 海外の名無しさん 2026-09-10 13:51
>>20 昔のFacebookでもあった手口だ。アプリを更新するたびにそのチェックボックスがリセットされてるんだろう

他サイトの新着

22 海外の名無しさん 2026-09-10 13:28
>>3 設定のチェックを外さなかったからといって、それが同意になるとは思わない。まあ自分は大事なものをChatGPTに入力すること自体しないけど
42 海外の名無しさん 2026-09-10 13:37
>>22 EUのルールでは、それは同意とはみなされない
23 海外の名無しさん 2026-09-10 13:38
>>3 『みんなのためにモデルを改善する』というのは、実装の仕方次第でいくらでも曖昧になり得る。https://news.ycombinator.com/item?id=49643513
24 海外の名無しさん 2026-09-10 13:50
>>3 オフにしたつもりでも、そう思い込まされているだけかもしれない。オフにする指示を出したところで、実際に反映されたかどうかは確認しようがない
31 海外の名無しさん 2026-09-10 13:38
>>10 OpenAIが設立時の理念に忠実であり続けて……学習・推論のパイプラインを本当にオープンソース化していれば、こんな問題は起きなかったはずだ
32 海外の名無しさん 2026-09-10 13:51
>>10 それはこうした企業の言い分をそのまま信じている前提の話だ。長く生きてきて分かったのは、企業の『言うこと』と『やること』はよく食い違うということ。信じることが仕事じゃない、確かめることが仕事だ
36 海外の名無しさん 2026-09-10 13:58
>>17 腕時計から取ったランダムな音声の断片が、なぜAIの学習データとして役に立つんだ?
37 海外の名無しさん 2026-09-10 13:56
>>17 何の話をしてるんだ?
41 海外の名無しさん 2026-09-10 14:02
>>21 おいおい、それは滑りやすい坂だぞ! 次はモデルの提供者に学習データの出典を明記しろとか言い出しそうだな
43 海外の名無しさん 2026-09-10 13:52
>>25 詐欺で回っている経済というのは、他人が働いた詐欺の責任を、騙された側にすべて負わせることで成り立っている

この話題の背景と論点

この件の背景には、生成AI各社が学習データの出所について説明責任を十分に果たしていないという根強い不信がある。焦点になっているナビエ・ストークス方程式は流体力学の未解決問題のひとつで、OpenAIは自社の内部モデルがこれに関する成果を出したと発表したが、研究者側はその過程で数学者たちがChatGPTと交わした会話が学習に使われた可能性を疑っている。ただしスレッド内でも指摘されている通り、これは状況証拠に基づく疑惑であり、学習データの除染基準(閾値)がOpenAI側から公開されていない以上、外部から確認する手立てはないというのが実情だ。「オプトアウト設定がアプリ更新のたびに勝手に再度有効化される」という報告も、リンク先の個人の体験談であり、全ユーザーに一般化できるかは分かっていない。サム・アルトマン氏が2023年11月に取締役会から一時解任された経緯も引き合いに出されているが、これは公になっている事実で、スレッドでは「経営陣の説明を額面通り受け取るべきではない」という文脈で言及されている。

※本記事は5ch(Hacker News)スレッド「Another researcher says OpenAI trained on conversations, then claimed breakthrou」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事