新画像生成AI「Qwen-Image-2.1」公開、ライセンス巡り海外で議論に
姉妹サイトの新着
他サイトの新着
- 5chまとめMAP千原ジュニア、街で見かけた初心者マーク車 “まさかの位置”にツッコミ
- ニュース速報まとめMAP【映画】ナイトミュージアムが金曜ロードショーに!お前ら観るしかねぇwww
- なんJ傑作まとめアンテナMAP【困惑】芦田愛菜さん主演「南田南弁護士は天才肌」予告&ポスター解禁wwwwwwwwww
- アニメ声優まとめアンテナMAP【悲報】しぐれういさん謝罪したのに、未だにブチ切れてる人が多すぎる
- VTuberまとめアンテナMAP【にじさんじ】Rei7、ダイナソー竜崎とインセクター羽賀の方が分かる
- だめぽアンテナ【X】習近平、脳梗塞!?
- ヌルポあんてな海外「国ガチャに失敗した…」 日本の被災地の避難所の様子に海外から羨望と称賛の声
- 2chまとめアプリ+年齢公表したVTuber、2カ月で視聴者層が激変してしまうwwww
- News人海外メディア:アロンソ、2027年はF1を離れWECでアストンマーチンのハイパーカー計画に移籍を検討?他
- ブルーアンテナ南ことりちゃん、グラビアアイドルになってしまうwwwww
- ウマーあんてな【海外の反応】マドリー・ダービー実況スレ、ヴィニシウス起用巡り海外勢が激論
- 2ちゃんねるまとめるまとめ【ネタ続々】アジア大会、日本との決勝前に韓国男子バスケ練習中止 送迎バス来ず「妨害を疑う」
- 勝つるあんてな!【悲報】度会隆輝さん、ホームランを追いすぎてフェンスに激突
- 5chnavi10年近く好きだった彼から私の友達のセンスや親を見下す発言をされた。その途端、残っていた好意まで一気に消えて…
- にゅーもふ【閲覧注意】 100年前のロシア大飢饉、死んだ瞬間 ”人肉市場” に卸されてたってマジかよ…
- 海外の反応アンテナ.com外国人「なぜ日本人を特別扱いするのか?日本人との接し方について神経質な外国人が多すぎる」
- ぷぅアンテナ【乃木坂46】瀬戸口心月の網タイツ美脚! 他
- Ask Reddit まとめ海外「彼女は単三電池を耳元で振って、残量を音で確かめようとしてた」男たちが明かす“女性に冷めたしょうもない理由”
- Red4 海外の反応まとめ【海外の反応】日本経済がドイツや中国を抜き返すことは可能だと思う? → 「エネルギー自給を達成して他国の影響を受けないようになれば」「ドイツがGDPを追い抜いたのはコロナ後のインフレのおかげだぞ」
- キター!アンテナアジア大会、韓国戦で今度は国歌流れず 全競技で一時演奏中止か
中国Alibaba系列のQwenチームが新しい画像生成モデル「Qwen-Image-2.1」を公開し、Hacker Newsで大きな反応を呼んだ。漢字やかなの文字組み込みがMicrosoft Windowsより正確だという指摘や、CheersやBluey風のキャラクター再現サンプルへの驚きの声が上がった一方、ライセンスが「非商用利用限定」に変更されたことへの落胆も相次いだ。法外なAPI課金を避けられると中国勢のオープンソース姿勢を評価する意見と、ライセンスの実効性そのものを疑う意見が交錯した。
Qwen-Image-2.1:コンパクトで効率的、統合された画像生成モデル
出典: qwen.ai / 元記事はこちら
同じことを書こうと思っていた。Apache 2.0ライセンスの画像モデルは2025年のものが最後のようで、最近のQwenモデルは軒並み「非商用利用限定」になっている。
企業はライセンスに関係なくLLMを使って「ライセンス・ロンダリング」ができてしまう。このモデルを使ってライセンス上の問題がない別モデルを作るのはどれくらい難しいんだろう?
非商用条項は好きだよ。詐欺広告や「バーチャル内見」、偽のSNSアカウントにこの手のモデルを使う連中が多すぎるから。そういう奴らの邪魔をしつつ、自分が子供のためにふざけた画像を作ったりTRPGのタペストリーを作ったりするのは許されるなら、それで十分満足だ。
Qwen Image 3は2か月前にリリース済みだよ(リンク)。別のモデルと勘違いしてるんじゃないかな。
この手のモデル向けにdiffusion.cppというのがある。2か月前にChatGPTの助けを借りてkrea-2-turboを動かしたことがあるけど、それなりのPCがあるなら対応され次第それがおすすめ。
リンク先のGitHubページにDiffusers、ComfyUI、vLLM-Omni、SGLang、LightX2Vへのリンク付きで対応済みと書かれてる。
提案の通りにやればいいのでは?つまりこのページの手順でllama.cppを使って、結果はUIかwget/curlで取得する、とか。
つい最近まで公式のChatGPT画像生成にすらその機能がなかったことを考えると…しかもそれが今ローカルで動く(自分のMacで動かし方が分かればの話だけど)。信じられない。
ChatGPTって本当にそんなにいいの?4月の時点ではChatGPT Images 2.0の目玉サンプルに中国語の文字化けがあって、後でブログ記事から削除されてた。2.5では改善されてるのかな?
ComfyUIにはMac用の実行ファイルがあったはず。
「ようやくVAEを直した」というのは、何か情報源ある?
元の画像自体がそこまで良くなかったことを考えると、結果はかなり良い再現だと思う。むしろウディ・ハレルソンの方がひどいことになってる気がする。
VAEを使わない場合でも、彼らのモデルには昔からフーリエ空間に透かしが入っていて、それは大抵簡単に検出できる。
ローカルの画像・動画モデルを試すならComfyUIが一番手軽だと思う。もしくは対応してるならvLLMで `vllm serve <model> –omni –port 9080` みたいな感じでも動くはず。
逆に、アーティストからすればきっと逆だと思う。画像そのものより、コードの品質の方に感心するはず。
一般化すると、LLMは「自分が不得意なこと」で特にすごく見える。
それは公平な指摘だと思う、同意する。自分は絵がかなり下手なので、その分バイアスがかかってるのかもしれない。
llama.cppが画像生成モデルにも対応してるかは怪しいと思う。
マルチモーダル対応してるよ、これ見て(リンク)。
他サイトの新着
そのライセンスを実際に強制できるといいね(皮肉)。
ああ、知らなかった、教えてくれてありがとう。
なんでわざわざそんなことするの?普通に使えばいいのでは。モデルに著作権上の制限をかけられるかどうか、法的な先例すらまだ無い。各社はまるでそれが意味を持つかのようにライセンス文書を出し続けてるだけ。
少なくとも、それがそのラボにとっては重要だという意思表示ではある。だから、先例を作る最初の一人になって訴訟費用を払いたくないなら、無視できない話だと思う。
おそらく強制できないライセンス条項なんて、あの連中が気にすると思う?
マルチモーダル対応だからといって入出力の両方が保証されるわけじゃない。「現時点では画像・音声・動画の入力に対応」としか書かれていない。
何か見落としてる気がする。このモデルは他の入力にも対応してるの?画像出力は対応してるはず。動画は…出力というより、正距円筒図法サンプルのプレビューだと思うから出力ではない気がする。結局、このモデルが「対応していない」出力って何のことを言ってるんだろう?
この話題の背景と論点
Qwenは中国アリババ系列が開発する大規模モデル群で、これまで複数の画像生成モデルをApache 2.0など比較的自由なライセンスで公開してきた経緯がある。今回のQwen-Image-2.1はそこから一転し、非商用利用限定のライセンスに変更された点がスレッドの主な論点になった。賛否の背景には、AIモデルのライセンスがそもそも法的にどこまで強制力を持つのか、まだ判例のない領域への不透明さがある。スレでは、ライセンスを軽視する声がある一方で、規約の存在自体が開発元の意図表明として一定の意味を持つという指摘もあり、単純な二元論では割り切れない論点であることが読み取れる。また漢字・かな表記の精度向上やCheers・Blueyのキャラクター再現例は、モデルの実用性を測る具体例として紹介されており、性能面の評価と権利面の懸念が同時に語られている点がこのスレッドの特徴といえる。
※本記事は5ch(Hacker News)スレッド「Qwen-Image-2.1: Compact, efficient, and unified image creation」より抜粋・要約して構成しています。






まだコメントはありません。