1 ポイント 投稿者 GN⁺ 2024-01-17 | 1件のコメント | WhatsAppで共有
  • タイトルはMidjourneyの学習データにおけるアーティスト記載の問題を示しているが、入力に含まれる本文はその論争の詳細というより、読者の短い反応に近い
  • ある読者はFeeling Hard Or Hardly Feelingを2005-07-17からハードドライブに保存していたものの、作者を知らなかったと明かしている
  • 後になって制作者を調べたあとで「It means something」と残しており、その作品が個人的に長く心に残っていたことを示している
  • 別の反応では、創作者の寛大さ、正当な怒り、芸術への感謝、そしてその芸術が前の二つを美しく要約しているという見方が述べられている
  • 入力されたテキストだけでは、Midjourneyの学習リストの基準、使われた作品の範囲、対応措置といった具体的な情報は確認できない

長く保存されていた作品と遅れて訪れた発見

  • ある読者はFeeling Hard Or Hardly Feelingを2005-07-17からハードドライブに保存していた
  • 保存当時は誰が作った作品なのか分からず、時間がたってからようやく制作者を調べた
  • 「It means something」という一文で、その作品が個人的に意味深く残っていたことを示している

本文から確認できる反応の範囲

  • 短い反応には、創作者の寛大さ、正当な怒り、芸術への感謝が込められている
  • その芸術が前の二つを美しく要約しているという評価も含まれている
  • Midjourneyの学習に使われた作品リスト、アーティスト記載の方式、法的・技術的な詳細は、入力された本文からは確認できない

1件のコメント

 
GN⁺ 2024-01-17
Hacker News のコメント
  • これが私にとっては核心的な争点。OpenAI が営利企業ではないとしても、明らかに価値のある会社であり、その価値は他人が作ったコンテンツを取り込んで作られたのに、その人たちに価値を還元していないところから来ている。
    法的にどうであれ、それは間違っていると思う。OpenAI の学習から、著作権があり許可を得ていないコンテンツをすべて取り除いたら、製品価値はどれだけ残るだろうか? 著作権コンテンツを使えなければ OpenAI の価値が下がると思うなら、その価値の一部はコンテンツ側に還元すべきだ。

    • 著作権コンテンツを使用することは許されるが、著作権コンテンツを複製することは許されない。私たちはそれを見て消費し、影響を受けることができ、多くの場合はそもそもコピーすることすら許されている。
      自分の著作物を誰にも見られたり、消費されたり、影響を与えたりしたくないなら、箱に入れて誰にも見せるべきではない。AI が自分の作品にあまりに似た画像を作ると訴えるアーティストたちにはある程度共感するが、その共感はだんだん薄れている。出力物が本当に似て見えることはあるかもしれないが、その作品を何百万人もの他の作品と比べれば、既存の人間の作品の中にも似たものを見つけられるはずだ。
      だから衣服は著作権保護の対象にならない。どれほど独創的だと思っても、過去数千年のファッション史の中で誰かがすでにやっているからだ。視覚芸術も似た地点に近づいているのかもしれない。自分の絵がどれほど独創的だと思っても、どこかにはすでに似たものがあり、AI も画像を文字どおり複製しているわけではない。こうした現実がファッション産業を殺さなかったように、視覚芸術も殺しはしない。
    • OpenAI は、他の米国の営利企業と同じように利益を上げるインセンティブを持つ営利企業に近いと思う。別に非営利会社があり、その会社が営利会社を指揮しているのは理解しているが、それはガバナンス構造の脚注に近いもので、OpenAI を非営利にするわけではない。
      ウェブサイトにもこうある:「持分の発行を通じて資本を調達し、世界的な人材を雇用できる新しい営利子会社が設立され、引き続き非営利法人の指揮下に置かれる。営利事業を担当していた従業員は新子会社へ移った。」
      https://openai.com/our-structure
    • これは Instagram のようなプラットフォームを指して言ったもの。そこにイラストを配布すると、暗黙のうちに彼らの広告マシンが私の作品で利益を得ることになる。
    • 見方が違う。アーティストが自分の作品をオンラインに載せたなら、それは誰もが見てインスピレーションを得られる状態になったということだ。
      誰かがそのまま盗用しない限り、別の用途に使われたからといって被害を受けたとは思わない。別のアーティストが見てインスピレーションを得るならそれはあり得るし、AI が見てインスピレーションを得ることも同じく害はないと思う。
    • 同じ論理を検索エンジンにも適用できるのでは? 検索するコンテンツがなければ Google の価値とは何だろう?
      だとすれば検索エンジンにロイヤリティを払わせるべきなのか? Google の規模では実行不可能に見える。Google を単に違法にすべきなのか? それも悪い結果だ。検索エンジンが存在するのは良いことだと思う。
      だからこの論理は好きではない。自然に最後まで押し進めると、他のプロジェクトにも同じ結論を強いることになるからだ。
  • 同じテーマの別のウェブコミック: https://www.penny-arcade.com/comic/2024/01/03/terminarter
    もし OS がスクロールバーを隠していてページがさらに長いことに気づかなかったなら、漫画の下にあるテキスト解説も見るべきだ。

    • 「その瞬間の構成が何であれ、私はいつも『対話』に完全に飛び込むことをためらう。それはシグニファイアのスムージーのようなものだ。こういうものは数 ppm のレベルでも検出できなければならない。いったん転移すると、もともと扱っていたテーマから離れ、ますます大きな声で教理問答と忠誠の誓いを読み上げることになるからだ。」
      本当にその通りに聞こえる。
    • Penny Arcade の Gabe は、自分の漫画が美術の授業で次世代のアーティストを訓練するために使われたら怒るのだろうか、気になる。
    • これで Midjourney の絵がなぜあんなに醜く見えるのか説明がつく。
  • この記事や Penny Arcade の文章に反論しにくいというより、レトリックの間から具体的な論点を理解するのが難しい。彼らのコメント欄やソーシャルチャンネルでこの話題を議論するのも慎重になりそうだ。
    では、どんな条件なら AI アートは受け入れられるのだろうか? たとえば、こうしたモデルを大企業が作ったかどうかは本当に重要なのか? 個人が同じモデルを作ったなら、法的・倫理的に何が変わるのか分からない。
    学習データにそのアーティストたちの作品が含まれていたかが重要なのか? もしパブリックドメインの写真、映像、芸術作品だけで学習した新しいモデルが同じくらい強力だったら? 将来のモデルが作品を一つか二つ見ただけで画風を模倣できるようになったら? そういうモデルが出てくるのは時間の問題かもしれない。そのときは問題ないのか? そうでないなら、なぜなのか?
    個人的には、AI 画像を作った人が自分でその画像を作ったかのように、AI モデルのユーザーが合法的かつ倫理的に使う責任を負うべきだと思う。

    • 「どんな条件なら AI アートは受け入れられるのか?」という問いに対して、インターネット的な反論のように聞こえるかもしれないが、アーティストや社会には、文化の中にAI アートが許容される場所を必ず残しておく義務はない。
      そうした可能性があるかもしれないし、ないかもしれない。ただ、現在の AI が、いくつもの大企業がかき集めることのできた芸術作品の、複雑だが半ば文字どおりの平均に近いものだとすれば、それに対する反発は十分に妥当に見える。
    • こういう問いは興味深いと思う。特にユーザーがサンプルとしてスタイルの文脈を提供した場合はなおさらだ。
      今でもアーティストに絵を見せて「こういう感じで、ただしこういう部分は変えてほしい」と頼むのはフェアユースに当たる。脚本家に Star Wars を見せて似たものを書いてほしいと頼むこともできる。
      著作権の問題は、著作権のある作品がインスピレーションとして使われたかではなく、出力物が十分に変容的(transformative)かどうかにかかっている。
    • 「どんな条件なら AI アートは受け入れられるのか?」という問いは、十分な頻度では出てこない。受け入れられるように時間をかけることは価値ある目標であり、障害物ではなく道筋の一部だと思う。
  • クリエイターの独占コンテンツで学習したモデルから利益を得る側は、早くコンテンツ費用を支払い始めたほうが、クリエイターと社会、さらにはAI企業にとってもよい。
    著作権法がAI企業に適用されるかどうかをめぐって議論するのはうんざりする。適用される。きちんとしたライセンスモデルを整理すればよい。

    • a16zは「AIモデルの作成者に実際または潜在的な著作権責任のコストを課せば、開発は死ぬか、大きく阻害される」と書いていた。
      また、すでに大規模言語モデルに使われたすべての著作権資料に費用を支払うなら、それを作った企業は毎年「数百億から数千億ドル」のロイヤリティを支払わなければならないとも述べていた。
      https://www.businessinsider.com/marc-andreessen-horowitz-ai-...
    • 「適用される」と言えばそうなればいいのだが、実際には簡単ではない。
      著作権法は固定された有形の表現だけを保護し、アイデア、概念、原則などは保護しないうえ、フェアユースという大きな抜け穴もあるため、法的な論証は単純ではない。
    • その通り。こうすれば無料の代替手段を潰せる。大きな権利保有者とライセンス契約を結ぶ資金がない側は誰も参入できず、Googleは喜ぶだろう。
      クリエイターははした金を受け取り、誰もが独占APIを経由しなければならず、オープンソースは違法化されかねない。見たい未来ではない。
    • 実際には「モデルで利益を得る誰か」ではなく、「モデルを作る誰か」が問題だ。
      他人のアートを許可なく学習させてモデルを作り、そのモデルや出力を無料で配布したとしても、まったく金を稼がなくても、彼らの仕事を盗んでいることになる。
    • Adobe FireflyとiStockには、すでにライセンス済みコンテンツのみを使う生成ツールがある点は指摘しておく価値がある。
  • アーティストのライセンスが非商用利用に限定されていたなら、それを商用AI学習に使うのは明白な違反ではないのか? なぜ違うのか本当に知りたい。

    • フェアユースがあるからだ。そうしたライセンスは著作権によって執行されるが、その利用が著作権の適用対象でないなら、ライセンス条件は意味を持たない。
    • フェアユースは、なぜライセンスや著作権に違反したのかを説明する論拠だ。許可なくコピーしたという事実に依拠している。
    • フェアユースが実際に適用されるなら、ライセンスは気にしない。
    • だとすれば、その非商用利用条件は、そのAIで共同制作された、あるいは制作された作品にも拡張されるべきなのだろうか?
  • このテーマについて初めて何かを感情的に響く形で伝えてくれた文章なので、筆者に拍手を送りたい。
    今日、世界を変えつつある生成AIは、三つの集団の仕事の上に築かれている。ソフトウェア開発者、Redditのコメント投稿者、デジタルアーティストだ。Redditのコメント投稿者たちはずっと前に権利を放棄しており、気にしていない。残るのはソフトウェア開発者とデジタルアーティストだ。
    概して、ソフトウェア開発者は手厚く報われてきたが、デジタルアーティストはそうではなかった。ソフトウェア開発者は自分の仕事を変更可能な形で公開したが、アーティストたちはそうしなかった。おそらく最も重要な違いは、ソフトウェア開発者が生成AIを作ったという点だ。ある意味では私たち自身の創造物なので、自分の職業を自分で食いつぶしている感覚と、外部の見知らぬ集団に食いつぶされる感覚はまったく違う。
    ワシントンが燃えるのなら、火星人が焼くよりは英国人が焼くほうがましだ。私たちのしたことが私たち自身の手によるものではなかったなら、私たちはどう反応しただろうか?

  • こういう状況に置かれると、嫌な感覚を乗り越えるのは非常に難しそうだ。
    非技術者にとって技術は解読不能に見え、一般の人にとって法律は解読不能に見え、倫理は誰にとっても解読不能に見える。
    これほど混乱が大きいと、集団訴訟に参加して過去の問題を解決するだけでは、公正に扱われたと感じにくいかもしれない。たとえば、企業を相手取って訴訟を起こそうとする人たちをつなぐプロトコルやサイトがあれば、公共の信頼に役立つだろう。社会が平等と正義の価値を支持していることを示す何かが必要だ。

    • 倫理はかなり明確だと思う。
      1. 人が望まないことを、その人にしないこと。
      2. 自分が扱われたいように他人を扱うこと。
        本当にその程度に単純だ。
  • 簡単な解決策がある。
    公開データで学習した非公開の大型モデルを禁止し、そうしたモデルには公開重みを要求すればよい。企業が大型の非公開モデルを学習したいなら、自社データでやればよい。

    • こういう提案はあまり見ないが、この考え方はかなり気に入っている。モデルがアーティストから学ぶことを違法にすべきだとか、アーティストにはモデルから金を引き出す権利があるという考えは、あまり筋が通らない。人間の学習を扱う方法からあまりにも急進的に逸脱しているからだ。
      しかし、企業がそうしたモデルを所有できるというのは不公平に見える。それは企業の制作物ではなく、実質的には人類全体の文化的産出物をコード化した表現だ。私たち全員が所有すべきだ。
    • 簡単な解決策は、出力物が著作権を侵害しているかを確認する別のAIだ。
      ここでの問題は、モデルが著作権のある作品をそのまま生成することだ。著作権のある作品で学習すること自体が著作権侵害だと主張する側には、法的に立つ足場がない。概念を意図的に曖昧にしてそう見せているだけで、有能な裁判官ならすぐに見抜くだろう。
    • 公開データの一部にもライセンスが付いている可能性があるので、出所追跡、著作者表示、著作権の問題は依然として残る。
      ソフトウェアと比較すると、公開されたソースコードの商用・非公開利用を許可するMITライセンスがある。想定している方向性には、コピーレフトライセンスのほうが近いかもしれない。
    • 正直、優れた妥協案だ。少しだけ関連する話だが、著作権法がオプトアウト方式だったらどうだろう? 望めば無視できるが、その代わり自分もいかなる著作権も主張できなくなる方式だ。私は参加すると思う。
    • これで多くが解決するとはあまり思えない。人々は単にオープンソース画像生成器を使うだろう。アーティストたちは依然として同じジレンマを抱えることになる。
  • カメラが登場する前、そしておそらく今でも一部では、複数の画家が有名アーティストの作品を主に複製して販売する会社を運営していました。家に有名な絵画の見事な複製を飾れるようにする、というものです。
    Midjourney のようなツールも同じ範疇に入ると考えられるかもしれませんが、重要な違いがあります。これまでの複製の仕組みは、概して成功して有名になったアーティストを中心に回っていました。お金を稼ぐには、すでに人々にとって大きな価値があるものを複製する必要があり、それが複製品であることも非常に明確でした。
    今は違います。概してほとんど無名に近いアーティストたちの膨大な作品が部分的に複製され、その出所はさらに曖昧になる形で使われています。こうしたアーティストたちが盗まれたと感じるのはもっともです。彼らは名声がもたらす富も、死後の名声が与える慰めもないまま、Van Gogh のような扱いに耐えているのです。

  • Cat and Girl をよく知らなかったので、ランダムにいくつか読んでいるうちに、この漫画を見つけました: https://catandgirl.com/heroes-and-villains/
    ときどき宇宙にはブラックユーモアのセンスがあるように思えます。