3 ポイント 投稿者 GN⁺ 2024-07-12 | 1件のコメント | WhatsAppで共有
  • 赤ちゃんの名前選びを競争的な意思決定として単純化し、親が名前の一意性だけを見て行動するとどのような分布が生じるのかをゲーム理論で扱う
  • 親を**近視眼的(myopic)**で完全な情報を持つ主体と仮定し、分析可能な形の名付けモデルを構築
  • 基本設定とパラメータ、親のインセンティブ構造を形式化しながら、単純な解釈で現れる近視眼的行動のリスクを指摘
  • 数値実験は、パラメータの変化によって名前の分布と戦略の結果が変わり得ることを示す
  • 大規模言語モデルツールの分析と今後の研究方向も含まれ、関連研究の節では既存の命名研究を冗談めかして列挙している

名前の一意性をめぐるゲーム

  • 子どもの名前は出生直後、子ども本人の入力や承認なしに決められ、伝統的には生涯維持され、将来の人生の道筋に大きな影響を与えるという前提を置く
  • 親は、名付けという競争的領域でゲーム理論の教育をほとんど受けないまま意思決定を迫られる
  • モデル内の親は次のように単純化される
    • 近視眼的な主体
    • 完全な情報を持つ主体
    • 名前の一意性だけを基準に選ぶ主体
  • この設定をもとに、名付けゲームの基本構造、パラメータ、親が望む名前の属性とインセンティブを形式化する
  • 最も単純なモデル解釈では、親の近視眼的な選択が名前戦略にどのような落とし穴を作り得るかが核心的な論点となる

実験と拡張に関する議論

  • 数値実験は、モデル内で名前の分布がどのように移動するかを確認する役割を果たす
  • パラメータを変えると名付け戦略の結果も変わり得るため、単純な一意性の追求が常に同じ結果につながるわけではない
  • 数値実験に加えて、大規模言語モデルツールの分析も扱う
  • 最後に今後の研究方向を整理する
  • 関連研究の節は「既存研究はまったくない」としたうえで、複数の先行研究を「都合よく無視するなら」という但し書きとともに列挙する冗談めいた構成を取っている

1件のコメント

 
GN⁺ 2024-07-12
Hacker Newsのコメント
  • 著者一覧は Katy Blumer、Kate Donahue、Katie Fritz、Kate Ivanovich、Katherine Lee、Katie Luo、Cathy Meng、Katie Van Koevering だが、英語圏の名前に馴染みがない人のために言うと、いずれも Katherine に似ているか、そこから派生した名前である

    • いちばん笑えるのは、同じありふれた名前を選ぶ親があまりに多いという証拠として、論文自身を再帰的に引用している点だ
      「たとえば、ある親は『Kate』という名前が心地よく伝統的でありながら独特で、人気もほどほどだと予想するかもしれない。彼らは間違っている [6]。」ここで参考文献 6 がまさにこの論文である
    • 論文タイトルも、John Green の有名なヤングアダルト小説「An Abundance of Katherines」を指している
    • 似た例として、Goodman、Goodman、Goodman、Goodman による A Few Goodmen: Surname-Sharing Economist Authors がある: https://scholar.harvard.edu/files/joshuagoodman/files/goodma...
      さらに O.W. Greenberg、D.M Greenberger、T.V. Greenbergest による (Para)bosons, (para)fermions, quons and other beasts in the menagerie of particle statistics もある: https://arxiv.org/abs/hep-ph/9306225
      Wally Greenberg から聞いたところでは、T.V. は “the very” の略だという。そして元記事が4月1日の投稿である点にも注目すべきだ
    • 数年前に KatieConf があり、技術カンファレンスで女性登壇者が不足していることを浮き彫りにしようとするイベントだった
      https://2019.katieconf.xyz/
    • 「Katerina」が関係あるのか気になったが、普通は「Kat」と略すし、ここで見た語源が興味深かった: https://www.behindthename.com/name/katherine
  • かなり筋の通った笑いどころがいくつもあった
    「本論文は2024年に書かれたため、生成AIとLLMを扱う義務的な節を含む。」
    「もう一つのERAはカゲロウ親仮定であり、すべての親が子どもに名前を付けた直後に即座に死亡すると仮定することで、数学をかなり容易にする。」
    「親は、生まれたばかりの子にどの名前を付けたいかについて、常に完全に意見が一致していることはよく知られている。」

    • 「われわれは根拠なく対数正規分布が妥当だと主張する……」も良かったし、図8の少し切れたChatGPTのスクリーンショットに「Can you write me a paper on the game theory of names」と書かれているのが特に気に入った
    • 恐竜とイカの形をした分布グラフも笑えた
    • Danger 5 が断然最高だった: https://imgur.com/P80uqLB
  • 参考文献 [12] を見ると、論文タイトルは以前の作品に着想を得たもののようだ: https://en.wikipedia.org/wiki/An_Abundance_of_Katherines
    投稿日が2024年3月31日であることを見ると、エイプリルフール論文として出そうとしたように思える

  • Wait But Why は赤ちゃんの名付け理論を本当にうまく捉えていたと思う: https://waitbutwhy.com/2013/12/how-to-name-baby.html

    • ある赤ちゃんの名前が退屈だというのは誤解だと思う
      小さく元気な人間が「これが自分だ」と自信を持って受け入れた名前ほど、退屈でないものはない。おもちゃの名前なら、自分を納得させるために奇抜な名前が欲しくなるかもしれないが、子どもにはまったく問題にならない
    • Freakonomics でこういう話が出ていた: [0]
      「名前に関して最も予測可能なパターンの一つは、人気が出るほぼすべての名前が、最初は上流階級または高学歴層の名前として始まるという点だ。カリフォルニアのデータでは親の教育水準を見ることができ、後にいわゆる『最も野暮ったい』名前になる Tiffany、Brittany、Caitlyn のような名前も、所得分布の上位から始まり、20年、30年、40年かけて下へ降りていき、低学歴層の間でますます一般的になっていく。」
      論文中の Mabel は、流行名が戻ってくる例のように見える。ヒップスターたちが復活させ、ヒップスター的な趣味を持つ上流階級の親たちが広め、その後一般大衆へ広がっていく、という具合だ。コツは、古臭いか見慣れない響きだが、子どもの生涯のうちに人気を得る名前を選ぶことだ。今なら Linda や Iris のような名前を選べるかもしれない
      音節数の分析も見てみたい。ベビーブーマー世代風の2音節の名前はいつまた流行するのだろうか?
      [0] https://freakonomics.com/podcast/how-much-does-your-name-mat...
    • もしかして気になる人がいるかもしれないので言っておくと、ここで言う why は _why ではない: https://viewsourcecode.org/why/
  • Jinseok Kim、Jenna Kim、Jinmo Kim の論文「Effect of Chinese characters on machine learning for Chinese author name disambiguation: A counterfactual evaluation」もある
    著者たちは中国語名ではないが、個人的に同姓同名の識別が必要な名前を持っていると、この研究分野に関心を持つようになるのかもしれないと思う。論文でも韓国語名にも同じ問題があると述べている
    https://journals.sagepub.com/doi/full/10.1177/01655515211018...

    • 姓だけを表記する慣行は、姓が長くて区別しやすく、名が一般的な文化圏ではうまく機能するが、姓が短く一般的で、情報量の大半が名にある文化圏ではおかしなやり方になる
  • 「…私たちは扱いやすく整っているだけでなく、現実世界を完璧に捉えるモデルを作る」という文を読んで、どういう雰囲気なのかすぐ分かった
    著者たちのユーモアのセンスが良い

  • 「上のモデルには、いくつかの極めて合理的な仮定(ERA)が含まれている。[...]もう1つのERAはカゲロウ親仮定で、すべての親が子どもに名前を付けた直後に即座に死亡すると仮定し、数学をかなり簡単にする。」
    この論文はこういう笑える文でいっぱいだ

  • 「An Abundance of Katherines」ではなく、An Abundance of K8sに聞こえる

    • Kubernetes は女の子の名前として実にかわいらしい
    • もっと悲劇的なバージョンとして Keighty もある
    • KT’s もあり得る
  • 夜眠れずに赤ちゃんの名付け問題について考えている
    子どもの名前はちょうどよいところにあってほしい。ありふれすぎず、かといって個性的すぎず、特に短い期間だけ流行して、名前を聞いただけでだいたいの年齢が分かるような名前ではないといい[0]
    だが、こう考える人たちは結局、同じ少数の名前に集まり、望まないまま「短期間に人気が出すぎる」効果を作ってしまう。すでに一度失敗していて、猫の名前が Olivia なのだが、実はその10年代の人気の女の子の名前だった
    [0] 私の名前もそういう名前の1つなので腹立たしい

    • 子どもを持つつもりはなかったが、もし持つなら名付けのルールがあった
      1. 実際に呼ぶ名前を付けること。「Kate」と呼びたいなら「Katherine」と名付けず、「Sam」と呼びたいなら Samuel と名付けないこと
      2. 近い親族と同じ名前を付けないこと
      3. 一般的な名前に独特な綴りを付けないこと。名前を口頭で伝えるたびに、一生綴りを説明しなければならない面倒を与えるだけだ
        両親は私の名前を付けるときに最初の2つのルールを破り、大人になる過程で厄介ごとが生じた。Intel でインターンをしていたときも、父が15年間働いていた場所だったので問題が起き、父宛てのメールが私に来たり、その逆があったりした
    • 子どもをその時代の産物にしてはいけない理由はあるだろうか。どんな名前を選んでも、ひ孫たちがおばあちゃんの名前について、かっこよく時代に合った名前を選んだとは思わないだろう
    • https://www.fantasynamegenerators.comを勧めてもいいだろうか?
      名前に限らず、現実世界の名前カテゴリもかなり大きい。本気で言っている。赤ちゃんの名前リストは何千もあって典型的な情報過多だが、ランダム生成器を使えば10個見て、気に入らなければまた10個引ける
    • Social Security Administration のサイトを勧める: https://www.ssa.gov/oact/babynames/
      100年前や好きな時代までさかのぼってリストを眺め、最近の上位X位にも入っていない気に入った名前を見つければかなり安全だ。妥当でありながら過度に個性的ではなく、今の世代にはほとんどいない名前が得られる。サイトには直近の年のデータもあり、名前は普通、一夜にしてリスト外から人気名へ跳ね上がることはない
      「その10年代の人気の女の子の名前」である点については、インターネット時代には検索最適化されにくい一般的な名前の方がむしろ良い場合もあることも考慮すべきだ。もちろん姓によって変わることが多い
    • そういう名前を持っているのは気に入っている。昔人気があったのでなじみのある名前だが、同じ名前の人には数人しか会ったことがない
      興味深いことに、同程度に人気の姓と組み合わせると、米国には私と名前も姓も同じ人がおよそ30人いる
  • 「2024年3月31日提出」だなんて、ほとんどエイプリルフールの冗談のように見える
    「上のモデルには、いくつかの極めて合理的な仮定(ERA)が含まれている。最初のERAは非常に保守的な仮定で、性別は1つだけであり、すべての子どもとすべての名前が同じ性別に従うというものだ。したがって、名前リストに存在しさえすれば、どの子どもにもどんな名前でも付けられる。もう1つのERAはカゲロウ親仮定で、すべての親が子どもに名前を付けた直後に即座に死亡すると仮定し、数学をかなり簡単にする。」

    • ニュージーランドとオーストラリアではすでにエイプリルフールで、GMT-XX タイムゾーンが少し遅れて付いてきているだけだ
    • SIGBOVIK はいつもエイプリルフールに近い時期に開かれる :)