3 ポイント 投稿者 GN⁺ 2024-05-31 | 1件のコメント | WhatsAppで共有
  • delveは、1つのテーマを深く掘り下げる用途のChatGPT UIとして公開されており、現在のページは短い紹介レベルにとどまる
  • 公開画面には「delve into —」という文言とともに、Faster language models、High-speed rail、Lentils が例示トピックとして表示されている
  • 機能説明、使い方、アカウント作成、価格、対応モデルといった製品判断情報は提供されていない
  • ChatGPTとの連携方式や実際のUI動作は、提供されたテキストだけでは確認しにくい
  • 現時点で確認できる内容は製品名と例示トピックに限られており、実際に使うべきか判断するには追加情報が必要である

公開ページで確認できる内容

  • 製品名はdelve
  • 画面には「delve into —」という文言が表示されている
  • 例示されている探索トピックは3つ
    • Faster language models
    • High-speed rail
    • Lentils

まだ確認できない情報

  • 本文には機能一覧や利用手順は含まれていない
  • アカウント作成、価格、対応モデル、データ処理方式、ChatGPT連携方式は、提供されたテキストからは確認できない

1件のコメント

 
GN⁺ 2024-05-31
Hacker News のコメント
  • とても良い。正確に何とは言いにくいが、単なるギミックより重要な何かに見える
    すでに探索したトピックをクリックしても再度開かないのも良かったし、そのトピックが開いているパネルへ戻るようにできるとさらに良さそう。LLM の UX にもう少し力を入れるべきだという観点で、興味深い試みだと思う

    • UI が良く、さらに掘り下げさせる力がある。ただ、私にはこのツールがユーザーを LLM が苦手な領域へ連れていくのが問題に見える
      LLM は、個人でもできるがやりたくない作業を処理するのに役立つ。たとえば、ある友人は ChatGPT でありきたりな差別禁止ポリシーを作り、別の友人は悪役の描写を出させ、定型的なコード生成でも有名だ。しかし、新しい具体的事実を発見するために使うのは災難に近い。偽造ボルトについて調べていたら、2018 年に偽造ファスナーを狙ったという “sword net” の事例と “Secure the Foundation, Eliminate the Fake” という文言を幻覚したが、Google、Brave、DuckDuckBing のどこにも根拠はなかった。結局、システムが一般的な偽造品と、より特殊な問題である偽造ファスナーを混同したわけで、こうした細かな区別が不可避なら、LLM はこの種の探索にはあまり役に立たない
    • 「単なるギミックより重要に見える」という感覚を説明すると、人間の会話には複数の会話の流れがあり得て、10 分ほど経つと話題が完全に変わり、元の話題に戻るのが難しくなることがある
      プロンプト履歴が見えるチャットとまったく同じではないが、会話はいまだにかなり線形だ。この UI は思考を分岐させられるので、その問題を前もって防いでくれる
    • 正直よく分からない。ChatGPT と何が違うのか気になる
  • 一歩引いて見ると、LLM 全般の UX/UI はまだ非常に未成熟だ。こうしたツールとやり取りする最善の方法はまだ初期段階なので、何が機能し、何が機能しないのかを見極めるには、こういう実験がもっと必要だ

    • 完全に同意。まだ表面すらまともに触れていない感じがする
      いま取り組んでいるプロジェクトでは、すべての LLM が一瞬見せる煩わしい Markdown 記法をなくしたり、文字のレンダリングを画面のリフレッシュレートに合わせて滑らかにしたりするような、分かりきっているが必要な実験をしている。https://llm-ui.com/
    • 基本的なチャットインターフェースは、ひどい Copilot のサイドパネルや、疑似 Material Design で過剰に磨き込んだ Google 風のインターフェースの試みより、はるかに良い
      マルチモーダルやディープリサーチのような特殊なケースでは改善の余地があるだろうが、純粋なテキストチャットだけで見れば、最も単純なインターフェースを改善するのは難しいと思う
    • ヒューマンコンピュータインタラクションが十分に発展して、いつかインターフェースが最後の手段になればいいと思う
    • Chrome 拡張機能の HLAI もこのアイデアを実験している
  • “delve” が内輪ネタだったのなら分かった。私にも AutoExpert (Chat) という Custom GPT があり、複数のレビュアーがトピックを学んでいく方式のため、「完璧な Rabbit Hole GPT」と呼んでいた
    無料ティアのユーザーも今はアクセスできるので、気に入るかもしれない。[0]: https://chatgpt.com/g/g-LQHhJCXhW-autoexpert-chat

    • これは気に入った。より深く掘り下げやすい点が良い。ただ、無料ユーザーには Custom GPT の使用量制限がかなりあるので、望むだけ深く入っていくのは難しいかもしれない
      弦理論、量子力学、古典的なローマのパスタ料理、イタリアワインについて尋ね、ドクニンジンの写真も送ってみたが、新しく一番好きな GPT を見つけた気がする。最近撮った写真の批評もさせてみたが、それも素晴らしく、かなり印象的だった
    • 全体的なアプローチは気に入っているが、これほど幻覚しやすいツールで「学習」するのが本当に大丈夫なのかは疑問だ
      大部分は正しいだろうが、運が悪いと幻覚された内容を知らないうちに覚えてしまい、実際の専門家の前で話したときに変な目で見られそうだ
    • これは本当に便利だ。専門家ロールの誘導、代替の専門家、反対の観点まで引き出すやり方が興味深い
      LLM でできることは、まだ始まったばかりという感じがする
    • 何のジョークなのか気になる
  • 気に入った。サイトがすぐ実行につながる点は良いが、ウォークスルーがあるとずっと良くなりそう
    開始プロンプトの中でそのままサイトを紹介してくれれば、目的を最初から理解しやすいと思う。たとえば最初の画面に [Explain what "delve into" is] のようなおすすめプロンプトがあり、回答として「興味深いものが別の興味深いものにつながる rabbit hole のように、トピックを深く探索するツールです。例は ...」と表示する形だ。その後、「オプション X をクリックして新しいスレッドを開始し、おすすめプロンプトを選ぶか自分で作成して、関連スレッドをたどりながらさらに深く進んでください」のように機能を段階的に案内すると良さそう

    • こういう開始案内が正味でプラスになるかは、思ったほど明確ではない。人々はこうしたガイド提案について二分される
      多くの人は非常に親切なウォークスルーが当然役に立つと言い、また多くの人は面倒だと言う。さまざまなサイトやアプリでシニア UX デザイナー、PM、ユーザーフィードバックをたくさん集めてきたが、改善点やベストプラクティスについて互いにしばしば矛盾する。もちろん実際に意見を出すのはそれを望む人たちで、イライラする人たちの声は聞こえにくいものだ。このプロジェクトは私には分かりやすく直感的なので、追加のウォークスルーは必要なさそうに見える
  • 本当に気に入った。ユーザーがテキストの任意の部分を選択して、今リンクが機能しているのと同じように使えるようにするのはどうだろう?
    たとえば人名はリンクとして扱われないようだが、Wikipedia で本文に言及された人物を簡単に調べられる点が好きだ。ページにリンクが何千個もできるより、テキスト中の名前を選択してボタンや右クリックメニューを押し、選択範囲ベースのプロンプトを作れると便利そうだ。こうしたカスタム用途なら、ユーザーが数回余分にクリックする必要があっても問題ないと思う

    • 8 ビット Atari コンピュータについて尋ねたら MOS 6502 CPU が入っていたと言ったが、その部分はリンクに変わらなかった。まさにそこから次の rabbit hole に入りたかった
  • 良いアイデア。Andy Matuschak のノートからも着想を得ているようだし、私もそのやり方が好き
    [0] https://notes.andymatuschak.org/zB74H9CuWrosEuqve7jZyCo?stac...

    • こういう形でノートを書ける Notion のような SaaS や Obsidian プラグインはあるだろうか?
  • 素晴らしいし、以前からあったらいいと思っていたもの。今のところタイルは 線形構造 になっている
    例えばタイル A がタイル B と C にリンクしている場合、B か C のどちらかをクリックすると A のすぐ横に新しいタイルが開き、一度に B か C のどちらか一方しか見えない。B と C がどちらも A から分岐して同時に見られるツリーレイアウトだとどうなるのか気になる

    • この点では範囲を一段広げて、LLM ツリー UI の実装だけを探すより、成熟した分野である 一般的なテキスト階層構造 を見るべきだと思う
      wikilink 風のドキュメントリポジトリを可視化する UI は、Obsidian プラグイン、ブラウザ拡張、Vim/Emacs プラグインなど、すでにたくさんあるはず。個人的に、いつか本を通じて世の中に押し出したい原則がいくつかある。キーではなくインデックスを使うこと、1つの集合は通常10個以下の N 個の要素だけを持つこと、各要素はローカルインデックス 3、またはルートから祖先インデックスをつなげた完全なパス 053 で参照すること。これは、偶然存在している wikilink 構造を単に可視化する場当たり的な「合成」アプローチとは対照的な、「分析的」アプローチの例だ。あらかじめ設計された構造を使うと自動可視化が可能になるので、そちらを好む。例えば、すべての SWE プロジェクトで同じ3/4個の12要素ディレクトリテンプレートを再利用する、といった具合で、多数の自動 LLM クエリで行うリサーチプロジェクトにもそのまま適用できる
    • 同意。UI はすでに素晴らしいが、ツリー型構造 があると格好いいと思う
    • 蜘蛛の巣図のようなもの?
  • とても気に入った。のんびり Wikipedia のリンクをたどっていく感じだが、新しい段階ごとに 以前のコンテキスト を保つという重要な違いがある
    私にとっては新しく、有用だ

    • https://wiki.c2.com/ でハマっていた rabbit hole セッションを思い出す。チャットとコンテキスト付きの rabbit hole ウィンドウのようなインターフェースが組み合わされれば、私には完璧かもしれない
  • わあ、本当に素晴らしい。Show HN では普段あまり感銘を受けることがなく、自分の冷めた反応が投稿者の邪魔になるのも望まないのであまりコメントしないのだが、時々こういう非常に素晴らしいものが出てくる
    Cloudflare Insights 以外にトラッキングがない点も本当に気に入った。業界の古くからの通説の一つに、人はアイデアについて「提案」をたくさんするほど、そのアイデアをより好む、というものがあるが、本当にその通りだ。よくできたプロジェクト。収益化オープンソース の計画があるのか気になる

  • 分岐型の会話 はさまざまな理由で素晴らしい。以前プロトタイプのデモを投稿した: https://x.com/ajdegol/status/1788689011302682657
    Jake Collins も、多機能な Obsidian プラグインをオープンソースで公開すると発表していた: https://x.com/JacobColling/status/1795462258258002255

    • この方向が正しいと思う。プログラムを作るときにもこれを使うと想像してみると、生成された関数をドラッグして配置し、視覚的につなげられる
      各関数が自分のノードになり、入力と出力をドラッグ&ドロップで調整すると、AI が魔法のように要件を把握してくれる、という感じ
    • 私も分岐という面では非常によく似たアプリを作っている。右側の可視化はまだないが、似たものと Git のようなグラフ の両方をサポートする予定
      1: https://msty.app