KarpathyのLLM Wikiパターン(https://gist.github.com/karpathy/…
どのように動いているか
- 毎朝、エージェントがarXiv・HuggingFace Daily Papers・各ラボの公式ブログ・X・中国のラボ(DeepSeek・Qwen・Moonshot・Z.ai・MiniMaxをローテーション)・US Federal Registerを収集
- 元のスナップショットを不変のまま保存し、組織/モデル/概念/論文ページを生成・更新(すべての事実に出典引用を強制)
- 機械的なフィードポーリングはGitHub Actionsが毎時行い、LLMは判断・執筆のみ(candidatesファイルで引き継ぎ)
- 日曜日には週次総合(synthesis)とWiki整合性lintを別途実行します
現在の規模(2026-07-26)
- Wiki 107ページ / 相互リンク371件 — ホームがそのリンクグラフです。ノードはすべて実際のページリンクで、ノードにマウスを重ねると、そのページが引用しているものだけがハイライトされます
- モデルリリースのタイムライン51件(リリース/発表状態を区別)
- 週次総合10週分、日次ブリーフ56件
- 2026-05-16の開始から72日目の無人運用
作りながら分かったこといくつか
- 検索でソースをポーリングすると、捕捉が中央値で+6日遅れました。RSSの直接ポーリングに切り替え、中国のラボをローテーションに入れた後は+1〜4日に縮まりました(以前は+27〜46日遅れたものもありました)
- HTTP 200を返しながら、実際には死んでいるフィードが5つありました(2018年で止まったスタブ、soft-404など)。項目数と最新日付を一緒に測らないと、「死んだソース」と「静かな週」を区別できません
- パイプラインの運用ログ(捕捉遅延バッジ、ランキングスコア、dedupリスト)が読者画面にそのまま露出していました。運用者向けの記録と読者向けの紙面を分離しました
- モデル仕様表で値がない場合、行を削除せずに
unknownとして残すように変えました。欠けた行は見えませんが、unknownは数えられるので、毎週lintがカバレッジを追跡します
RSSとメール購読(ダブルオプトイン)もあります。フィードバック歓迎です——特に「こういう情報がもっと見えるとよい」という点について。
まだコメントはありません。