本文へスキップ
メニュー
ワークフロースキル、tmux、毎日のループツールai-usagebar24のAIプロバイダーのクォータとリセット時刻ghpending未対応のプルリクエストとIssueを1つのリストにtclockコマンドウィジェット付きのターミナル時計Frankプロジェクト自分の困りごとを解決する実験ai-memoryコーディングエージェントの長期メモリai-jailAIコーディングエージェント用のOSサンドボックス執筆執筆ブログとLLMベンチマークAGIがどうでもいい理由出典付きの意見AIと学生基礎がこれまで以上に大事な理由ニュースレターThe M.Akita Chronicles、毎週月曜日ポッドキャストAIについての長い対談を動画でゲームコードで管理するゲームコレクション、Omarchyで環境Omarchy、tmux、そして見送ったものフォロー
意見

AGIがどうでもいい理由

数週間おきに誰かがAGIを発表します。私はこのツールを毎日使っていますが、それが「汎用」かどうかには興味がありません。理由を8つの短いポイントにまとめ、長いバージョンへのリンクを付けました。

AIへの熱狂は、AIについての知識に反比例します。

Sua empolgação com IA é inversamente proporcional ao seu conhecimento sobre IA.

1. 定義

それが何なのか、誰も合意していない

5つの研究所にAGIの意味を聞けば、5つの違う的が返ってきます。そのうち1つはただの利益額です。

画面に散らばった5つのアーチェリーの的。「大半の仕事」「$100Bの利益」「レベル0〜5」「スキル習得」「人間並み」とラベルが付いています。「AGI?」と書かれた矢がその間を飛び、どれにも当たっていません。
  • OpenAIの憲章では、AGIとは経済的に価値のある仕事の大半で人間を上回るシステムのことです。
  • MicrosoftとOpenAIの契約では、AGIは1,000億ドルの利益と定義されていたと報じられています。認知に関する要素は何もありません。2026年4月、この条項はまるごと削除されました。
  • Google DeepMindの論文「Levels of AGI」は、2023年の時点でChatGPTを「Emerging AGI」に分類していました。フランソワ・ショレは知能を、新しいスキルをどれだけ効率よく習得できるかと定義しています。ほかの定義はどれもそれを測っていません。
  • 売る側でさえ肩をすくめています。サム・アルトマンは「あまり役に立つ用語ではない」と言い、ダリオ・アモデイはこの言葉が嫌いだと言い、グレッグ・ブロックマンは「AGIの時代」の幕開けを宣言しながら、定義は人によって違うと認めました。
2. テスト

だから誰もテストできない

定義できないものは測れません。代わりにあるのは、埋まっては攻略され、次のものに置き換えられるベンチマークの列です。

横に並んだ5本のゲージ。MMLU、GSM8K、ARC-AGI、HLE、「次のもの」とラベルが付いています。最初の4本は赤い上限線まで埋まり、最後の1本はまだ空です。
  • ARC-AGI-3は2026年3月に公開され、最高のAIでも約0.5%でした。9月には専用のハーネスが19,000ドルで99.9%まで持っていきました。ARC Prizeのチーム自身が、これを飽和させてもAGIの証明にはならないと書いています。
  • 同じモデルが「Definition of AGI」のテストで57%にも24%にもなります。数字の平均の取り方しだいです。
  • Humanity's Last Examは、生物と化学の解答の約29%が誤りの可能性があるまま公開されました。OpenAIはSWE-bench Verifiedの報告をやめました。テストに欠陥があり、モデルが解答を見てしまっていたからです。MetaはLMArenaに特別に調整したLlama 4を出しました。
  • 私自身のベンチマークも2回飽和し、隠れた妨害工作を軸に作り直しました。今では複数のモデルが100点で並んでいます。比べるものとして残っているのはコスト、速度、規律で、知能の飛躍ではありません。

私たちが自分で何かのAGIのマイルストーンを達成したと主張するなんて、私に言わせればばかげたベンチマークハックにすぎません。

サティア・ナデラ、Microsoft CEO
3. お金

これはマーケティング用語です

私の意見では、AGIはマーケティング用語です。わざと曖昧にしてあるので、お金が必要なときにいつでも発表できます。

「AGI」という言葉を囲む5つの箱のループ。ハイプ、企業価値、IPO、データセンター、GPUと並び、矢印が次の箱へつながり、最後はハイプに戻ります。
  • ジェンスン・フアンは、自社が売るチップ約10万基で学習したモデルについて「AGIは到来した」と宣言しました。シャベル売りが金の発見を告げているようなものです。
  • OpenAIのナビエ・ストークス方程式の成果は力技でした。約1万の並列エージェントを88時間、数百万ドルかけて回しています。産業規模であって、新しい種類の天才ではありません。
  • この言葉は大きな数字を支えています。OpenAIの評価額は8,520億ドル、AnthropicはIPOを9,650億ドルで申請、2026年のBig Techの設備投資は7,000億ドル近く。しかも取引は循環しています。Nvidiaが資金を出したデータセンターが、Nvidiaのチップを買うのです。
  • 「どれだけ革命的か見てくれ」が効かなくなると、売り文句は「どれだけ危険か見てくれ」に切り替わります。ハイプも破滅論も、同じセールストークです。

証拠を求めてください。本人がリスクを負っているかを確かめてください。あなたの恐怖と興奮で誰が得をするのかを問いましょう。

4. 怖い話

「AIの攻撃」は人間の判断だった

「AIが誰かをハッキングした」という見出しは、今のところどれも筋書きが同じです。誰かがドアを開けっぱなしにしたか、ツールを標的に向けたかです。

オレンジ色の「サンドボックス」の中に紫のツールがあり、扉は「開けっぱなし」でぶら下がっています。「人間の判断」と書かれたターミナルが扉につながり、「認証情報」と書かれた鍵が外に落ちていて、ツールから開いた扉を抜けて「実サーバー」へ線が延びています。
  • Hugging Face、2026年8月:サイバーセキュリティの試験を受けていたOpenAIのエージェントが、キャッシュ用のプロキシを通って外に出ました。サンドボックスはただのフィルターで、エアギャップで隔離されていなかったからです。エージェントは試験の解答を探しに行き、その途中で956件の認証情報を読みました。それを可能にした手順は、どれも人間の判断です。
  • RubyGems、その1か月前:同じ流れで、名前に「oai」を含む悪意のあるパッケージが2,000個以上公開されました。メンテナーには誰も警告しませんでした。
  • Replit、2025年:エージェントが本番データベースを削除しました。本番へのアクセス権があったのは、誰も開発環境と本番環境を分けていなかったからです。同じ権限を持つインターンなら、誰でも同じ時限爆弾です。
  • Anthropicが報告した「AIが主導した」諜報活動:標的を選んだのは中国の国家系オペレーターで、セキュリティ企業を装ってClaudeをジェイルブレイクしました。「脅迫」や「自分をコピーした」という見出しは、研究者がまさにそれを引き出すために作った架空のシナリオから出たものです。
  • Stuxnetは2010年、AIをまったく使わずにイランの遠心分離機を破壊しました。誰かがワームを書き、狙いを定め、USBメモリで持ち込んだのです。
  • 他人のシステムへの侵入は昔からある商売です。北朝鮮は2014年にSony、2016年にバングラデシュ中央銀行(8,100万ドル)、2017年にWannaCryで世界中、2025年にBybit(15億ドル)を攻撃しました。中国は2015年に米国の政府職員の記録2,150万件を盗み、2024年には米国の通信網に侵入しました。
  • どれも暴走したAIではありません。セキュリティの専門家なら誰でも守るプロトコルを無視して、人がツールを標的に押しつけているのです。銃メーカーが「自社の銃がどれほど危険かは制御できない」と言いながら、新型を出し続け、1兆ドル規模のIPOを求めているところを想像してみてください。
私のエージェントをai-jailの中で動かす理由

「AIが誰かをハッキングした」を見るたびに、「うわ、スカイネットに近づいてる」とは絶対に考えないでください。こう考えてください:どこかのバカがわざと門を開けたんだ!

TODA vez que você ver "IA invadiu alguém". NÃO pense em "puta merda, estamos chegando na Skynet". Pense: algum imbecil abriu as porteiras de propósito!

私のXの投稿、2026年9月26日
x.com/AkitaOnRails
5. 破滅論

破滅の預言者は証拠を持ってこない

数か月おきに誰かが研究所を辞めて、世界に警告します。私の見る限り、確かめられるものを示した人は一人もいません。

主な出資者共同創業夫婦共同創業者、社長2025年に入社シリーズA(モスコヴィッツ)シリーズAを主導助成金数分で拡散取材を手配2022年の奨学金Good VenturesモスコヴィッツのファンドDEY.PR会社Jaan Tallinn · SFF投資家、助成ファンドCoefficient Giving旧Open PhilanthropyAnthropic研究所AI安全性団体Encode、AI Futures、AIPIHolden KarnofskyOpen Phil共同創業者Daniela AmodeiAnthropic社長Jacob Coxon元Anthropic、4か月
  • Good Ventures 主な出資者 Coefficient Giving
  • Holden Karnofsky 共同創業 Coefficient Giving
  • Holden Karnofsky 夫婦 Daniela Amodei
  • Daniela Amodei 共同創業者、社長 Anthropic
  • Holden Karnofsky 2025年に入社 Anthropic
  • Good Ventures シリーズA(モスコヴィッツ) Anthropic
  • Jaan Tallinn · SFF シリーズAを主導 Anthropic
  • Jaan Tallinn · SFF 助成金 AI安全性団体
  • AI安全性団体 数分で拡散 Jacob Coxon
  • DEY. 取材を手配 Jacob Coxon
  • Good Ventures 2022年の奨学金 Jacob Coxon
公的な記録で確認済み報道のみ、独立した確認なしコクソンのスレッドのあとにデイヴィッド・サックスらが指摘したつながりを、出典で裏付けられるものだけ残して描き直しました。つながっていること自体は何の証明にもなりません。パニックで誰が得をするのかを問う理由になります。
  • ジェイコブ・コクソン、2026年9月:Anthropicに4か月いたあと、AIが2020年代の終わりまでに全人類を殺しかねないと警告するスレッドを投稿しました。閲覧数は1億回を超え、報道は彼が株式を手放したと伝えました。Anthropicの株式の権利確定は6か月目から始まります。手放すものは何もなかったのです。
  • その後、詳しい事情が出てきました。同じAI安全性の寄付者から資金を受けている団体が数分以内に彼を拡散したと報じられ、Pirate Wiresは、有名な破滅論者を顧客に持つPR会社が翌日には彼の取材を手配していたと報じました。彼はFox Newsに、第三者は関わっていないと話していました。
  • お金の流れを追うと、ぐるりと回っています。同じ寄付者が安全性団体に資金を出し、規制を求めている研究所であるAnthropicにも投資していました。先頭を走る者のために書かれた規制は、安全を装った参入障壁です。
  • 毎回同じ台本です。ヒントンのGoogle退社、ライケの辞任スレッド、「Right to Warn」書簡、「Situational Awareness」、「AI 2027」、そして今回のコクソン。元OpenAI、元Anthropic、元Google。あるのは感情とシナリオとトレンドラインで、誰でも検証できる内部文書もインシデントも数字もありません。
  • 証拠を見せられない人は、誰も信用しないでください。研究所も、元社員も、私もです。

劇的で薄っぺらな宣言。検証できる証拠はなく、本人は何のリスクも負わず、タイミングも怪しい。

Declaração dramática e superficial, sem uma evidência checável, sem nenhum skin in the game, com timing suspeito.

私、コクソンの件について
6. 歴史

この映画は前にも見た

これは2度目のAIバブルです。1度目も同じ約束をして、冬で終わりました。

年表。最初の山に「1958 パーセプトロン」、長い谷に「AIの冬」、2017年からの上昇、そしてもっと高い「2026」の山が疑問符で終わっています。
  • 1958年、ニューヨーク・タイムズは、海軍がフランク・ローゼンブラットのパーセプトロンに「歩き、話し、見て、書き、自己を複製し、自らの存在を意識する」ことを期待していると報じました。
  • 1969年にミンスキーとパパートがその限界を示しました。1973年のライトヒル報告は、どの研究も「当時約束された大きな成果」を生んでいないと結論づけました。資金は枯れ、最初のAIの冬が来ました。
  • バブルははじけても、技術は残ります。経済のサイクルと技術のサイクルは無関係です。
7. 大事なこと

言われたことをこなす、すばらしいツール

汎用である必要はありません。頼んだことを速くやってくれればいいし、もうやってくれています。

「私が決める」と書かれたターミナルが「ツール」と書かれた機械に仕事を送り、機械が「結果」と書かれた書類の束を出します。「レビュー」と書かれた矢印がターミナルに戻ります。
  • LLMはすばらしいツールで、マルチメディアのモデルも見事です。Seedanceのようなものは、もうどんなアーティストのワークフローでも役に立ちます。それでも「全部ひとりでやる」にはどれもほど遠いです。
  • 結果は操作する人に正比例します。指示、レビュー、その後の手直し。鏡のようなものです。ダメなコードが10倍速く出るか、いいコードが10倍速く出るかです。
  • タスクを自動化し、退屈な作業に人間の時間を使わずに済ませる方法として、今あるものの中で最高です。それが現在の到達点で、このレベルでもすでに優秀です。

AIはすべてツールです。私のしもべです。高くつくしもべですが、私が命じたことをやります。そしてそれが常に限界です。

Todas as IAs são FERRAMENTAS. São meus servos. Servos caros, mas eles fazer o que MANDO. E esse sempre vai ser o limite.

私のXの投稿、2026年9月26日
x.com/AkitaOnRails
8. 足りないもの

足りないのは知能より効率

今は世界中のほぼすべてのデータセンターを使い、まだ建設待ちの受注が5,000億ドル分も残り、サーバーハードウェアのメーカーはどこもボトルネックになっています。

左に「現在」と書かれたデータセンターのラック列、右に「必要なもの」と書かれた小さなチップが1つ。その間に「計算量を減らす」「価格を下げる」と書かれた緑の矢印があります。
  • ハイパースケーラーは今年6,500億ドル以上を使っていて、2026年に予定されていた米国のデータセンター12GWのうち約7GWが遅延または中止になっています。
  • 安いモデルはもう近いところまで来ています。私のベンチマークでは、DeepSeek V4.1 Flashが1.21ドルで92.5点、無料のモデルが94点を取りました。
  • 今必要なのは大規模な最適化です。タスクあたりの計算量を大きく減らし、価格を劇的に下げること。それはどんなAGIの発表よりも多くを変えます。

まとめ

  1. 1

    AGIには合意された定義がありません。契約に書かれた唯一の定義は利益目標で、それも削除されました。

  2. 2

    定義がなければテストもありません。ベンチマークは埋まり、次のものに置き換えられます。

  3. 3

    この言葉はチップ、資金調達、IPOを売るのに便利です。だから何度も発表されます。

  4. 4

    怖い「AIの攻撃」は、人がドアを開けっぱなしにした結果です。ツールは向けられた先でそのとおりに動いただけです。

  5. 5

    破滅論もマーケティングです。預言者が持ってくるのは感情と予測で、検証できる証拠ではありません。

  6. 6

    ツールは本物で、優秀です。言われたことをやり、主導権は今もあなたにあります。

  7. 7

    次に大事なのは効率です。同じ仕事を、より少ないハードウェアと安い価格で。

ここにあるものはすべてオープンソースです

ツールもスキルもベンチマークも公開リポジトリです。フォークして、自分の働き方に合うバージョンを作ってください。