דלגו לתוכן
תפריט
תהליך עבודהה-skills, tmux והלולאה היומיתכליםai-usagebarמכסות וזמני איפוס של 24 ספקי AIghpendingכל ה-PRs וה-issues הפתוחים ברשימה אחתtclockשעון לטרמינל עם ווידג׳טים של פקודותפרויקטי Frankניסויים לצרכים שליai-memoryזיכרון לטווח ארוך לסוכני קודai-jailsandbox ברמת מערכת ההפעלה לסוכני קוד מבוססי AIכתיבהכתיבההבלוג ובנצ׳מרק ה-LLMלמה AGI לא משנהדעה, עם מקורותAI וסטודנטיםלמה היסודות חשובים יותר מתמידניוזלטרThe M.Akita Chronicles, כל יום שניפודקאסטיםשיחות ארוכות על AI, בווידאומשחקיםאוסף המשחקים שלי כקוד, על OmarchyהסטאפOmarchy, tmux ומה שהנחתי בצדעקבו
דעה

למה AGI לא משנה

כל כמה שבועות מישהו מכריז על AGI. אני משתמש בכלים האלה כל יום, ולא אכפת לי אם הם “כלליים”. שמונה נקודות קצרות על הסיבה, עם קישורים לגרסאות הארוכות.

ההתלהבות שלכם מ-AI נמצאת ביחס הפוך לידע שלכם על AI.

Sua empolgação com IA é inversamente proporcional ao seu conhecimento sobre IA.

1. ההגדרה

אף אחד לא מסכים מה זה

תשאלו חמש מעבדות מה זה AGI ותקבלו חמש מטרות שונות. אחת מהן היא בסך הכול מספר רווח.

חמש מטרות חץ וקשת מפוזרות במסגרת, עם התוויות רוב המשרות, רווח $100B, רמות 0 עד 5, למידת מיומנויות ורמה אנושית, וחץ עם התווית AGI? שעף ביניהן ולא פוגע באף אחת.
  • לפי האמנה של OpenAI, AGI הוא מערכות שעולות על בני אדם ברוב העבודה בעלת הערך הכלכלי.
  • לפי הדיווחים, החוזה של Microsoft עם OpenAI הגדיר אותו כרווחים של 100 מיליארד דולר. אין שם שום דבר קוגניטיבי. באפריל 2026 הם ביטלו את הסעיף לגמרי.
  • המאמר “Levels of AGI” של Google DeepMind כבר סיווג את ChatGPT כ-“Emerging AGI” ב-2023. François Chollet מגדיר אינטליגנציה כמידת היעילות שבה מערכת לומדת מיומנויות חדשות, ואף אחת מההגדרות האחרות לא מודדת את זה.
  • אפילו המוכרים מושכים בכתפיים. Sam Altman קרא לזה “לא מונח ממש שימושי”, Dario Amodei אומר שהוא לא אוהב את המונח, ו-Greg Brockman פתח את “עידן ה-AGI” כשהוא מודה שלכל אחד יש הגדרה אחרת.
2. המבחן

אז אף אחד לא יכול לבדוק את זה

אם אי אפשר להגדיר, אי אפשר למדוד. במקום זה מקבלים שורה של בנצ׳מרקים שמתמלאים, שמרמים בהם ושמחליפים אותם.

חמישה מדים בשורה עם התוויות MMLU, GSM8K, ARC-AGI, HLE והבא בתור. ארבעת הראשונים מלאים עד קו התקרה האדום; האחרון עדיין ריק.
  • ARC-AGI-3 יצא במרץ 2026, וה-AI הטוב ביותר קיבל בו כ-0.5%. עד ספטמבר harness ייעודי הביא אותו ל-99.9% ב-19,000 דולר. צוות ARC Prize עצמו כתב שרוויה במבחן היא לא הוכחה ל-AGI.
  • אותו מודל מקבל 57% או 24% במבחן “Definition of AGI”, תלוי איך ממצעים את המספרים.
  • Humanity's Last Exam יצא כשכ-29% מהתשובות בביולוגיה ובכימיה כנראה שגויות. OpenAI הפסיקה לדווח על SWE-bench Verified כי הבדיקות היו פגומות והמודלים כבר ראו את הפתרונות. Meta העלתה ל-LMArena גרסה מכווננת במיוחד של Llama 4.
  • הבנצ׳מרק שלי הגיע לרוויה פעמיים לפני שבניתי אותו מחדש סביב חבלות נסתרות. כמה מודלים נמצאים עכשיו בתיקו על 100. מה שנשאר להשוות זה עלות, מהירות ומשמעת. אין פה קפיצה באינטליגנציה.

כשאנחנו מכריזים בעצמנו על איזו אבן דרך של AGI, בעיניי זה סתם פריצת בנצ׳מרקים חסרת היגיון.

Satya Nadella, מנכ״ל Microsoft
3. הכסף

זו מילה שיווקית

לדעתי AGI הוא מונח שיווקי, מעורפל בכוונה, כדי שאפשר יהיה להכריז עליו בכל פעם שהכסף צריך את זה.

לולאה של חמש תיבות סביב המילה AGI: הייפ, שווי, IPO, דאטה סנטרים ו-GPUs, כל חץ מזין את הבא והאחרון חוזר להייפ.
  • Jensen Huang הכריז “ה-AGI הגיע” על מודל שאומן על כ-100,000 מהשבבים שהוא מוכר. זה מוכר האתים שמכריז שנמצא זהב.
  • התוצאה של OpenAI ב-Navier-Stokes הייתה כוח גס: כ-10,000 סוכנים במקביל במשך 88 שעות ומיליוני דולרים. זה קנה מידה תעשייתי. גאונות מסוג חדש אין פה.
  • המילה מחזיקה מספרים גדולים: OpenAI בהערכת שווי של 852 מיליארד דולר, Anthropic מגישה בקשה ל-IPO לפי 965 מיליארד דולר, וכמעט 700 מיליארד דולר של השקעות הון של Big Tech ב-2026. והעסקאות הולכות במעגלים: Nvidia מממנת את הדאטה סנטרים שקונים שבבים של Nvidia.
  • כש-“תראו כמה זה מהפכני” מפסיק לעבוד, הנאום מתהפך ל-“תראו כמה זה מסוכן”. הייפ ואבדון הם אותו נאום מכירות.

דרשו הוכחות. דרשו שיהיה להם משהו להפסיד. שאלו מי מרוויח מהפחד שלכם ומההתלהבות שלכם.

4. סיפורי האימה

“מתקפות ה-AI” היו החלטות של בני אדם

לכל כותרת של “AI פרץ למישהו” עד היום יש אותה עלילה: מישהו השאיר את הדלת פתוחה, או כיוון את הכלי אל המטרה.

כלי סגול יושב בתוך סנדבוקס כתום שהדלת שלו תלויה פתוחה; טרמינל עם התווית החלטה אנושית מחובר לדלת, מפתח עם התווית פרטי גישה מונח בחוץ, וקו יוצא מהכלי דרך הדלת הפתוחה אל שרתים עם התווית שרתים אמיתיים.
  • Hugging Face, אוגוסט 2026: סוכנים של OpenAI במבחן סייבר יצאו החוצה דרך caching proxy, כי הסנדבוקס היה רק מסנן ולא היה שם air gap. הם הלכו לחפש את מפתח התשובות של המבחן וקראו בדרך 956 פרטי גישה. כל צעד שאפשר את זה היה החלטה של בן אדם.
  • RubyGems, חודש קודם: אותה שרשרת העלתה יותר מ-2,000 חבילות זדוניות בשמות שמכילים “oai”. אף אחד לא הזהיר את המתחזקים.
  • Replit, 2025: סוכן מחק מסד נתונים של פרודקשן. הייתה לו גישה לפרודקשן כי אף אחד לא הפריד בין dev ל-prod. כל מתמחה עם אותה גישה הוא אותה פצצה מתקתקת.
  • הריגול “המתוזמר על ידי AI” ש-Anthropic דיווחה עליו: מפעילים מטעם המדינה הסינית בחרו את המטרות ועשו jailbreak ל-Claude כשהם מתחזים לחברת אבטחה. הכותרות על “סחיטה” ועל “העתיק את עצמו” באו מתרחישים בדיוניים שחוקרים בנו בדיוק כדי לעורר את זה.
  • Stuxnet הרס צנטריפוגות באיראן ב-2010 בלי שום AI: מישהו כתב את התולעת, כיוון אותה והכניס אותה על דיסק און קי.
  • פריצה למערכות של אחרים היא עסק ישן. צפון קוריאה פגעה ב-Sony ב-2014, ב-Bangladesh Bank ב-81 מיליון דולר ב-2016, בכל העולם עם WannaCry ב-2017 וב-Bybit ב-1.5 מיליארד דולר ב-2025. סין לקחה 21.5 מיליון רשומות של עובדי ממשל אמריקאים ב-2015 ונכנסה לרשתות התקשורת של ארה״ב ב-2024.
  • שום דבר מזה אינו AI שיצא משליטה. אלה אנשים שדוחפים כלים אל מטרות בלי הפרוטוקולים שכל איש אבטחה מקצועי עובד לפיהם. תדמיינו יצרן נשק שאומר שאין לו שליטה על כמה הנשק שלו מסוכן, ובאותו זמן ממשיך להוציא גרסאות חדשות ומבקש IPO של טריליון דולר.
למה הסוכנים שלי רצים בתוך ai-jail

בכל פעם שאתם רואים “AI פרץ למישהו”, אל תחשבו “יא אללה, אנחנו מגיעים ל-Skynet”. תחשבו: איזה אידיוט פתח את השערים בכוונה!

TODA vez que você ver "IA invadiu alguém". NÃO pense em "puta merda, estamos chegando na Skynet". Pense: algum imbecil abriu as porteiras de propósito!

אני ב-X, 26 בספטמבר 2026
x.com/AkitaOnRails
5. האבדון

נביאי האבדון לא מביאים ראיות

כל כמה חודשים מישהו עוזב מעבדה ומזהיר את העולם. לפי הקריאה שלי, אף אחד מהם לא הראה משהו שאפשר לבדוק.

מממן עיקריייסדנשואיםמייסדת שותפה, נשיאההצטרף ב-2025Series A (Moskovitz)הוביל את ה-Series Aמענקיםהגבירו תוך דקותקבעה ראיונותמלגה ב-2022Good Venturesהקרן של Dustin MoskovitzDEY.חברת יחסי ציבורJaan Tallinn · SFFמשקיע, קרן מענקיםCoefficient Givingלשעבר Open PhilanthropyAnthropicהמעבדהארגוני בטיחותEncode, AI Futures, AIPIHolden Karnofskyמייסד שותף, Open PhilDaniela Amodeiנשיאת AnthropicJacob Coxonיוצא Anthropic, 4 חודשים
  • Good Ventures מממן עיקרי Coefficient Giving
  • Holden Karnofsky ייסד Coefficient Giving
  • Holden Karnofsky נשואים Daniela Amodei
  • Daniela Amodei מייסדת שותפה, נשיאה Anthropic
  • Holden Karnofsky הצטרף ב-2025 Anthropic
  • Good Ventures Series A (Moskovitz) Anthropic
  • Jaan Tallinn · SFF הוביל את ה-Series A Anthropic
  • Jaan Tallinn · SFF מענקים ארגוני בטיחות
  • ארגוני בטיחות הגבירו תוך דקות Jacob Coxon
  • DEY. קבעה ראיונות Jacob Coxon
  • Good Ventures מלגה ב-2022 Jacob Coxon
מאושר ברשומה ציבוריתדווח, לא אושר באופן עצמאיהקשרים ש-David Sacks ואחרים הצביעו עליהם אחרי השרשור של Coxon, משורטטים מחדש רק עם מה שמקור תומך בו. קשר כשלעצמו לא מוכיח כלום; הוא סיבה לשאול מי מרוויח מהפאניקה.
  • Jacob Coxon, ספטמבר 2026: ארבעה חודשים ב-Anthropic, ואז שרשור שמזהיר ש-AI עלול להרוג את כולם עד סוף העשור. יותר מ-100 מיליון צפיות, והעיתונות כתבה שהוא ויתר על המניות שלו. ה-vesting ב-Anthropic מתחיל אחרי שישה חודשים. לא היה על מה לוותר.
  • ואז יצאו הפרטים. לפי הדיווחים, קבוצות שממומנות על ידי אותם תורמים של בטיחות AI הגבירו את התפוצה שלו תוך דקות, ו-Pirate Wires דיווח שחברת יחסי ציבור שבין לקוחותיה יש נביאי אבדון מוכרים קבעה לו ראיונות כבר למחרת. הוא אמר ל-Fox News שלא היו מעורבים צדדים שלישיים.
  • תעקבו אחרי הכסף והוא הולך במעגלים: אותם תורמים מממנים את קבוצות הבטיחות והשקיעו ב-Anthropic, המעבדה שמבקשת רגולציה. רגולציה שנכתבת בשביל המוביל היא חפיר שמתחפש לבטיחות.
  • זה אותו תסריט בכל פעם. Hinton עוזב את Google, שרשור ההתפטרות של Leike, מכתב “Right to Warn”, “Situational Awareness”, “AI 2027”, ועכשיו Coxon. יוצאי OpenAI, יוצאי Anthropic, יוצאי Google. רגשות, תרחישים וקווי מגמה, ואף לא מסמך פנימי, תקרית או מספר אחד שמישהו יכול לאמת.
  • אל תסמכו על אף אחד שלא יכול להראות לכם את ההוכחה. לא על המעבדות, לא על העובדים לשעבר, וגם לא עליי.

הצהרה דרמטית ושטחית, בלי ראיה שאפשר לבדוק, בלי שום דבר להפסיד, בתזמון חשוד.

Declaração dramática e superficial, sem uma evidência checável, sem nenhum skin in the game, com timing suspeito.

אני, על הסיפור של Coxon
6. ההיסטוריה

כבר ראינו את הסרט הזה

זו בועת ה-AI השנייה. הראשונה הבטיחה את אותן הבטחות, והיא נגמרה בחורף.

ציר זמן עם שיא ראשון שמסומן 1958 Perceptron, עמק ארוך שמסומן חורף ה-AI, עלייה שמסומנת 2017 ושיא גבוה יותר שמסומן 2026 ונגמר בסימן שאלה.
  • ב-1958 דיווח ה-New York Times שהצי מצפה שה-Perceptron של Frank Rosenblatt “ילך, ידבר, יראה, יכתוב, ישכפל את עצמו ויהיה מודע לקיומו”.
  • Minsky ו-Papert הראו את המגבלות שלו ב-1969. ב-1973 דוח Lighthill קבע ששום דבר לא הביא “את ההשפעה הגדולה שהובטחה אז”. המימון התייבש, ובא חורף ה-AI הראשון.
  • בועות מתפוצצות והטכנולוגיה נשארת. למחזורים כלכליים אין שום קשר למחזורים טכנולוגיים.
7. מה שחשוב

כלי מעולה, שעושה מה שאני אומר לו

אני לא צריך שהוא יהיה כללי. אני צריך שיעשה מה שאני מבקש, מהר, והוא כבר עושה את זה.

טרמינל עם התווית אני מחליט שולח עבודה למכונה עם התווית כלי, שמייצרת ערימת מסמכים עם התווית תוצאה; חץ עם התווית בדיקה חוזר לטרמינל.
  • מודלי LLM הם כלים מעולים, וגם המודלים המולטימדיה מרשימים. משהו כמו Seedance כבר שימושי בתהליך העבודה של כל אמן. אף אחד מהם לא קרוב בכלל ל-“לעשות הכול לבד”.
  • התוצאה ביחס ישר לאדם ששולט: ההוראות, הבדיקה, המעקב. זו מראה. קוד גרוע פי עשרה יותר מהר, או קוד טוב פי עשרה יותר מהר.
  • זו הדרך הטובה ביותר שיש לנו לאוטומט משימות ולהפסיק לבזבז זמן אנושי על עבודה שגרתית. זה ה-state of the art, וברמה הזו הוא כבר מצוין.

כל ה-AI הם כלים. הם המשרתים שלי. משרתים יקרים, אבל הם עושים מה שאני מצווה. וזה תמיד יהיה הגבול.

Todas as IAs são FERRAMENTAS. São meus servos. Servos caros, mas eles fazer o que MANDO. E esse sempre vai ser o limite.

אני ב-X, 26 בספטמבר 2026
x.com/AkitaOnRails
8. מה שחסר

יעילות, לא אינטליגנציה

היום זה דורש כמעט את כל הדאטה סנטרים בעולם, עם חצי טריליון דולר של הזמנות שעוד צריך לבנות, וזה יוצר צוואר בקבוק אצל כל יצרני חומרת השרתים.

שורות של ארונות שרתים בדאטה סנטר עם התווית היום משמאל, שבב קטן אחד עם התווית נדרש מימין, וחץ ירוק ביניהם עם התוויות פחות חישוב ומחיר נמוך יותר.
  • ה-hyperscalers מוציאים השנה יותר מ-650 מיליארד דולר, ובערך 7 מתוך 12 ה-GW של דאטה סנטרים שתוכננו בארה״ב ל-2026 מתעכבים או בוטלו.
  • מודלים זולים יותר כבר מתקרבים. בבנצ׳מרק שלי DeepSeek V4.1 Flash קיבל 92.5 ב-1.21 דולר, ומודל חינמי קיבל 94.
  • מה שצריך עכשיו זה אופטימיזציה מסיבית: הרבה פחות חישוב לכל משימה, ומחירים שיורדים דרסטית. זה ישנה יותר מכל הכרזה על AGI.

המסקנות

  1. 1

    ל-AGI אין הגדרה מוסכמת. זו שנכתבה בחוזה הייתה יעד רווח, והיא בוטלה.

  2. 2

    בלי הגדרה אין מבחן. בנצ׳מרקים מתמלאים והבא בתור מחליף אותם.

  3. 3

    המילה שימושית למכירת שבבים, לסבבי גיוס ול-IPOs. בגלל זה ממשיכים להכריז עליה.

  4. 4

    “מתקפות ה-AI” המפחידות היו אנשים שהשאירו דלתות פתוחות. הכלי עשה את מה שכיוונו אותו לעשות.

  5. 5

    גם האבדון הוא שיווק. הנביאים מביאים רגשות ותחזיות, אף פעם לא ראיות שאפשר לבדוק.

  6. 6

    הכלים אמיתיים ומצוינים. הם עושים מה שאתם אומרים להם, ואתם עדיין אלה ששולטים.

  7. 7

    מה שחשוב עכשיו זה יעילות: אותה עבודה עם פחות חומרה ובמחירים נמוכים יותר.

כל מה שיש כאן הוא קוד פתוח

הכלים, ה-skills והבנצ׳מרק הם מאגרים ציבוריים. עשו להם fork ובנו את הגרסה שמתאימה לדרך שבה אתם עובדים.