→ חזרה לכל הדוחות

Loop Engineering — האם זו מסגרת אמיתית או שם חדש למה שאנחנו כבר עושים

2026-07-26 · loop engineering

שורה תחתונה

אימוץ חלקי — קח שלושה כלים מכניים, דלג על המסגרת. "Loop engineering" הוא מונח אמיתי שנטבע ביוני 2026, אבל לא על ידי בעל הריפו: אדי אוסמני טבע אותו, וקובוס גריילינג בנה סביבו כלים. מבחינה רעיונית אין שם כלום שאתה לא עושה כבר — ה-pm-loop שלך (מכונת מצבים חסומה, מאמת בקונטקסט נקי, quarantine, compound write-back) מהודק בהרבה ממה שכתוב בריפו, שהוא בעצם צ'קליסט markdown. מה שכן שווה לגנוב: gate.yaml (תאום קריא-למכונה של מסמך הבטיחות, נאכף ב-exit code ולא בתקווה שהסוכן קרא), סולם אוטונומיה L0→L3 מפורש לכל לולאה, וזיהוי stagnation בנפרד מתקרת ניסיונות. שלושה פריטים, לא מסגרת.

מה כבר ידענו

הרצתי Recall — במאגר לא היו עובדות קודמות על הנושא הזה. זו קרקע חיצונית חדשה לחלוטין.

אבל *פנימית* זה לא מושג חדש בכלל. ה-studio כבר מחזיק שלוש שכבות של בדיוק העניין הזה:

כלומר: המונח חדש לנו, הפרקטיקה לא.

מה חדש

1. הריפו עצמו — אמיתי, גדול, ולא מאמר

אימתתי מול GitHub API ב-2026-07-26:

| מדד | ערך |

|---|---|

| כוכבים | 9,406 |

| Forks | 1,290 |

| Watchers | 59 |

| Commits | 320 |

| נוצר | 2026-06-09 |

| Push אחרון | 2026-07-26 (היום) |

| רישיון | MIT |

| Issues פתוחים | 23 |

זה לא מאמר ולא מניפסט — זו monorepo עובדת: 599 קבצים, 9 חבילות npm שפורסמו (loop, loop-audit, loop-init, loop-cost, loop-sync, loop-context, loop-mcp-server, loop-worktree, loop-gate), 7 דפוסי ייצור, starters, 19 stories, ו-CI שמריץ את הדפוסים על עצמו.

קצב הצמיחה חריג: 9.4k כוכבים ב-7 שבועות. מבחינת תרומות זה עדיין פרויקט של אדם אחד — cobusgreyling עם 118 commits, בוט ה-Actions עם 52, וכל שאר ~30 התורמים עם 1-19 כל אחד.

2. גריילינג לא טבע את המונח — אוסמני כן

זו הנקודה החשובה שלא ברורה מהריפו במבט ראשון. תיאור הריפו עצמו אומר (inspired by Addy Osmani and Boris Cherny), וקובץ resources/sources.md מודה בזה במפורש.

שרשרת המקור:

3. האם זו "תנועה"? כן — אבל בת 7 שבועות וצרה

יש כמה מפיצים עצמאיים-למחצה (O'Reilly Radar, The New Stack, IBM Think, MindStudio), אבל כמעט כולם נגזרים מאוסמני/צ'רני. שני ממצאים כנים:

4. איפה הריפו דק — הבדיקה הכי חשובה

docs/adopters.md מכיל 6 שורות, מתוכן 4 הן הריפו של המתחזק עצמו. רק שני מאמצים חיצוניים מתועדים: Hermes Agent של Nous Research ו-Pluribus. כלומר: 9,406 כוכבים מול 2 אימוצים חיצוניים מתועדים. זה פער ענק בין תשומת לב לאימוץ.

בנוסף יש מבנה משפך ברור: loop-audit ממליץ אוטומטית על harness-foundry (ריפו אחר של אותו מחבר) כשהציון ≥80, ויש עוד ארבעה ריפואים אחים (memory-engineering, outerloop, goal-engineering, fleet-engineering) שכל אחד מוכר "Ready Score" משלו. הציון מודד נוכחות scaffolding, לא איכות תוצאה — והם מודים בזה בעצמם ב-story: *"Score ≠ permission — Loop Ready 90+ measures scaffold, not license to auto-fix"*.

מצד שני — ה-stories/ הן באמת טובות, כולל כישלונות כנים: הריגת CI Sweeper אחרי 4 ימים (~8M טוקנים ב-48 שעות, 11 PRs שמתוכם 3 תיקוני סימפטום ו-1 ששבר קונפיג פרודקשן), וסיפור "בעיית המאמת" בלולאת קוונט. זה החלק הכי שווה בריפו.

5. מה באמת אקשנבילי

א. gate.yaml — תאום קריא-למכונה של מסמך הבטיחות. רשימת denylist (.env, auth/, payments/, /migrations/, k8s/production/**), maxFiles: 10, ו-autoMergeAllowlist. נאכף על ידי CLI: loop-gate check --action <type> --paths <files> → exit 2 = escalate, 0 = proceed. הרציונל מנוסח היטב: *"instead of relying on the loop to have read this file"*.

ב. loop-context — מפסק זרם דטרמיניסטי. בלי קריאת LLM ("cheap enough to run on every iteration"). ארבעה אותות נפרדים:

Exit 0 המשך / 2 escalate. בנוסף מעקב תקציב יומי חוצה-ריצות ב-daily-spend.<pattern>.json עם hook --on-exceed.

ג. מכפילי עלות אורקסטרציה ב-loop-cost: single 1x · maker-checker 2x · parallel:N = N+1 · debate:R = 1+R. מכפיל מעל 2x מפיק אזהרה.

ד. סולם L0→L3: L0 טיוטה · L1 דיווח-בלבד · L2 תיקונים מסויעים עם מאמת · L3 ללא השגחה. הכלל: *"Never skip L1 for a new pattern on a production repo"*.

ה. קטלוג כשלים עם דירוג חומרה (S1 מעצבן / S2 מזיק / S3 קריטי): Infinite Fix Loop, State Rot, Verifier Theater, Token Burn, Over-Reach, Comprehension Debt Spiral, Parallel Collision, Escalation Failure.

ו. העיקרון החד ביותר בכל הריפו — מסיפור הקוונט: *"The maker/checker split is worthless unless the checker measures something the maker cannot fake."* הדגמה: אסטרטגיה עם Sharpe של +2.54 in-sample ו-−4.33 out-of-sample; מאמת LLM היה מאשר, מאמת נומרי דוחה. *"That refusal is the product."*

מה חדש באמת מול מה ששם לדבר ידוע: הרוב המכריע הוא שם לפרקטיקה מוכרת. התרומה האמיתית היא (1) אוצר מילים לכשלים — verifier theater, intent debt, state rot, comprehension debt — שהוא כלי סקירה שימושי, ו-(2) שלושת האַרטִיפָקְטִים המכניים למעלה. שום טכניקה חדשה.

מה זה באמת אומר לנו

מה שכבר יש לך חזק יותר — אל תיגע

| נושא | ב-loop-engineering | ב-PRISM/Orion |

|---|---|---|

| חסימת לולאה | צ'קליסט markdown "hard cap e.g. 3" | MAX_STAGE_ITERS + מצב BLOCKED טרמינלי + guards ממצים ב-pm-loop v2 |

| תקרת ניסיונות | ledger JSON חיצוני | review_attempts++ דורבילי לפני קריאת הסוקר, claim דרך SKIP LOCKED — לא ניתן לעקיפה |

| מאמת נפרד | "different instructions" | מושב Verifier בקונטקסט-נקי שלא ראה את ההנמקה המייצרת |

| תוצרים כושלים | לא מטופל | מסלול quarantine — לא מקודמים ל-canonical state |

| למידה מצטברת | לא קיים | COMPOUND + promotions.log + scorecard /7 שמזין את improvement-loop |

| ביסוס אקדמי | אפס ציטוטים | Huang et al. 2310.01798, Reflexion, Self-Refine, Anthropic multi-agent, Cognition |

הריפו לא מצטט שום מחקר. ה-pm-loop שלך כן. זה לא פרט טכני — זה אומר שהמסגרת שלך יודעת *למה* מאמת עצמי נכשל, והם רק יודעים *ש*הוא נכשל.

מה כן לאמץ — שלושה פריטים

1. gate.yaml — ההחזר הגבוה ביותר. היום כללי הבטיחות שלך חיים בפרוזה (constitution, CLAUDE.md, safety docs) ונאכפים בכך שהסוכן קרא אותם. הריפו מספק את התאום החסר: קובץ YAML + CLI שמחזיר exit code. תרגום ל-PRISM: קובץ denylist/allowlist קריא-למכונה שמריצים לפני כל commit אוטומטי, כולל תקרת maxFiles. זה בדיוק מה שחסר כשלולאות רצות ללא השגחה.

2. סולם L0→L3 כתכונה מפורשת של כל לולאה. יש לך שלבים ושערי P6, אבל אין דרגת אוטונומיה מוצהרת פר-לולאה עם משמעת "אף פעם לא מדלגים על L1". רלוונטי ישירות ללֵיינים היצירתיים (script/image/aviv) ולכל אוטומציה מתוזמנת חדשה. הכלל שלהם — *שבועיים משעממים של דיווח-בלבד לפני שמפעילים כתיבה* — הוא בדיוק הסוג של גדר שמונעת את סיפור ה-8M טוקנים.

3. Stagnation כאות נפרד מתקרת ניסיונות. גם ה-≤3 rework וגם max_review_attempts=3 סופרים ניסיונות. loop-context מוסיף שני אותות שסופר ניסיונות מפספס: *אותה שגיאה 3 פעמים ברצף* ו-*5 כשלונות רצופים*. זול מאוד להוסיף ל-work_loop ול-DECIDE של ה-pm-loop, ותופס את המקרה "3 ניסיונות זהים" שכיום נראה כמו ניצול תקין של התקציב.

שקול (שוליים)

מיותר — דלג

פסק דין

המסגרת עצמה היא rebranding של מה שאתה עושה, ואתה עושה את החלק הקשה טוב יותר. אל תאמץ את השפה, אל תשנה את ה-pm-loop, ואל תתרשם מ-9.4k כוכבים מול 2 מאמצים חיצוניים. קח את שלושת האַרטִיפָקְטִים המכניים ולך הלאה. אם אתה קורא רק דבר אחד — קרא את stories/ (הכישלונות הכנים), לא את ה-README.

מה לא הצלחתי לאמת

עובדות שנשמרו

ריפו cobusgreyling/loop-engineering צבר 9,406 כוכבים ו-1,290 forks תוך כ-7 שבועות (נוצר 2026-06-09, נמדד 2026-07-26)
https://github.com/cobusgreyling/loop-engineering
המונח loop engineering נטבע על ידי אדי אוסמני במסה מ-7 ביוני 2026, לא על ידי קובוס גריילינג — תיאור הריפו של גריילינג עצמו כותב 'inspired by Addy Osmani and Boris Cherny'
https://addyosmani.com/blog/loop-engineering/
ההגדרה של אוסמני: 'Loop engineering is replacing yourself as the person who prompts the agent. You design the system that does it instead.'
https://www.oreilly.com/radar/loop-engineering/
אנתרופיק לא משתמשת במונח loop engineering באף פרסום הנדסי רשמי — אוצר המילים שלה הוא context engineering ו-harness
https://www.anthropic.com/engineering/effective-context-engineering-for-ai-agents
loop-engineering הוא monorepo עובד עם 599 קבצים, 320 commits ו-9 חבילות npm שפורסמו (loop, loop-audit, loop-init, loop-cost, loop-sync, loop-context, loop-mcp-server, loop-worktree, loop-gate) — לא מאמר ולא מניפסט
https://github.com/cobusgreyling/loop-engineering
רשימת המאמצים הרשמית של הריפו מכילה 6 שורות, מתוכן 4 הן הריפו של המתחזק עצמו — רק 2 מאמצים חיצוניים מתועדים מול 9.4k כוכבים
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/docs/adopters.md
הריפו מספק gate.yaml — תאום קריא-למכונה של מסמך הבטיחות עם denylist, maxFiles: 10 ו-autoMergeAllowlist — שנאכף על ידי CLI המחזיר exit 2 (escalate) או 0 (proceed), במקום להסתמך על כך שהסוכן קרא את מסמך הבטיחות
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/gate.yaml
loop-context מיישם מפסק זרם דטרמיניסטי ללא קריאת LLM עם ארבעה אותות עצירה נפרדים: max-iterations (10), stagnation (אותה שגיאה 3 פעמים ברצף), no-progress (5 כשלונות רצופים), ו-token-budget
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/tools/loop-context/README.md
loop-cost מגדיר מכפילי עלות לפי צורת האורקסטרציה: single 1x, maker-checker 2x, parallel:N = N+1, debate:R = 1+R, עם אזהרה אוטומטית מעל 2x
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/tools/loop-cost/README.md
הריפו מגדיר סולם אוטונומיה L0 (טיוטה) → L1 (דיווח-בלבד) → L2 (תיקונים מסויעים עם מאמת) → L3 (ללא השגחה), עם הכלל 'Never skip L1 for a new pattern on a production repo'
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/docs/operating-loops.md
קטלוג הכשלים מדרג חומרה S1 (מעצבן) / S2 (מזיק) / S3 (קריטי) ומגדיר Verifier Theater — מאמת שמאשר בעוד הבדיקות נכשלות ב-CI — כ-S2, עם המיטיגציה שהמאמת חייב להריץ בדיקות ולדווח פלט
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/docs/failure-modes.md
העיקרון המרכזי מסיפור לולאת הקוונט: 'The maker/checker split is worthless unless the checker measures something the maker cannot fake' — מודגם באסטרטגיה עם Sharpe של +2.54 in-sample ו-−4.33 out-of-sample שמאמת LLM היה מאשר ומאמת נומרי דוחה
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/stories/quant-loop-the-verifier-problem.md
הריפו מודה בעצמו ש-Loop Ready score מודד scaffolding ולא איכות: 'Score ≠ permission — Loop Ready 90+ measures scaffold, not license to auto-fix'
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/stories/score-climbs-then-budget-burns.md
כישלון מתועד בריפו: CI Sweeper שהופעל ב-L2 מוקדם מדי שרף כ-8M טוקנים ב-48 שעות, הציע 11 PRs מתוכם 3 תיקוני סימפטום ואחד ששבר קונפיג פרודקשן — הסיבות: אין שלב L1, מאמת באותה סשן, אין allowlist ענפים, אין תקציב יומי
https://raw.githubusercontent.com/cobusgreyling/loop-engineering/main/stories/why-we-killed-ci-sweeper.md
הריפו של גריילינג מקשר מיוזמתו ל-open-spek/loop כשימוש עצמאי ומוקבל במונח loop engineering במשמעות שונה לגמרי — סימן יושרה, וגם עדות לכך שהמונח עדיין לא מיוצב
https://github.com/open-spek/loop
ארמין רונאכר כיסה את אותו שטח מושגי ב-'The Coming Loop' (23 ביוני 2026) בלי להשתמש במונח loop engineering — מסגור מקביל עצמאי תחת אוצר מילים אחר
https://lucumr.pocoo.org/2026/6/23/the-coming-loop/
קובוס גריילינג הוא Chief Evangelist ב-Kore.ai וכותב תוכן פורה על LLMs וסוכנים — רקורד של אוונגליזם ותוכן בנפח גבוה, לא מחקר
https://blog.kore.ai/cobus-greyling
הפרויקט הוא בפועל של אדם אחד: cobusgreyling עם 118 commits ובוט GitHub Actions עם 52, בעוד כל ~30 שאר התורמים עם 1-19 commits כל אחד
https://github.com/cobusgreyling/loop-engineering

מקורות