צוותי סוכנים ומצב מהיר - עבודה במקביל עם קלוד
לא סוכן אחד שעובד לבד: subagents שרצים במקביל, צוותים שמתואמים ביניהם, ו-fast mode כשמהירות קובעת.
רוב האנשים עובדים עם קלוד כמו שעובדים עם עובד אחד: נותנים משימה, מחכים, מקבלים תוצאה. זה עובד מצוין - עד גודל מסוים. המאמר הזה על מה שקורה מעבר לגודל הזה: איך מפצלים משימה בין כמה סוכנים שרצים במקביל, איך מונעים מהם לדרוס זה את זה, ומתי מצב מהיר עדיף על פיצול.
מעבר לסוכן אחד
סוכן אחד מתחיל להיחנק בשלושה סוגי משימות. הראשון הוא חקירה רחבה: “איפה בקוד הזה מטפלים בהרשאות?” דורש לפתוח עשרות קבצים, וכל אחד מהם נכנס להקשר השיחה. עד שהתשובה מגיעה, ההקשר מלא בקוד שכבר לא רלוונטי.
השני הוא כמה תיקונים בלתי תלויים. שלושה באגים בשלושה אזורים שונים של המערכת אינם דורשים סדר - אבל סוכן אחד יטפל בהם ברצף, כי הוא יכול לעשות רק דבר אחד בכל רגע.
השלישי הוא סקירה מכמה זוויות. אותו קוד יכול להיבדק מבחינת אבטחה, מבחינת ביצועים ומבחינת קריאוּת - וכל זווית מצריכה חשיבה אחרת. סוכן אחד שמנסה לעשות את שלושתן יעשה את כולן בינוני.
הפתרון לשלושתם זהה: סוכני משנה (subagents) שרצים במקביל, כל אחד על החלק שלו.
איך זה עובד
סוכן משנה הוא מופע נפרד של קלוד. שלוש תכונות הופכות אותו לשימושי:
- חלון הקשר נקי. הוא מתחיל מאפס, בלי ההיסטוריה של השיחה הראשית. כל מה שנכנס לו הוא המשימה שהגדרתם.
- משימה ממוקדת.הוא לא “עוזר כללי” אלא נשלח לענות על שאלה אחת או לבצע פעולה אחת.
- מחזיר רק את המסקנה. זו הנקודה החשובה. הסוכן יכול לקרוא ארבעים קבצים, אבל מה שחוזר לשיחה הראשית הוא הסיכום - לא ארבעים הקבצים. ההקשר הראשי נשאר נקי.
כברירת מחדל סוכני משנה רצים ברקע, כך שאפשר לשגר כמה מהם ולהמשיך לעבוד בזמן שהם עובדים. כשמישהו מסיים, התוצאה חוזרת.
כדאי לעצור רגע על ההשלכה של “מחזיר רק את המסקנה”, כי שם נמצא כל הרווח. חקירה שדורשת לפתוח ארבעים קבצים תמלא שיחה ראשית עד שהיא כמעט לא שמישה, ומשם כל שאלה נוספת נגררת עם המשקל הזה. סוכן משנה סופג את העלות הזו אצלו ומחזיר פסקה. אתם משלמים על אותם טוקנים, אבל משלמים עליהם פעם אחת במקום לגרור אותם בכל פנייה עד סוף השיחה.
אפשר גם להגדיר סוכנים מותאמים אישית: קובץ markdown בתיקיית .claude/agents/עם שם, תיאור, ההנחיות שלו, ורשימת הכלים שמותר לו להפעיל. התיאור הוא מה שקובע מתי קלוד יבחר בו לבד - ולכן שווה לכתוב אותו כמו הוראה, לא כמו כותרת. הגבלת כלים היא לא רק אבטחה: סוכן שמותר לו רק לקרוא קבצים לא יתפתה “תוך כדי” לתקן משהו.
אם המושג עצמו חדש לכם, שווה לקרוא קודם על Agents - קלוד שפועל לבד, ואת פרק סוכני המשנה בClaude Code לעומק.
עבודה במקביל בלי התנגשויות
שני סוכנים שעורכים את אותו קובץ באותו רגע הם מתכון לבלגן. יש שתי רמות של פתרון.
הרמה הראשונה: חלוקת קבצים ברורה. כשאתם מפזרים משימות, הגדירו לכל סוכן על אילו קבצים או תיקיות הוא אחראי - וודאו שאין חפיפה. ברוב המקרים זה מספיק לגמרי, וזו גם חלוקה בריאה מבחינת המשימה עצמה: אם קשה לחלק את הקבצים, כנראה שהחלקים לא באמת בלתי תלויים.
הרמה השנייה: בידוד מלא עם git worktree. worktree הוא עותק עבודה נפרד של אותו ריפו, בתיקייה משלו ועל ענף משלו. סוכן שרץ ב-worktree משלו יכול לערוך כל קובץ שהוא רוצה בלי לגעת בעץ הראשי שלכם - ובלי להתנגש בסוכן אחר. בסוף המיזוג הוא מיזוג git רגיל, על כל היתרונות: אפשר לראות diff לכל סוכן בנפרד, לאשר חלק ולדחות חלק.
כל סוכן עולה זמן וטוקנים - הוא צריך להיטען, להתמצא, ולסכם. אם המשימה היא שתי קריאות קובץ ותיקון שורה, סוכן משנה יאט אתכם ולא יזרז. הפיצול משתלם כשהחלקים באמת בלתי תלויים וגם באמת גדולים.
תיאום
כשיש יותר משניים-שלושה סוכנים, מישהו צריך לנהל. התפקיד הזה נקרא סוכן מתאם (coordinator), והוא עושה שלושה דברים: מפזר משימות, אוסף דיווחים, ומחליט מה הצעד הבא לאור מה שחזר. לרוב המתאם הוא פשוט השיחה הראשית שלכם.
שלוש תבניות חוזרות על עצמן ומכסות כמעט כל מקרה:
- מפצלים - חוקרים - מאחדים. מחלקים שאלה גדולה לכמה שאלות קטנות, שולחים סוכן לכל אחת, ומאחדים את התשובות לתמונה אחת. התבנית הכי שימושית לחקירת קוד לא מוכר.
- כותב ומבקר.סוכן אחד מייצר, סוכן שני מנסה למצוא בו פגמים. שני מופעים נפרדים נותנים ביקורת אמיתית יותר מאשר בקשה מאותו סוכן “לבדוק את עצמו”.
- סריקה רחבה ואז העמקה. סבב ראשון זול ומהיר שמסמן אזורים מעניינים, ואז סוכן אחד או שניים שנכנסים לעומק רק לשם. חוסך המון עבודה מיותרת.
מה שמכריע אם התיאום יעבוד הוא לרוב פרט אחד ומשעמם: פורמט דיווח אחיד. כשכל סוכן מחזיר טקסט חופשי באורך שבא לו, המתאם מבזבז את מרב המאמץ על השוואת תפוחים לתפוזים. כשמגדירים מראש מה בדיוק חוזר - כמה ממצאים לכל היותר, אילו שדות, באיזה סדר - האיחוד הופך לפעולה טכנית והמתאם יכול להתפנות להחלטה עצמה.
כלל אצבע לגודל הצוות: שניים עד ארבעה סוכנים הם הטווח שבו הרווח ברור. מעבר לזה, זמן התיאום והסיכום מתחיל לאכול את מה שהחיסכון בזמן ההרצה נתן, ואתם מנהלים במקום לעבוד.
מצב מהיר
לא כל בעיית זמן נפתרת בפיצול. לפעמים אתם עובדים לבד על משימה אחת, והדבר שמפריע הוא פשוט המתנה. לזה יש את הפקודה /fast ב-Claude Code.
חשוב להבין מה זה כן ומה זה לא. מצב מהיר לא מחליף אתכם למודל קטן וזול יותר. זה אותו מודל Opus בדיוק, עם מהירות פלט גבוהה משמעותית. האיכות נשמרת; התשובות פשוט זורמות מהר יותר.
מתי זה משתלם: עבודה אינטראקטיבית צפופה, כשאתם יושבים מול המסך ומגיבים לכל תשובה. איטרציות קצרות שבהן אתם מתקנים כיוון כל דקה. כל מצב שבו זמן ההמתנה הוא מה שמכתיב את הקצב שלכם ולא איכות החשיבה. למשימה כבדה שרצה ברקע בזמן שאתם עושים משהו אחר, זה פחות משנה. למפתחים שעובדים מול ה-API קיים מצב מקביל.
מתכון מעשי
נסגור עם דוגמה שאפשר להעתיק. נניח שאתם רוצים סריקת באגים על ריפו שלא אתם כתבתם. במקום לבקש “מצא באגים” ולקבל רשימה שטחית, מפזרים שלושה סוכני חיפוש לפי אזור, ואז שולחים סוכן רביעי שתפקידו לנסות להפריך כל ממצא:
הרץ שלושה סוכני חיפוש במקביל, כל אחד על אזור אחר: 1. שכבת ה-API (app/api) - טיפול בשגיאות וקלט לא מאומת 2. שכבת הנתונים (lib/db) - שאילתות, טרנזקציות, מקרי קצה 3. ה-UI (components) - מצבי טעינה, שגיאה וריק כל סוכן מחזיר עד 5 ממצאים בפורמט: קובץ:שורה, מה הבעיה, למה זה באג ולא כוונה. אחר כך הרץ סוכן אימות אחד שמקבל את כל הממצאים ומנסה להפריך כל אחד מהם - לקרוא את הקוד סביבו ולבדוק אם יש הסבר תמים. סמן כל ממצא כ"אושר" או "נדחה". בסוף תן לי רק את המאושרים, מסודרים לפי חומרה.
שימו לב לשלושה דברים בפרומפט הזה. החלוקה היא לפי אזור, כך שאין חפיפה בקבצים. הפורמט מוגדר מראש, כך שהתוצאות מגיעות ניתנות להשוואה. וסוכן האימות מקבל תפקיד של מפריך, לא של מאשר - כי סוכן שמתבקש “לאמת” נוטה להסכים.
זה בעצם כל הרעיון. צוות סוכנים הוא לא קסם ולא מורכבות לשמה - הוא חלוקת עבודה. אותם כללים שעובדים בצוות אנושי עובדים כאן: משימות ברורות, גבולות אחריות, פורמט דיווח אחיד, ומישהו אחד שמרכיב את התמונה בסוף.
שאלות נפוצות
- מה זה צוות סוכנים?
- במקום סוכן אחד שעושה הכל ברצף, המשימה מפוצלת לכמה סוכני משנה (subagents) שרצים במקביל - כל אחד עם חלון הקשר משלו ומשימה ממוקדת - וסוכן מתאם שמאחד את התוצאות. מתאים למשימות שמתפרקות לחלקים בלתי תלויים.
- מתי כדאי לפצל לסוכני משנה ומתי לא?
- כדאי: סריקה רחבה של הקוד, משימות בלתי תלויות שאפשר להריץ במקביל, עבודה שמציפה את ההקשר של השיחה הראשית. לא כדאי: משימות קצרות של קריאה בכמה קבצים, או אימות של עבודה שהסוכן הראשי יכול לבדוק לבד - כל סוכן נוסף עולה בזמן ובטוקנים.
- איך סוכנים מקבילים לא דורסים זה את זה?
- מגדירים לכל סוכן משימה נפרדת וקבצים נפרדים, וכשצריך בידוד אמיתי - כל סוכן מקבל git worktree משלו: עותק נפרד של ה-repo שבו הוא עובד, בלי לגעת בעץ הראשי. התוצאות מתמזגות בסוף.
- מה זה fast mode?
- מצב שמפעילים עם הפקודה /fast ב-Claude Code: אותו מודל Opus בדיוק, עם מהירות פלט גבוהה משמעותית. זה לא מעבר למודל קטן יותר - האיכות נשמרת, התשובות פשוט זורמות מהר יותר. שימושי לעבודה אינטראקטיבית אינטנסיבית.
- איך מגדירים subagent מותאם אישית?
- יוצרים קובץ markdown בתיקיית .claude/agents/ עם שם, תיאור והנחיות. קלוד יפעיל את הסוכן הזה אוטומטית כשהמשימה מתאימה לתיאור, או כשתבקשו אותו במפורש. אפשר להגדיר לכל סוכן אילו כלים מותר לו להפעיל.
להרחיב את ארגז הכלים
סוכנים, שימוש מתקדם ב-Claude Code, ומיומנויות שאפשר ללמד את קלוד