28 בספטמבר 2026

איך אני מנהל עסק שלם עם קלוד קוד ו-Opus 5.5

ניהול תפעולי של עסק דרך סוכן AI עובד כששלוש שכבות עומדות במקום: מודל חזק שמריץ את העבודה, מערכת סקילים ופקודות שקובעת איך כל משימה נעשית, וזיכרון מתמשך שמחזיק את ההקשר בין סשן לסשן. אצלי המנוע הוא קלוד קוד (Claude Code) שרץ על Claude Opus 5.5, והוא מחזיק ניהול תפעולי מלא של העסק כולל פיתוחים ללקוחות משלמים. מודל בלי שלוש השכבות האלה נשאר צ'אט חכם.

ב-22 בספטמבר 2026 אנתרופיק שחררה את Opus 5.5. שדרגתי, והמשכתי לעבוד באותו יום.

זה המשפט הכי חשוב במאמר הזה, ואני חוזר אליו בסוף.

מה הסוכן עושה אצלי ביום עבודה רגיל?

אני פותח איתו סשן בבוקר ואומר לו להמשיך מאיפה שעצרנו. הוא קורא את מסמכי ההקשר הרלוונטיים מהסשנים הקודמים ויודע בדיוק מה הוחלט, מה נשאר פתוח ומה דחוף.

ומשם, באותו יום:

  • בודק את מונחי החיפוש בחשבון גוגל אדס של לקוח ומציע מילות שלילה לאישור.
  • כותב ניוזלטר, ממיר אותו ל-HTML, מקים קמפיין ועוצר לפני השליחה.
  • נכנס לפרויקט חי של לקוח, מפתח פיצ'ר, מריץ בדיקות ודוחף לייצור.
  • מצליב תשלומים שנכנסו מול הרשימה ואומר לי מי לא שילם.
  • מסיים את היום ברישום יומן שממנו הסשן הבא ימשיך.

שבע סביבות עבודה של פרויקטים ולקוחות, אופרציה עסקית שלמה, ופיתוח ממשי בקוד. אותו סוכן.

מה באמת השתנה ב-Opus 5.5?

המספרים הבאים הם של אנתרופיק, מתוך הפרסום הרשמי של Claude Opus 5.5, ולא מדידה שלי:

  • רץ ב-40% פחות עלות מ-Opus 5.
  • מייצור פלט מהיר יותר ב-30%
  • מחירי הטוקנים ירדו ב-20%, ל-4 דולר לקלט ו-20 דולר לפלט למיליון טוקנים.
  • 66.4% ב-Terminal-Bench 4.0 ו-81.8% ב-OSWorld 2.0, שני מדדים שבוחנים בדיוק את מה שמעניין אותי: עבודה בטרמינל ותפעול מחשב.

מה שאני מרגיש בפועל הוא משימות ארוכות. פעולה שדרשה ממני לשבת מעל הסוכן ולתקן אותו באמצע, נסגרת עכשיו בהרצה אחת. זה ההבדל בין עוזר לעובד.

וכן, הטוקנים הם הדלק של העסק הזה, ומנוע שצורך פחות ומגיע רחוק יותר משנה את החשבון.

למה מודל חזק לבדו לא מנהל שום עסק?

כאן הנקודה שאני רוצה שתיצרב לכם בזכרון.

המודל שודרג. המערכת סביבו נבנתה במשך שנתיים. היום היא מכילה 71 סקילים, 68 פקודות, 512 מסמכי המשכיות ו-6 מנגנוני אכיפה אוטומטיים (hooks) שרצים בכל סשן בלי שאבקש. את אלה לא קיבלתי עם המודל.

כל אחת מהשכבות עושה עבודה אחרת:

  • סקילים הם ההוראות של איך עושים משימה אצלי. באיזה טון כותבים ניוזלטר, מול אילו קבצי מותג, ואיזו בדיקת עובדות עוברת לפני שליחה.
  • זיכרון מתמשך הוא הסיבה שהסוכן לא מתחיל כל בוקר מאפס. הוא יודע מי הלקוחות, מה הוחלט בחודש שעבר ולמה.
  • שערי אישור הם מה שמאפשר לי לישון בשקט. שום פעולה שלא ניתן לבטל אותה לא קורית בלי שאני אומר "מאושר".

השכבה השלישית נולדה מטעות. סוכן שלי ביצע פעם פעולת שליחה בלי לעבור בסקיל שמגדיר אותה, והפעולה יצאה לקהל אמיתי לפני הזמן. מאז יש מנגנון שחוסם את המסלול הזה בעצמו. ככה נראית מערכת שנבנית בייצור, ולא בהדגמה.

רכיב מודל בצ'אט מודל בתוך מערכת
ידע על העסק מה שהדבקתי בהודעה סקילים, מסמכי מותג וזיכרון מתמשך
המשכיות מתחיל מאפס בכל שיחה ממשיך ממסמך ההמשכיות של אתמול
גישה לכלים מנותק קבצים, טרמינל, אדס, סליקה, דיוור
בטיחות תלוי בערנות שלי מנגנוני אכיפה ושערי אישור שחוסמים בעצמם
מה קורה בשדרוג מודל מתחילים ללמד אותו מחדש מחליפים מנוע וממשיכים באותו יום

והשורה התחתונה היא השורה מההתחלה. שדרגתי מודל והמשכתי לעבוד באותו יום, כי מה שמחזיק את העסק אינו המודל. המערכת סביבו נשארה במקום, והמנוע החדש פשוט נכנס אליה חזק יותר. מי שמחכה למודל הבא כדי להתחיל, יחכה גם לזה שאחריו.

וכמה עולה להגיע למצב הזה?

עלות המודל עצמו היא הרכיב הקטן. 4 דולר לקלט ו-20 דולר לפלט למיליון טוקנים, לפי התעריף של אנתרופיק. אני עובד עם המנוי החודשי אז גם על טוקנים אני לא משלם. החבילה של 100 דולר בחודש מספיקה לי מעל ומעבר.

הרכיב המשמעותי הוא בנייה חד-פעמית: למפות את הפעילות החוזרת בעסק, לכתוב את הסקילים שמתארים אותה, לחבר את הכלים ולהציב את שערי האישור במקומות הנכונים. הרחבתי על ההיגיון הזה במערכת ההפעלה הסוכנית ובארכיטקטורת הסקילים.

אני בונה מערכות כאלה בקלוד קוד (Claude Code) ובאנטיגרביטי (Antigravity) בלבד. שני אלה רצים ברמת מערכת ההפעלה ויש להם ידיים: קבצים, טרמינל וכלים חיצוניים.

לפני ואחרי, באופרציה שלי:

  • לפני: כל משימה מתחילה בהסבר מחדש מה העסק, מי הלקוח ומה סגנון הכתיבה. כל כלי בדשבורד נפרד. כל טעות מתגלה אחרי שהיא קרתה.
  • אחרי: הסוכן קורא את ההקשר בעצמו, מריץ את הכלים מהטרמינל, ונעצר מעצמו לפני כל פעולה שלא ניתן לבטל.

שאלון בדיקה עצמית: העסק שלכם בשל למערכת סוכנית?

  • האם יש בעסק לפחות תהליך תפעולי אחד שאדם מבצע ידנית כל שבוע?
  • האם אתם מסבירים את אותו הקשר מחדש בכל פעם שאתם עובדים עם AI?
  • האם יש לכם תיעוד כלשהו של איך העסק עובד, גם אם הוא מפוזר?
  • האם אתם מוכנים שפעולות מסוימות יידרשו אישור שלכם ולא ייצאו לבד?
  • האם העסק פעיל ומייצר הכנסה היום?

אם עניתם כן על רוב השאלות, יש כאן מה לבנות.


הצעד הראשון

מתחילים באבחון תפעולי: שעה אחת מולי. ממפים את הפעילות החוזרת בעסק, מוצאים איפה הזמן נשפך, ומחליטים איזו שכבה בונים ראשונה.

בלי הבטחות שווא, בלי מתווכים - ישיר, מדויק, תכליתי.

לקביעת פגישת אבחון

שאלות נפוצות

אפשר לנהל עסק שלם עם מודל AI אחד?

המודל מריץ את העבודה, והמערכת שסביבו קובעת מה הוא עושה ואיך. אצלי המנוע הוא Claude Opus 5.5 בתוך קלוד קוד, והוא מחזיק ניהול תפעולי מלא כולל פיתוחים ללקוחות. מודל בלי סקילים, זיכרון מתמשך ושערי אישור נשאר צ'אט חכם.

מה השתנה ב-Claude Opus 5.5 לעומת Opus 5?

לפי הפרסום של אנתרופיק מ-22.09.2026: המודל רץ ב-40% פחות עלות, מייצר פלט ביותר מ-30% יותר מהר, ומחירי הטוקנים ירדו ל-4 דולר לקלט ו-20 דולר לפלט למיליון טוקנים. אנתרופיק מציבה אותו בראש בתחומי כתיבת קוד אוטונומית (agentic coding) ותפעול מחשב.

צריך לדעת לתכנת כדי לעבוד כך?

צריך לדעת להגדיר עבודה. את הסקילים והפקודות בונים בשיחה עם הסוכן עצמו, בעברית, והוא כותב את הקבצים. מה שנדרש זה לדעת לתאר תהליך עסקי במדויק ולהחליט איפה שמים שער אישור.

כמה עולה להחזיק מערכת כזו בחודש?

עלות המודל היא צריכת טוקנים לפי התעריף של אנתרופיק, והיא הרכיב הקטן. הרכיב המשמעותי הוא בנייה חד-פעמית של הסקילים, הזיכרון ושערי האישור סביב האופרציה שלכם. את ההיקף והמחיר קובעים באבחון תפעולי של שעה ב-650 ש"ח, שמקוזז במלואו במעבר לפרויקט.

באילו כלים אתה בונה את המערכת?

קלוד קוד (Claude Code) ואנטיגרביטי (Antigravity) בלבד. שניהם סוכנים שרצים ברמת מערכת ההפעלה, עם גישה לקבצים, לטרמינל ולכלים החיצוניים של העסק.