חיתוך שימוש בטוקנים של Claude Code: לא להציע — לאכוף
התשובה הקצרה
חשבון שנפוץ ברשת טוען שניתן לחתוך את שימוש הטוקנים של Claude Code ב-90%+ באמצעות סט של 5 שכבות שבהן כל שכבה תופסת את מה שהקודמת החמיצה — בתוספת hooks שמטרתן לאכוף את הסט כדי ש-Claude לא יחזור למסלול העצלן.
הלקח ששווה לשאוב הוא לא המספר הספציפי של 90% (הוא מדווח על-ידי המחבר ותלוי במערכת ובתצורה) — אלא המסגור: "אל תגיד ל-Claude להיות יעיל. אכוף זאת. hook אחד שחוסם דפוס מבזבז מנצח אלף מילים של CLAUDE.md."
חמש השכבות
כל שכבה יושבת בנקודה שונה בצינור העבודה:
- Codebase Memory MCP (גרף ידע) — מחליפים קריאות קבצים בשאילתות מובנות. מדווח כ~99% הפחתה בטוקנים של חקר הקוד.
- Context-mode (וירטואליזציית פלט) — מסננים פלטים גדולים, מיידעים אותם לאינדקס חיפוש ומחזירים רק סיכום. מדווח כ~98% הפחתה בפלטים גדולים.
- RTK (קומפרסיית shell) — בינארי שמדחס פלטי CLI במקום לפני שהם נכנסים לקונטקסט. מדווח 60–90% חסכון בפלטי shell.
- Headroom (פרוקסי שכבת API) — דוחס את כל הפרומפט לפני שהוא יוצא מהמכונה, כולל היסטוריית שיחה ו-system prompts. מדווח 47–92% חסכון.
- Caveman (סגנון פלט) — גורם ל-Claude לדבר פחות: בלי מילים מיותרות, בלי נימוסים מיותרים. מדווח 50–75% חסכון בתגובות של Claude עצמו.
התובנה של האכיפה
החלק המייחד הוא אכיפה דרך hooks. המחבר לא רק מציע להשתמש בגרף הידע קודם — hook מסוג PreToolUse חוסם את קריאות ה-Read/Grep/Glob/Search הראשונות עד שכלי codebase-memory-mcp ישמש. ברגע שסמן כזה קיים, השער משעה את עצמו לשאר הסשן.
-hook נוסף (bash-ban-raw-tools) חוסם cat/grep/find/head/tail דרך Bash — כי פלט של Bash עוקף את כל hooks הקומפרסיה ונכנס ישירות לקונטקסט. גם צינורות חיתוך גולמיים (| head) נדחים, כי הם שוטפים את הקונטקסט לפני החיתוך.
זו העיקרון שניתן להעביר: הפוך את הנתיב היעיל לנתיב היחיד שקיים. Claude בוחר תמיד את נתיב ההתנגדות הקטנה ביותר.
רווחים מהירים לפני שמוסיפים hooks
שלוש פעולות ללא מאמץ מידי שעוזרות עכשיו:
/clearבתדירות — סשנים קצרים וממוקדים טובים יותר מארוכים.- כבה MCP servers שאינם בשימוש לכל סשן — שרתים לא בשימוש צורכים קונטקסט בשקט דרך תיאורי הכלים.
- העדף Mermaid על פני פרוזה לארכיטקטורה — דיאגרמה בת 6 שורות נושאת את צורת 3 פסקאות בחלקיק מהטוקנים.
מילה על המספרים
הערימה הזו היא הגדרה של power-user ועמדה דעתית עם אזהרות אבטחה ממשיות:
- האחוזים שהוצגו הם מדידות אישיות בפרויקט ספציפי — ראו אותם ככיוון, לא כהבטחה.
- המתקין מושך קוד צד-שלישי מ-PyPI, npm, שווקי תוספים ו-GitHub releases. בחנו, נעצו גרסאות או אשרו את התלויות לפני שימוש בסביבת רגישות.
- כמה שכבות (Headroom, context-mode, hooks, שרתי MCP) יכולות לראות פרומפטים, פלטי כלים, קוד, לוגים ונתוני סשן — התייחסו אליהן ככלים מקומיים עם גישה לסודות.
- הקונפיגורציה מפחיתה בדיקות הרשאה (
defaultMode: auto, דילוג על דגלי skip-dangerous), מה שאומר פחות נקודות בדיקה אנושיות לפני הרצת פקודות. - אם משהו מזה אינו מקובל, בצעו התקנה ידנית, דלגו על עטיפת ה-shell, והשאירו prompts של הרשאה פעילים.
מסקנה
הלקח העמיד אינו "התקינו 5 תוספים". זו הגישה של האכיפה: אם אתם רוצים ש-Claude יפסיק לפזר טוקנים — אל תגידו לו בלבד — עשו את הנתיב המבזבז לבלתי אפשרי. בין אם זה hook שחוסם cat/grep גולמיים, כלי שמוירטואליזציה פלט גדול לפני שהוא פוגע בקונטקסט, או הגדרת ברירת מחדל תוקפנית למאמץ — הניצחון מגיע מגבולות ש-Claude לא יכול לעבור פיזית — לא מניסוח פרומפט משופר.
זוהי תיאוריית פרקטיקן (Abid Abdul Gafoor, אפריל 2026) עם ריפו נלווה sgaabdu4/claude-code-tips. האחוזים הם מדידות של המחבר עצמו. מנגנוני Claude Code (הפסקת MCP, /clear, hooks) אומתו מול התיעוד הרשמי במקומות הרלוונטיים; טענות לגבי כלים צד-שלישי לא נבדקו באופן עצמאי בתאריך 2026-08-07.