Skip to main content

לומדים

העמוד בתהליך תרגום. בינתיים מוצג המקור באנגלית לאחר בדיקה.

חיתוך שימוש בטוקנים של Claude Code: לא להציע — לאכוף

התשובה הקצרה

חשבון שנפוץ ברשת טוען שניתן לחתוך את שימוש הטוקנים של Claude Code ב-90%+ באמצעות סט של 5 שכבות שבהן כל שכבה תופסת את מה שהקודמת החמיצה — בתוספת hooks שמטרתן לאכוף את הסט כדי ש-Claude לא יחזור למסלול העצלן.

הלקח ששווה לשאוב הוא לא המספר הספציפי של 90% (הוא מדווח על-ידי המחבר ותלוי במערכת ובתצורה) — אלא המסגור: "אל תגיד ל-Claude להיות יעיל. אכוף זאת. hook אחד שחוסם דפוס מבזבז מנצח אלף מילים של CLAUDE.md."

חמש השכבות

כל שכבה יושבת בנקודה שונה בצינור העבודה:

  1. Codebase Memory MCP (גרף ידע) — מחליפים קריאות קבצים בשאילתות מובנות. מדווח כ~99% הפחתה בטוקנים של חקר הקוד.
  2. Context-mode (וירטואליזציית פלט) — מסננים פלטים גדולים, מיידעים אותם לאינדקס חיפוש ומחזירים רק סיכום. מדווח כ~98% הפחתה בפלטים גדולים.
  3. RTK (קומפרסיית shell) — בינארי שמדחס פלטי CLI במקום לפני שהם נכנסים לקונטקסט. מדווח 60–90% חסכון בפלטי shell.
  4. Headroom (פרוקסי שכבת API) — דוחס את כל הפרומפט לפני שהוא יוצא מהמכונה, כולל היסטוריית שיחה ו-system prompts. מדווח 47–92% חסכון.
  5. Caveman (סגנון פלט) — גורם ל-Claude לדבר פחות: בלי מילים מיותרות, בלי נימוסים מיותרים. מדווח 50–75% חסכון בתגובות של Claude עצמו.

התובנה של האכיפה

החלק המייחד הוא אכיפה דרך hooks. המחבר לא רק מציע להשתמש בגרף הידע קודם — hook מסוג PreToolUse חוסם את קריאות ה-Read/Grep/Glob/Search הראשונות עד שכלי codebase-memory-mcp ישמש. ברגע שסמן כזה קיים, השער משעה את עצמו לשאר הסשן.

-hook נוסף (bash-ban-raw-tools) חוסם cat/grep/find/head/tail דרך Bash — כי פלט של Bash עוקף את כל hooks הקומפרסיה ונכנס ישירות לקונטקסט. גם צינורות חיתוך גולמיים (| head) נדחים, כי הם שוטפים את הקונטקסט לפני החיתוך.

זו העיקרון שניתן להעביר: הפוך את הנתיב היעיל לנתיב היחיד שקיים. Claude בוחר תמיד את נתיב ההתנגדות הקטנה ביותר.

רווחים מהירים לפני שמוסיפים hooks

שלוש פעולות ללא מאמץ מידי שעוזרות עכשיו:

  • /clear בתדירות — סשנים קצרים וממוקדים טובים יותר מארוכים.
  • כבה MCP servers שאינם בשימוש לכל סשן — שרתים לא בשימוש צורכים קונטקסט בשקט דרך תיאורי הכלים.
  • העדף Mermaid על פני פרוזה לארכיטקטורה — דיאגרמה בת 6 שורות נושאת את צורת 3 פסקאות בחלקיק מהטוקנים.

מילה על המספרים

הערימה הזו היא הגדרה של power-user ועמדה דעתית עם אזהרות אבטחה ממשיות:

  • האחוזים שהוצגו הם מדידות אישיות בפרויקט ספציפי — ראו אותם ככיוון, לא כהבטחה.
  • המתקין מושך קוד צד-שלישי מ-PyPI, npm, שווקי תוספים ו-GitHub releases. בחנו, נעצו גרסאות או אשרו את התלויות לפני שימוש בסביבת רגישות.
  • כמה שכבות (Headroom, context-mode, hooks, שרתי MCP) יכולות לראות פרומפטים, פלטי כלים, קוד, לוגים ונתוני סשן — התייחסו אליהן ככלים מקומיים עם גישה לסודות.
  • הקונפיגורציה מפחיתה בדיקות הרשאה (defaultMode: auto, דילוג על דגלי skip-dangerous), מה שאומר פחות נקודות בדיקה אנושיות לפני הרצת פקודות.
  • אם משהו מזה אינו מקובל, בצעו התקנה ידנית, דלגו על עטיפת ה-shell, והשאירו prompts של הרשאה פעילים.

מסקנה

הלקח העמיד אינו "התקינו 5 תוספים". זו הגישה של האכיפה: אם אתם רוצים ש-Claude יפסיק לפזר טוקנים — אל תגידו לו בלבד — עשו את הנתיב המבזבז לבלתי אפשרי. בין אם זה hook שחוסם cat/grep גולמיים, כלי שמוירטואליזציה פלט גדול לפני שהוא פוגע בקונטקסט, או הגדרת ברירת מחדל תוקפנית למאמץ — הניצחון מגיע מגבולות ש-Claude לא יכול לעבור פיזית — לא מניסוח פרומפט משופר.


זוהי תיאוריית פרקטיקן (Abid Abdul Gafoor, אפריל 2026) עם ריפו נלווה sgaabdu4/claude-code-tips. האחוזים הם מדידות של המחבר עצמו. מנגנוני Claude Code (הפסקת MCP, /clear, hooks) אומתו מול התיעוד הרשמי במקומות הרלוונטיים; טענות לגבי כלים צד-שלישי לא נבדקו באופן עצמאי בתאריך 2026-08-07.