Claude Code 2.1.49 reviewed: Agent Teams, Skills, Hooks, Plugins, MCP Tool Search
הכי מתאים ל: Senior developers who want to delegate long autonomous tasks and review results, DevOps teams integrating AI into CI pipelines for automated test fixing
יום רביעי בבוקר. הרצתי שלושה Claude Code במקביל על PR אחד שנגע במערכת האימות שלנו. אחד על אבטחה, אחד על ביצועים, אחד על כיסוי טסטים. הלכתי להכין קפה. חזרתי אחרי 7 דקות ומצאתי: timing attack בהשוואת טוקנים, שאילתת DB מיותרת ב-hot path, ושלושה ענפים בלי כיסוי בדיקות. לא כתבתי שורה אחת של קוד ביקורת. זה קורה מאז ש-Claude Code 2.1 הוציא את Agent Teams.
אמ;לק: Claude Code 2.1 (גרסה 2.1.49, פברואר 2026) כבר לא CLI במובן המסורתי. Agent Teams מריץ כמה מופעים של Claude במקביל, כל אחד עם חלון context משלו. Skills החדש (YAML, shell preprocessing, context forking) החליף לי Bash scripts שבניתי חודשים. 14 hooks של מחזור חיים, 6 מהם יכולים לחסום פעולות שאפילו הסוכן לא עוקף. MCP Tool Search הוריד לי את הצריכה של ה-context מ-41% ל-3% בערך. ומערכת הפלאגינים עברה את ה-9,000. זה לא עדכון. זה שינוי קטגוריה.
קשור: Claude Code 2.1 רץ על Claude Sonnet 4.6 החדש של Anthropic, עם 79.6% ב-SWE-bench ו-$3 למיליון טוקנים. הסקירה המלאה של Sonnet 4.6 כאן.
מה באמת נחת ב-Claude Code 2.1
Claude Code קפץ מ-2.1.45 ל-2.1.49 בשבוע אחד. חמש גרסאות. בין הפיצ'רים המרכזיים: Agent Teams, מערכת Skills תכנותית, 14 hooks של מחזור חיים, 9,000+ פלאגינים, MCP Tool Search, ומצב --worktree לעבודה מבודדת על git worktrees. תיקנו גם את הרינדור של הטרמינל ב-Windows, דליפת זיכרון ב-WASM בסשנים ארוכים, ויש עכשיו פקודות claude auth login/status/logout מהטרמינל.
אני רוצה לקחת אתכם לשלושה דברים שבאמת שינו לי את העבודה היומיומית: Skills, Agent Teams ו-Hooks. כל השאר נכנס לטבלה בסוף. אבל השלושה האלה גרמו לי לשקול מחדש את כל הסט-אפ שלי.
Claude Code 2.1.49 reviewed: Agent Teams, Skills, Hooks, Plugins, MCP Tool Search
הכי מתאים ל: Senior developers who want to delegate long autonomous tasks and review results, DevOps teams integrating AI into CI pipelines for automated test fixing
Skills: החלפתי Bash script של חודשים בתוך 20 דקות
בעבר Skills היו סתם slash commands. קובץ markdown עם הוראות. מקליד /review, Claude מקבל הוראות. נחמד, אבל לא משנה חיים.
זה לא מה שהם עכשיו. הנה משהו שבניתי ביום שלישי אחרי הצהריים, מא' עד ת', בערך 20 דקות:
---
name: review-pr
description: Deep PR review with security and perf analysis
argument-hint: [pr-number]
disable-model-invocation: true
allowed-tools: Read, Grep, Glob
model: sonnet
context: fork
agent: reviewer
hooks:
PostToolUse:
- matcher: "Read"
hooks:
- type: command
command: "echo 'Reviewed: $TOOL_INPUT_PATH' >> /tmp/review-log.txt"
---
Review PR #$ARGUMENTS with focus on security, performance, and test coverage.
## Current PR Diff
!`gh pr diff $ARGUMENTS`
## Recent Commits
!`gh pr view $ARGUMENTS --json commits --jq '.commits[-5:][].messageHeadline'`
Analyze every changed file. Flag: SQL injection risks, unvalidated inputs,
missing error handling, N+1 queries, missing tests for new branches.
יש פה הרבה מה לפרק. התחביר של !`command` מריץ פקודות shell לפני שהפרומפט מגיע ל-Claude. כלומר עד ש-Claude רואה את זה, ה-diff של ה-PR והקומיטים האחרונים כבר מוטמעים כ-context. בלי קריאות tool נוספות. ה-context: fork מריץ את כל הסקירה בסוכן מבודד. ה-disable-model-invocation: true אומר ש-Claude לעולם לא יפעיל סקירה מעצמו. ו-hook מתעד כל קובץ שנקרא במהלך הסקירה.
זה החליף לי Bash script שתחזקתי חודשים. הגרסה של Skills קצרה יותר, ברורה יותר, ותכל׳ס רצה טוב יותר בזכות ה-context forking.
שלושת המודים שמעיפים את Skills קדימה
| מוד | מי מפעיל | מתאים ל |
|---|---|---|
| Default | אתם או Claude | כלים כלליים: פורמט, ניתוח, עזרי refactoring |
disable-model-invocation: true |
רק אתם | פעולות מסוכנות: /deploy, /publish, /nuke-staging |
user-invocable: false |
רק Claude | ידע רקע: קונבנציות קוד, מדריכי סגנון |
המוד האחרון הפתיע אותי הכי הרבה. יצרתי skill עם user-invocable: false שמכיל את קונבנציות הקוד של הפרויקט שלנו. Claude טוען אותו אוטומטית כשרלוונטי, אבל הוא אף פעם לא מופיע לי בתפריט ה-/. הוא פשוט יודע את הסגנון שלנו עכשיו. בשקט. ברקע.
שימו לב: תיאורי Skills אוכלים עד 2% מחלון ה-context שלכם (16K תווים במצב fallback). אם תלכו רחב עם יצירת skills, חלק עלולים להיזרק בשקט. הריצו /context כדי לראות כמה מהחלון הולך על הגדרות skills. ועוד דבר חשוב: shell preprocessing רץ עם ההרשאות המלאות של המשתמש שלכם. אל תתקינו skills ממקורות שאתם לא מכירים. הגישה ל-shell אמיתית.
Agent Teams: מבקרים במקביל בזמן הקפה
זה הפיצ'ר שגרם לי לכתוב לקולגה הודעה בפייסבוק בשעה 23:00. Agent Teams נותן לסשן Claude Code שלכם לזמן כמה סשני teammate עצמאיים שעובדים במקביל. לכל אחד חלון context משלו. הם מתאמים דרך רשימת משימות משותפת ויכולים לשלוח זה לזה הודעות ישירות.
WHAT'S ACTUALLY HAPPENING:
┌──────────────────────────────────┐
│ TEAM LEAD │
│ (Your main Claude session) │
│ Creates tasks, assigns work │
│ Synthesizes everything │
├──────────────────────────────────┤
│ ┌──────┐ ┌──────┐ ┌──────┐ │
│ │ TM-1 │ │ TM-2 │ │ TM-3 │ │
│ │ │ │ │ │ │ │
│ │Secur-│ │Perfo-│ │Test │ │
│ │ity │ │rmance│ │Cover-│ │
│ │Review│ │Audit │ │age │ │
│ └──┬───┘ └──┬───┘ └──┬───┘ │
│ │ │ │ │
│ ┌──┴─────────┴─────────┴──┐ │
│ │ SHARED TASK LIST │ │
│ │ + DIRECT MESSAGING │ │
│ └─────────────────────────┘ │
└──────────────────────────────────┘
נחזור ליום רביעי ההוא: שלושה teammates, PR של אימות, 7 דקות. מבקר האבטחה מצא timing attack בהשוואת טוקנים. מבקר הביצועים סימן שאילתת DB מיותרת ב-hot path. מבקר הטסטים הצביע על שלושה ענפים בלי כיסוי. הייתי תופס את כל זה לבד? אולי. הייתי עושה את זה? תכל׳ס, כנראה שלא. הייתי מתמקד באבטחה (זה PR של auth) וכנראה מפספס את שאילתת ה-DB.
דפוסי תיאום שבאמת עובדים
Competing Hypotheses לדיבוג זה הדפוס שלא ציפיתי לו. אתם מזמנים 3-5 teammates, כל אחד חוקר תיאוריה שונה על הבאג. אז הם מתווכחים אחד עם השני דרך רשימת המשימות. התיאוריה ששורדת את החקירה הצולבת היא בדרך כלל הנכונה. נשמע מטורף, אבל זה מנטרל את הטיית העוגן שהורגת דיבוג בסשן יחיד (איפה שאתם נתפסים לתיאוריה הראשונה ומבזבזים שעות על להוכיח שהיא שגויה במקום לוותר עליה).
Cross-Layer Development זה מה שאני עושה יומיום עכשיו. Teammate של פרונטאנד שולט ב-src/components/. Teammate של בקאנד שולט ב-src/api/. Teammate של טסטים שולט ב-tests/. אין merge conflicts כי הם בקבצים שונים. גבולות בעלות טבעיים שמשקפים איך שבני אדם מחלקים עבודה.
Delegate Mode (Shift+Tab) ראוי להתייחסות נפרדת. הוא מגביל את ה-team lead רק לכלי תיאום: בלי עריכת קוד, בלי Bash. זה קיים כי בלי זה, ה-lead בהכרח מתחיל לממש משימות בעצמו במקום לחכות ל-teammates. אני יודע כי עשיתי את זה שלוש פעמים ביום שלישי לפני שהפעלתי את delegate mode. הרגשתי כמו מיקרו-מנהל, אבל זה הניב תוצאות גרועות יותר מלתת ל-teammates לעשות את העבודה.
טיפ מקצועי: 5-6 משימות ל-teammate זה האיזון. משימות קטנות מדי יוצרות overhead תיאום שבולע את כל הזמן. משימות גדולות מדי אומרות מקטעי זמן ארוכים בלי check-in. הנקודה המתוקה: כל משימה היא פונקציה אחת, קובץ טסט אחד, או מסמך ביקורת אחד עם deliverable ברור ונתון לאימות. אני כותב היום משימות כקריטריוני קבלה, לא כהוראות.
מספרים אמיתיים מצוותים אמיתיים
אני לא היחיד שרואה זינוק במהירות. צוותי הנדסה ב-incident.io, Nx, וכמה סטארט-אפים של Y Combinator מדווחים על שיפור פי 2 עד פי 10 כשמריצים 4-7 סוכנים במקביל. הממצא העקבי ביותר אצל כולם: Test-Driven Development הוא לא אופציונלי עם Agent Teams. מגדירים את הטסט קודם. נותנים לסוכנים לממש עד שיעבור. מאמתים אוטומטית. כל workflow אחר מוביל לסוכנים שעושים דברים שונים שלא מסתדרים יחד.
Anthropic הוכיחו את התקרה עם case study: הם בנו קומפיילר C עובד עם 16 סוכני Claude במקביל, בערך 2,000 סשנים, כ-2 מיליארד טוקני input, מתחת ל-$20,000 בסך הכל. הוא מקמפל קרנל Linux 6.9 שעולה על x86, ARM ו-RISC-V. זה לא דמו למשקיעים. זה עבודת הנדסה אמיתית.
"80% תכנון וסקירה, 20% ביצוע. כל צוות שניסה את היחס ההפוך התחרט על זה."
שמונה המגבלות הן אמיתיות
Anthropic מגדירים את Agent Teams כניסיוני. הם מתעדים 8 מגבלות, ואני נתקלתי ברוב מהן בעצמי. הנה הטבלה ההוגנת:
| # | מה משתבש | כמה זה רע |
|---|---|---|
| 1 | אין /resume ל-teammates |
אם teammate קורס באמצע משימה, העבודה הולכת לאיבוד. צריך להתחיל מחדש. |
| 2 | Lag בסטטוס משימה | Teammates שוכחים לסמן משימות כהושלמו. צריך לדחוף אותם ידנית. |
| 3 | כיבוי איטי | מחכה לבקשה הנוכחית להסתיים. יכול לקחת כמה דקות. |
| 4 | צוות אחד לסשן | אי אפשר להריץ צוות פרונטאנד וצוות בקאנד בו-זמנית בסשן אחד. |
| 5 | בלי צוותים מקוננים | Teammates לא יכולים לזמן תת-צוותים משלהם. |
| 6 | Team lead קבוע | אי אפשר להעביר מנהיגות באמצע סשן. |
| 7 | הרשאות נקבעות בהתחלה | אפשר לשנות אחרי כן, אבל לא יורשים דינמית מה-lead. |
| 8 | Split panes מוגבל | לא נתמך בטרמינל של VS Code, Windows Terminal או Ghostty. |
ובנוגע לעלות: מחירי הטוקנים גדלים ליניארית עם כמות ה-teammates. 4 סוכנים זה פי 4 מהחשבון הרגיל שלכם. הזינוק במהירות בדרך כלל מצדיק את זה. אבל תעשו את החשבון על הנפח הספציפי שלכם לפני שאתם מתחייבים. התחילו עם 2-3 teammates, לא 7. אני עשיתי את הטעות עם 7 teammates ב-refactor מורכב. ה-overhead של התיאום בלע את רוב היתרון של המקבילות.
לפני שמתחילים: ב-Agent Teams על AWS Bedrock, Azure וספקי API אחרים שאינם Anthropic, היה באג בגרסאות לפני 2.1.45 שבו משתני סביבה לא עברו לסשני teammate. אם אתם על Bedrock או Vertex, תוודאו שאתם על 2.1.45 ומעלה (הגרסה הנוכחית 2.1.49). התיקון נכלל ב-#23561.
Claude Code 2.1.49 reviewed: Agent Teams, Skills, Hooks, Plugins, MCP Tool Search
הכי מתאים ל: Senior developers who want to delegate long autonomous tasks and review results, DevOps teams integrating AI into CI pipelines for automated test fixing
Hooks: שערי איכות שהצוות שלי לא ידע שהוא צריך
אני אהיה כן: בהתחלה דילגתי על התיעוד של hooks. אירועי מחזור חיים? נשמע כמו middleware תאגידי. טעיתי, והבנתי את זה ביום הראשון שבאמת השתמשתי בהם.
ל-Claude Code יש עכשיו 14 אירועי מחזור חיים. שישה מהם יכולים לחסום את Claude מלעשות דברים. שני ה-hooks של Agent Teams הם מה שהמיר אותי.
TaskCompleted מופעל כש-teammate מסמן משימה כהושלמה. אם ה-hook שלכם מחזיר exit code 2, המשימה נשארת in-progress וה-teammate מקבל את הודעת המשוב שלכם. הנה ה-hook שכתבתי:
#!/bin/bash
# hooks/enforce-quality.sh -- Runs when ANY task is marked complete
if ! npm test 2>&1; then
echo "Tests are failing. Fix them before marking complete." >&2
exit 2 # Task stays in-progress. Teammate keeps working.
fi
if ! npm run lint 2>&1; then
echo "Lint errors. Clean up before completing." >&2
exit 2
fi
exit 0 # All good. Task can complete.
עכשיו ה-teammates של הסוכנים שלי לא יכולים לסמן משימה כ"בוצעה" אלא אם הטסטים וה-lint עוברים. בלי יוצאים מהכלל. בלי "אני אתקן אחר כך". שער האיכות הוא מכני. זה שיגע אותי בשעה הראשונה כי הטסטים שלי היו מרפרפים. אבל ברגע שתיקנתי את הטסטים המרפרפים, כל משימה שהושלמה הייתה באמת מושלמת. זו הרגשה מוזרה: לסמוך על פלט של משימה מ-AI כי סקריפט בדק את זה.
TeammateIdle זה השני ששינה לי את ה-workflow. כש-teammate עומד לעבור ל-idle, החזרת exit code 2 עם הודעה שולחת אותו בחזרה לעבודה. אני משתמש בזה כדי לאכוף ש-teammates יעדכנו תיעוד לפני עצירה. ה-teammate לא יכול לעבור ל-idle עד שהתיעוד מסתדר עם שינויי הקוד.
SessionStart Hooks: הגדרת סביבה שבאמת עובדת
ל-SessionStart hooks יש יכולת ייחודית: הם יכולים לכתוב ל-CLAUDE_ENV_FILE כדי לשמר משתני סביבה לכל אורך הסשן. זה נשמע משעמם. זה לא. הנה מה שזה פותר:
#!/bin/bash
# hooks/setup-env.sh -- SessionStart hook
source ~/.nvm/nvm.sh && nvm use 20 2>/dev/null
echo "export PATH=$NVM_BIN:$PATH" >> "$CLAUDE_ENV_FILE"
echo "export PROJECT_ENV=development" >> "$CLAUDE_ENV_FILE"
כל פקודת Bash ש-Claude מריץ בסשן הזה רואה עכשיו את גרסת ה-Node הנכונה ואת משתני הסביבה. אין יותר שגיאות "nvm: command not found" כש-Claude מנסה להריץ סקריפטים. אין יותר הזיות של Claude שהוא על גרסת Node שונה. הגדרת הסביבה רצה פעם אחת בתחילת הסשן ונשארת. הייתי צריך את זה לפני חודשים.
MCP Tool Search: מ-41% צריכת context ל-3% בערך
הסעיף הזה קצר אבל המספרים שווים אזכור. אני מריץ 27+ שרתי MCP (מסדי נתונים, Figma, Slack, GitHub, הסט-אפ המלא). לפני MCP Tool Search, כל הגדרות הכלים האלה נטענו מראש ואכלו 41% מחלון ה-context שלי. ארבעים ואחד אחוז. לפני שהקלדתי פרומפט אחד.
MCP Tool Search טוען כלים on-demand. Claude מחפש מה שהוא צריך ברגע שהוא צריך. זה מתפעל אוטומטית ברף של 10% context. צריכת ה-MCP שלי ירדה ל-3% בערך.
# Configuration options
ENABLE_TOOL_SEARCH=auto # Default: activate at 10% threshold
ENABLE_TOOL_SEARCH=auto:5 # Custom: activate at 5% threshold
ENABLE_TOOL_SEARCH=true # Always on
ENABLE_TOOL_SEARCH=false # Off (all tools load upfront)
הערת ארכיטקטורה: MCP Tool Search דורש Sonnet 4+ או Opus 4+. Haiku לא נתמך. אם אתם מריצים Haiku לאימות זול בסט-אפ של הסוכנים שלכם, הסוכנים האלה לא יכולים להשתמש ב-Tool Search ועדיין יצרכו את ה-context המלא להגדרות כלי MCP. תתכננו את רמות הסוכנים מסביב לזה: Sonnet לכל דבר שצריך MCP, Haiku למשימות היסק טהורות בלי כלים.
Skills + MCP + Hooks: למה השלושה האלה הם מערכת אחת
הנה מה שנפל לי ביום חמישי של אותו שבוע: Skills, Hooks ו-MCP הם לא שלושה פיצ'רים נפרדים. הם שלוש שכבות של סביבת פיתוח תכנותית אחת:
| שכבה | מערכת | שולטת ב | דוגמה מהעבודה שלי |
|---|---|---|---|
| ידע | Skills | מה Claude צריך לעשות | Skill של /review-pr עם קונבנציות הקוד שלנו |
| כלים | MCP | למה Claude יכול לגשת | 27 שרתים: Supabase, Figma, Slack, GitHub וכו׳ |
| גדרות | Hooks | מה Claude מורשה לעשות | שערי איכות, הגדרת סביבה, שליטה בהרשאות |
Skills יכולים להגדיר hooks ב-YAML frontmatter שלהם, מוגבלים לתקופת החיים של ה-skill. Hooks יכולים להתאים לדפוסי כלי MCP (mcp__memory__.*). Skills יכולים לשלוף משאבי MCP. פלאגינים אוגדים את השלושה לחבילות להפצה. אפשר לבנות סביבת פיתוח ספציפית לדומיין ולשתף אותה עם הצוות כפלאגין אחד בר-התקנה.
זה מה ש"מערכת הפעלה לסוכנים" אומר בפועל. לא מטאפורה. שכבה תכנותית ממשית בין אתכם ל-AI.
פלאגינים: 9,000+ וממשיכים לצמוח
מערכת הפלאגינים עברה 9,000 פלאגינים בין השוק הרשמי של Anthropic למאגרי הקהילה. פלאגין אוגד skills, סוכנים, hooks, שרתי MCP, שרתי LSP ו-output styles לתיקייה אחת. ה-manifest צריך רק שדה name. פלאגין מינימלי: קובץ markdown אחד, JSON של שלוש שורות.
פלאגיני ה-LSP הם אבן החן הנסתרת כאן. Pyright ל-Python, TypeScript LSP, Rust LSP. הם נותנים ל-Claude אינטליגנציית קוד בזמן אמת: diagnostics, go-to-definition, find references, מידע טיפוסים. אחרי שהתקנתי את פלאגין ה-TypeScript LSP, Claude תפס לי שגיאת טיפוסים בקוד לפני שהרצתי את הקומפיילר. הרגשתי שיש לי איזה אדם שני שקורא מעל לכתף שלי, רק שהוא מהיר יותר ופחות עייף ממני.
אבטחה מבוססת אמון, לא sandbox: פלאגינים מועתקים ל-cache מקומי ו-path traversal חסום, אבל הקוד עצמו לא בתוך sandbox. עם 9,000+ פלאגיני קהילה באיכות משתנה ובלי בידוד runtime, חלק יהיו מפוקפקים. תתקינו ממקורות שאתם מזהים. השוק הרשמי של Anthropic עבר סינון. ריפו GitHub אקראי עם 3 כוכבים לא עבר. זו דאגה אמיתית, לא תיאורטית.
כל השאר שנחת
| פיצ'ר | למה זה חשוב |
|---|---|
/teleport |
העברת סשן CLI ל-claude.ai/code. שימושי כשאתם רוצים לשתף context עם קולגה או להמשיך בדפדפן. |
--worktree mode (v2.1.49) |
worktrees מבודדים לכל סוכן. הרצה מקבילה של ענפי פיצ'ר בלי קונפליקטים. זה מה שמאפשר פיתוח מקבילי אמיתי. |
claude auth login/status/logout |
סוף סוף ניהול auth מסודר מהטרמינל. לא צריך יותר לחפור בקבצי קונפיג כדי להחליף API key. |
| תיקון דליפת WASM (v2.1.49) | סשנים ארוכים לא אוכלים יותר זיכרון בלי גבול. ה-parser של tree-sitter מתאפס מדי פעם. זו הייתה בעיה אמיתית ב-2.1.45. |
| שיפורים ב-VS Code plan preview | מתעדכן אוטומטית בזמן ש-Claude מתקדם, מעיר רק כשמוכן לסקירה. פחות רעש, אותו מידע. |
| תמיכה ב-Windows ARM64 | בינארי native ל-ARM Windows. Surface Pro ולפטופים של ARM מקבלים שיפור מהירות אמיתי מעל אמולציה. |
Claude Code 2.1 מול Cursor 2.0 מול Windsurf Wave 13
אני נשאל את זה כל הזמן: "למה לא פשוט להשתמש ב-Cursor או Windsurf?". שאלה הוגנת. הנה ההשוואה הכנה אחרי שהשתמשתי בשלושתם החודש:
| כלי | מחיר | ארכיטקטורת סוכנים | איפה הוא מנצח | איפה לא |
|---|---|---|---|---|
| Claude Code 2.1 | חינם + עלויות API | Agent Teams (ניסיוני), Skills, Hooks, 9,000+ פלאגינים | הרחבה, תזמור רב-סוכני, משתמשי טרמינל רציניים | אין עורך מובנה, עקומת הגדרה תלולה יותר |
| Cursor 2.0 | $20 בחודש | 8 סוכנים מקביליים עם עורך ויזואלי | מוכרות VS Code, UI מלוטש, עבודת עריכה יומיומית | פחות הרחבה, אין שווה-ערך ל-Skills |
| Windsurf Wave 13 | $15 בחודש | Arena Mode להשוואה עיוורת של מודלים | קוד גדול, Arena Mode לבחירת מודל, תמורה למחיר | פחות יכולות תיאום בין סוכנים |
הדעה הכנה שלי: אני משתמש ב-Claude Code לעבודת רב-סוכנים וב-Cursor לעריכה יומיומית. הם משלימים. אם אתם רוצים כלי אחד, Claude Code מנצח בהרחבה. Cursor ו-Windsurf מנצחים בליטוש. אם אתם מפתחים שחיים בטרמינל ורוצים שליטה מלאה בהתנהגות הסוכן, Claude Code 2.1 הוא האופציה היחידה שנותנת לכם את כל זה. ראו את מדריך כלי הקוד של AI Deck להשוואה המלאה.
התמונה המלאה: מה עובד ומה לא
מה עובד
- Agent Teams הפיק לי את סקירת הקוד הטובה ביותר שקיבלתי פעם מ-AI. שלושה מבקרים במקביל מצאו דברים שהייתי מפספס.
- מערכת Skills החליפה Bash script בן חודשים בתוך 20 דקות. YAML, shell preprocessing, context forking: יכולת חדשה אמיתית.
- MCP Tool Search חתך את ה-overhead של ה-context מ-41% ל-3% בערך. זה לא אופטימיזציה קטנה, זה משנה מה שאפשר להכניס לסשן.
- Hooks של שערי איכות אומרים שמשימות שהושלמו באמת הושלמו. הטסטים עוברים. ה-lint עובר. בלי יוצאים מהכלל, בלי משא ומתן.
- הארכיטקטורה בת שלוש השכבות (Skills + MCP + Hooks) יוצרת משהו שלא ראיתי בשום כלי קוד אחר.
- פלאגיני LSP נותנים ל-Claude בדיקת טיפוסים בזמן אמת. הוא תפס שגיאת טיפוסים לפני שהרצתי את הקומפיילר.
- חינם לשימוש אם יש לכם API key. העלות היא טוקני API, לא מנוי.
מה לא עובד
- Agent Teams ניסיוני עם 8 מגבלות אמיתיות. אין resume, צוות אחד בסשן, אין צוותים מקוננים. תכננו קריסות.
- עלויות הטוקנים מוכפלות ליניארית לכל teammate. 4 סוכנים זה פי 4 מההוצאה הרגילה. מקבילות לא בחינם.
- אבטחת פלאגינים מבוססת אמון בלי sandbox. 9,000+ פלאגינים, בלי בידוד runtime. תהיו סלקטיביים.
- MCP Tool Search לא עובד עם Haiku. סוכני אימות בתקציב לא יכולים להרוויח ממנו.
- חמש גרסאות בשבעה ימים (2.1.45 ל-2.1.49) אומרות שהדברים זזים מהר. שינויים שוברים אפשריים וכבר קרו.
- אין עורך מובנה. אם אתם רוצים IDE ויזואלי, אתם צריכים Cursor או VS Code לצידו.
- Shell preprocessing ב-Skills רץ עם ההרשאות המלאות שלכם. התקנת skills לא מהימנים זה סיכון אבטחה אמיתי.
טיפ מקצועי: תתחילו עם Skills לפני שאתם נכנסים ל-Agent Teams. בנו 2-3 skills למשימות הנפוצות ביותר שלכם (סקירת קוד, יצירת טסטים, עדכון תיעוד). תתרגלו לעבוד עם YAML frontmatter ו-shell preprocessing. אחר כך תוסיפו TaskCompleted hook לאכיפת איכות. רק אז תכניסו Agent Teams. הצוותים עובדים הרבה יותר טוב כשיש לכם יסוד של Skills להעביר לכל teammate.
Claude Code 2.1 - שאלות ותשובות
מה זה Claude Code 2.1 ובמה הוא שונה מהגרסאות הקודמות?
Claude Code 2.1 הוא כלי הפיתוח ה-CLI של Anthropic, כרגע בגרסה 2.1.49 (פברואר 2026). התוספות הגדולות מעל גרסאות 2.1.x קודמות הן Agent Teams (סשני Claude עצמאיים במקביל), מערכת Skills מחודשת עם YAML frontmatter ו-shell preprocessing, 14 hooks של מחזור חיים (6 מהם יכולים לחסום פעולות), MCP Tool Search לטעינת כלים on-demand, ומערכת פלאגינים עם 9,000+ הרחבות. הגרסאות הקודמות היו CLI מוכשר. 2.1 קרוב יותר ל-runtime תכנותי לסוכנים. ראו את דף הכלי המלא של Claude Code לפרטי מחיר והגדרה.
כמה Agent Teams עולה?
עלויות הטוקנים גדלות ליניארית: 4 סוכנים זה בערך פי 4 מההוצאה הרגילה לסשן. השיפור של פי 2 עד פי 10 במהירות שמדווח על ידי צוותי production (incident.io, Nx, סטארט-אפים של Y Combinator) בדרך כלל מפיק ערך חיובי נטו בזמן-עד-משלוח. case study של Anthropic: 16 סוכנים, בערך 2 מיליארד טוקני input, מתחת ל-$20,000 בסך הכל עבור מה שהיה לוקח חודשים לבד. התחילו עם 2-3 teammates כדי לכייל את העלות למשימה לפני שאתם מרחיבים. החשבון עובד לטובתכם במשימות מורכבות. במשימות פשוטות, ה-overhead בולע את היתרון.
איך Claude Code 2.1 מושווה ל-Cursor 2.0?
Claude Code של Anthropic (חינם עם API key) רץ בטרמינל שלכם ומתמקד בתזמור סוכנים: Agent Teams, Skills תכנותיים, 14 hooks של מחזור חיים ואינטגרציית שרתי MCP. Cursor 2.0 ($20 בחודש) הוא פורק של VS Code עם 8 סוכנים מקביליים ועורך ויזואלי. Claude Code מציע הרחבה ושליטה עמוקים יותר. Cursor מציע חוויית IDE מלוטשת יותר. אני משתמש בשניהם. Claude Code לעבודת רב-סוכנים ותזמור מורכב. Cursor לעריכה יומיומית. בדקו את דף ההשוואה של הכלים לפירוט המלא.
האם Claude Code 2.1 שווה למפתח סולו?
כן. Claude Code 2.1 חינם לשימוש (אתם משלמים רק על טוקני API דרך Sonnet 4.6 ב-$3 למיליון). גם בלי Agent Teams, מערכת Skills לבדה החליפה לי שעות של scripting מותאם. הסט-אפ הכי טוב למפתח סולו בפברואר 2026: צרו 3-5 Skills למשימות הנפוצות (סקירת קוד, יצירת טסטים, בדיקות deploy), הוסיפו TaskCompleted hook לאכיפת איכות, והשתמשו ב-Sonnet 4.6 כמודל ברירת המחדל. Agent Teams הופכים לשווים אחרי שאתם נוחים עם הבסיס. תתחילו עם Skills, תתקדמו לצוותים. בקרו ב-ספרייה המלאה של כלי AI Deck לחלופות אם אתם רוצים אופציות להשוואה.
מה חששות האבטחה מול פלאגיני Claude Code?
מערכת הפלאגינים משתמשת במודל אבטחה מבוסס אמון. פלאגינים מועתקים ל-cache מקומי ו-path traversal חסום, אבל הקוד עצמו לא ב-sandbox. עם 9,000+ פלאגיני קהילה באיכות משתנה ובלי בידוד runtime, חלק יהיו זדוניים או כתובים גרוע. מערכת Skills מריצה shell preprocessing עם ההרשאות המלאות שלכם. תתקינו מהשוק הרשמי של Anthropic בשביל פלאגינים שעברו סינון. ריפו GitHub אקראיים לא עברו סינון. זו דאגה אמיתית ככל שהמערכת צומחת. ראו את קטגוריית כלי המפתחים לחלופות ממוקדות אבטחה.
השורה התחתונה שלי
למפתחים שכבר משתמשים ב-Claude Code: תעדכנו ל-2.1.49 היום. תבנו Skill אחד למשימה החוזרת ביותר שלכם. תוסיפו TaskCompleted hook לאכיפת טסטים. שני השינויים האלה לבד ישנו לכם את העבודה, והם לוקחים פחות משעה להגדיר.
לצוותים ששוקלים Agent Teams: תתחילו קטן. שני teammates על סקירת PR אמיתית. תגדירו משימות כקריטריוני קבלה. תפעילו TDD לפני שאתם מתחילים. תריצו את חשבון העלויות בנפח הטוקנים שלכם. אם היחס מהירות-לעלות עובד, תרחיבו. אם לא, Skills ו-Hooks שווים גם לבד.
למפתחים שמתלבטים בין Claude Code ל-Cursor/Windsurf: אם אתם רוצים הרחבה מקסימלית, workflow טבעי לטרמינל ואת תזמור הסוכנים העמוק ביותר שקיים בפברואר 2026, Claude Code 2.1 היא התשובה. אם אתם רוצים חוויית IDE מלוטשת עם פחות הגדרות, Cursor 2.0 עדיף. הם משלימים, לא מתחרים.
הדירוג שלי: 4.5/5. מורידים חצי נקודה בגלל 8 המגבלות של Agent Teams ומודל האבטחה של הפלאגינים. הכל השאר? מה שעושה את העבודה שלי מהירה יותר. עבורכם זה יעבוד?
