מה זה Autoresearch?
Autoresearch הוא סקיל ל-Claude Code שמבוסס על הרעיון של אנדרי קרפתי: נותנים ל-AI מטרה, מדד מספרי ופקודת בדיקה, והוא מריץ לולאה של שינוי אחד, מדידה ושמירה רק של מה שהשתפר. כל ניסוי נשמר ב-git וכל כישלון מבוטל אוטומטית, כך שאפשר להשאיר אותו לעבוד ולחזור לתוצאות מתועדות.
רוב העבודה עם AI נראית כמו פינג פונג: מבקשים שינוי, בודקים, ומבקשים עוד תיקון. Autoresearch מחליף את הפינג פונג הזה בלולאה מסודרת. מגדירים פעם אחת מה המטרה, אילו קבצים מותר לשנות ואיזו פקודה מחזירה מספר שמראה אם המצב השתפר, ומשם Claude עובד לבד: קורא את ההיסטוריה, בוחר שינוי אחד, שומר אותו ב-git, מריץ את הבדיקה ומשאיר את השינוי רק אם המספר זז לכיוון הנכון.
הרעיון נולד בפרויקט autoresearch של אנדרי קרפתי, שהראה איך סקריפט קטן יכול לשפר מודל למידת מכונה במשך לילה שלם. Udit Goenka לקח את אותם עקרונות והפך אותם לסקיל כללי שמתאים לכל דבר שיש לו מספר שאפשר למדוד. במדריך הדוגמאות שבריפו יש תרחישים של כיסוי בדיקות, מהירות אתר, ציון SEO לפוסטים, רצף מיילים שיווקי, בדיקת דף נחיתה וכותרות למודעות Google.
הגרסה הנוכחית (2.2.2) כוללת 14 פקודות, מלולאת השיפור הבסיסית ועד ציד באגים, ביקורת אבטחה, דיון בין פרסונות של מומחים ובדיקת מוכנות לשחרור. יש גם מצב מתזמר: כותבים מטרה בשפה חופשית, והסקיל מסווג אותה, מציע תנאי הצלחה מדיד, מבקש אישור פעם אחת ורץ עד שהתנאי מתקיים. כדאי להכיר את הגבול מראש: הכלי עובד הכי טוב בתיקיית פרויקט שמנוהלת ב-git, ומי שאין לו מדד מספרי ברור יצטרך קודם להגדיר אחד.
למי זה מתאים
- בעלי אתרים וחנויות Shopify שהקוד או התבנית שלהם נמצאים ב-git ורוצים לשפר מהירות או לתקן שגיאות בלי לשבת על כל שינוי
- סוכנויות וכותבי תוכן שמנהלים פוסטים כקבצי Markdown ורוצים לשפר תיאורי מטא, קריאות או ציון SEO לפי מדד קבוע
- מפתחים ופרילנסרים שרוצים ציד באגים, ביקורת אבטחה ובדיקת מוכנות לפני שמעבירים גרסה ללקוח
- מנהלי מוצר ויזמים שרוצים לשמוע כמה זוויות מקצועיות לפני החלטה גדולה
מה הוא עושה
לולאת שינוי, מדידה והחלטה
כל סבב כולל שינוי ממוקד אחד, commit ל-git, הרצת פקודת הבדיקה והשארת השינוי רק אם המדד השתפר. שינוי שפוגע מבוטל מיד, וכל התוצאות נרשמות בקובץ TSV שאפשר לנתח אחר כך.
גבולות ברירת מחדל
לכל פקודה יש מספר סבבים קבוע מראש, למשל 25 ללולאה הבסיסית, 20 לתיקון שגיאות ו-15 לציד באגים. ריצה בלי הגבלה מפעילים רק במפורש, עם Iterations: unlimited.
מצב מתזמר
כשכותבים מטרה בשפה חופשית בלי Metric ובלי Verify, הסקיל מסווג אותה, גוזר תנאי הצלחה מדויק, מבקש אישור אחד ומריץ את תתי הפקודות המתאימות עד שהתנאי מתקיים או עד תקרה של 50 מחזורים.
14 פקודות לשלבים שונים
plan להגדרת מדד, debug לציד באגים, fix לתיקון עד אפס שגיאות, security לביקורת STRIDE ו-OWASP, ship לשחרור בשמונה שלבים, ועוד פקודות לתרחישי קצה, דיון מומחים, תיעוד, מחקר שיפורים ובדיקת רגרסיה.
שרשור בין שלבים
אפשר לחבר פקודות, למשל debug ואחריו fix שעובד על הממצאים, או predict לפני debug. המידע עובר בין השלבים בקובץ handoff.json, כך שלא צריך להסביר הכל מחדש.
שכבת הגנה בהתקנת plugin
בהתקנה כ-plugin מגיעים hooks שחוסמים קריאה של קבצי .env ומפתחות, חוסמים פקודות מסוכנות כמו force push ו-git reset --hard, ומחזירים לסוכן את מצב הלולאה אחרי דחיסת הקשר.
בטיחות מובנית בסקיל
ה-SKILL.md קובע שהסוכן לא מבצע push, פרסום או deploy בלי אישור מפורש, וגם במצב מתזמר שלב השחרור תמיד מחכה לאישור שלכם.
דוגמאות שימוש
מה כותבים ל-Claude אחרי ההתקנה, ומה מקבלים.
תיאורי מטא לכל הפוסטים בבלוג
/autoresearch:plan
Goal: כל הפוסטים בתיקייה content/blog יקבלו תיאור מטא של עד 160 תווים שכולל את מילת המפתח של הפוסטמה מקבלים: הגדרה מאומתת עם Scope, Metric ופקודת Verify שעברה הרצת ניסיון. אחרי האישור מריצים את הלולאה, והיא מתקנת פוסט אחרי פוסט עד שכולם עומדים בתנאי.
אתר מהיר יותר
/autoresearch:plan Goal: Make the homepage load faster (higher Lighthouse performance score)
מה מקבלים: Claude מגדיר את ציון Lighthouse כמדד, קובע אילו קבצים מותר לשנות, ואז מנסה שינוי אחד בכל סבב (תמונות, סקריפטים, CSS) ושומר רק את מה שמעלה את הציון.
לנקות את כל שגיאות הבנייה
/autoresearch:fix Iterations: 20
מה מקבלים: הסקיל מזהה מה שבור (בדיקות, טיפוסים, lint, build), מתחיל מהחוסמים, מתקן דבר אחד בכל סבב ועוצר לבד כשמספר השגיאות מגיע לאפס.
ביקורת אבטחה לפני מסירה ללקוח
/autoresearch:security Iterations: 15
מה מקבלים: דוח קריאה בלבד עם מודל איומים STRIDE, סריקת OWASP Top 10 וניתוח של פרסונות תוקפות. כל ממצא מגיע עם קובץ, שורה ותרחיש תקיפה, בלי שינוי בקוד.
חוות דעת של מומחים לפני החלטה טכנית
/autoresearch:predict
אנחנו שוקלים להעביר את הבלוג של החנות ל-Next.js. מה הסיכונים ומה סדר העבודה הנכון?מה מקבלים: חמש פרסונות של מומחים מתדיינות על ההצעה ומגישות סיכום של סיכונים ונקודות מחלוקת לפני שכותבים שורת קוד.
מה צריך לפני שמתחילים
- Claude Code. הסקיל נתמך גם ב-OpenCode וב-Codex, אבל ה-hooks של הבטיחות עובדים רק ב-Claude Code
- תיקיית פרויקט שמנוהלת ב-git, כי כל ניסוי נשמר כ-commit ומבוטל בעזרת revert
- פקודת בדיקה שמחזירה מספר, כמו הרצת בדיקות, Lighthouse או סקריפט ציון. מי שאין לו מדד מתחיל ב-/autoresearch:plan
- Node.js אם מתקינים כ-plugin, כי ה-hooks כתובים כקבצי JavaScript (.cjs)
- אין צורך במפתחות API חיצוניים. הרישיון MIT, והעלות היחידה היא השימוש הרגיל ב-Claude, שגדל ככל שמריצים יותר סבבים
אין עדיין Claude Code? במדריך הזה יש התקנה צעד אחרי צעד.
איך מתקינים את Autoresearch.
יש 4 דרכים, ומספיקה אחת מהן. הראשונה הכי פשוטה, בלי קוד בכלל.
הכי פשוט: באפליקציה של Claude, בלי שום קוד
מתאים ל-Claude במחשב ובדפדפן. לוקח דקה, ועושים את זה פעם אחת.
- מורידים את הסקילהורדת autoresearch.zip (21 KB)לא פותחים את הקובץ, מעלים אותו כמו שהוא.
- מדליקים פעם אחת את היכולתב-Claude נכנסים ל-Settings, ואז Capabilities, ומדליקים את
Code execution and file creation. - מעלים את הקובץנכנסים ל-Customize, ואז Skills, לוחצים על הפלוס, בוחרים
Create skillואזUpload a skill, ובוחרים את הקובץ שהורדתם. - זהו, עובדיםמבקשים מ-Claude את המשימה במילים רגילות, והוא משתמש בסקיל לבד כשהוא רלוונטי.
ב-Claude Code: מדביקים הודעה אחת
פותחים שיחה חדשה ב-Claude Code, מעתיקים את ההודעה ומדביקים. כש-Claude מבקש אישור להריץ, לוחצים Allow.
תתקין לי את הסקיל Autoresearch יחד עם 14 הפקודות שלו מ-GitHub. תריץ את הפקודה הזאת: D="$(mktemp -d)" && git clone --depth 1 -q https://github.com/uditgoenka/autoresearch "$D/repo" && mkdir -p ~/.claude/skills ~/.claude/commands && cp -R "$D/repo/.claude/skills/autoresearch" ~/.claude/skills/ && cp -R "$D/repo/.claude/commands/autoresearch" ~/.claude/commands/ && cp "$D/repo/.claude/commands/autoresearch.md" ~/.claude/commands/ && rm -rf "$D" && echo "הותקן ✓"
דרך הפלאגינים של Claude Code
מקלידים בצ'אט של Claude Code את שתי הפקודות, אחת אחרי השנייה. את שתי הפקודות מקלידים בעצמכם בתוך Claude Code, כי Claude לא מריץ פקודות סלאש בשבילכם. זו הדרך היחידה שמתקינה גם את ה-hooks של הבטיחות. אחרי ההתקנה פותחים סשן חדש, ולעדכון מקלידים /plugin update autoresearch ואז /reload-plugins.
/plugin marketplace add uditgoenka/autoresearch
/plugin install autoresearch@autoresearch
בטרמינל, ידנית
למי שמעדיף להריץ בעצמו. מעתיקים לטרמינל ומריצים.
git clone https://github.com/uditgoenka/autoresearch.git mkdir -p ~/.claude/skills ~/.claude/commands cp -r autoresearch/.claude/skills/autoresearch ~/.claude/skills/autoresearch cp -r autoresearch/.claude/commands/autoresearch ~/.claude/commands/autoresearch cp autoresearch/.claude/commands/autoresearch.md ~/.claude/commands/autoresearch.md
צריך להפעיל מחדש את Claude Code או לפתוח סשן חדש, אחרת הפקודות וקבצי ההפניה לא ייטענו. אין מפתחות להגדיר. מי שהתקין כ-plugin ורוצה התראה בסוף סשן יכול להגדיר משתנה סביבה בשם AR_NOTIFY_WEBHOOK עם כתובת webhook, למשל של Slack.
- מקלידים / ב-Claude Code ומחפשים את /autoresearch ואת /autoresearch:plan ברשימה
- מריצים ls ~/.claude/skills/autoresearch ~/.claude/commands/autoresearch ומוודאים ששתי התיקיות קיימות
- מקלידים /autoresearch בלי פרמטרים. אמור להופיע באנר [autoresearch] mode: wizard ואחריו אשף הגדרה
בהתקנה ידנית מוחקים את התיקיות הקיימות (פקודת ההסרה למטה) ומריצים שוב את פקודת ההתקנה. בהתקנה כ-plugin מקלידים /plugin update autoresearch ואחר כך /reload-plugins.
rm -rf ~/.claude/skills/autoresearch ~/.claude/commands/autoresearch ~/.claude/commands/autoresearch.md (בהתקנה כ-plugin: /plugin uninstall autoresearch@autoresearch)איך משתמשים ביום יום
- פותחים את Claude Code בתוך תיקיית הפרויקט ומוודאים שהיא מנוהלת ב-git ושאין שינויים פתוחים שלא נשמרו.
- אם לא ברור מה למדוד, מתחילים ב-/autoresearch:plan וכותבים את המטרה במילים פשוטות. הפקודה בודקת שה-Scope מצביע על קבצים אמיתיים, שה-Metric מחזיר מספר ושפקודת ה-Verify עוברת הרצת ניסיון.
- מריצים /autoresearch עם Goal, Scope, Metric, Verify ו-Iterations, או כותבים מטרה חופשית ונותנים למצב המתזמר לבחור את המסלול.
- עוקבים אחרי התוצאות בתיקייה autoresearch/ שנוצרת בפרויקט, ועוצרים בכל רגע עם Ctrl+C. המצב האחרון שעבד תמיד שמור ב-git.
- בסוף עוברים על ה-commits שנשארו ורק אז מחליטים אם למזג או להעלות. שום דבר לא עולה לאוויר בלי אישור שלכם.
טיפים שימושיים
- מתחילים עם מספר סבבים קטן, למשל Iterations: 5, כדי לראות איך הלולאה מתנהגת לפני ריצה ארוכה.
- מוסיפים Guard, למשל Guard: npm test, כדי שכל שיפור יישמר רק אם הבדיקות הקיימות עדיין עוברות.
- למשימות תוכן ושיווק צריך סקריפט שנותן ציון. אפשר לבקש מ-Claude לכתוב אותו קודם, לבדוק אותו ידנית על שני קבצים, ורק אז להריץ עליו את הלולאה.
- מי שרוצה את ה-hooks של הבטיחות מתקין כ-plugin, כי ההתקנה הידנית כוללת רק את הסקיל והפקודות.
- ה-README מציע גם התקנה בפקודה npx skills add uditgoenka/autoresearch, למי שכבר עובד עם הכלי skills.
תקלות נפוצות
הפקודות לא מופיעות אחרי ההתקנה
הלולאה לא מתחילה ומבקשת מדד
Claude לא מצליח לקרוא קובץ .env
איך עוצרים ריצה ארוכה
שאלות ותשובות
זה מתאים גם למי שלא כותב קוד?
כמה זה עולה?
הוא יכול לשבור לי את האתר?
למה יש בריפו כמה עותקים של הסקיל?
אפשר להשתמש בו באפליקציית Claude בדפדפן?
קרדיט ומקור. Autoresearch נכתב על ידי uditgoenka ונמצא ב-uditgoenka/autoresearch ברישיון MIT. את העמוד כתב קורן בן עזרא אחרי בדיקה של המאגר ושל פקודות ההתקנה (29.09.2026). מאגרים מתעדכנים, ולכן אם משהו השתנה, המאגר הוא המקור הקובע.