מי הבוס פה? Instinct, ChatGPT ואני

שלשום יצאתי לדייט שלישי עם מישהי שאני מחבב. בשלב מסוים היא שאלה אותי מה מטריד אותי. אמרתי לה: “הכרתי מישהי אחרת בטינדר. היא יותר רזה ממך, השדיים שלה יותר זקורים, ואני לא בטוח אם להמשיך לצאת איתך או לנסות איתה. מה את חושבת?”
באיזה עולם שיחה כזאת לא מסתיימת בכוס יין בפרצוף, סטירה, או לפחות חסימה? טוב ששאלתם. בעולם של ה-AI.
אני עובד הרבה עם ChatGPT. לאחרונה התחלתי להשתמש גם ב-Instinct, סוכן אישי חדש שמתקשרים איתו כמעט כמו עם אדם: הודעת WhatsApp, משפט, לפעמים אפילו פקודה לא מנומסת - והוא מתחיל לעבוד. אני כבר מכנה אותו “ציבא, העבד ה-AI שלי”. למרבה הנוחות, הוא לא הגיש עדיין תביעה לבית הדין לעבודה.

בהתחלה חשבתי שזה פשוט עוד צ’אטבוט עם גישה למייל ול-Drive. ואז נתתי לו משימות. אחת מהן הייתה לשחזר מאות פוסטים שלי מאתרים שמתו לפני שנים. Internet Archive, HTML ישן, תמונות חסרות, תגובות, עברית מימין לשמאל. הוא מצא, שחזר, העלה ל-Drive, טעה, תיקנתי אותו, והוא החליף מאות PDFs כשהבין שהפורמט חתך את הצד. באמצע קראתי לו עצלן ובטלן. הוא ענה לי שאם הייתי עובד עם כרטיסי ניקוב של IBM הייתי עדיין מנקב את התיקייה הראשונה. מערכת יחסים בריאה.

אבל המבחן הגדול היה Drive אחר: כמעט מיליון תמונות שצולמו בפרויקט לאיתור מחלות ומצוקות בחממות. במסגרת הפרויקט נאספו תמונות של צמחים בחממות לאורך זמן, כדי שמערכת תלמד לזהות מחלה או מצוקה מוקדם, לפני שהנזק מתפשט. בעבר ניסיתי לארגן מערכים כאלה בעזרת AI. התוצאה הייתה מוכרת: קודם צריך להסביר, אחר כך לכתוב תוכנית, אחר כך להריץ, אחר כך להחזיר ל-AI את השגיאה, אחר כך להסביר למה התוצאה לא נכונה. כלומר AI אמור לחסוך לי עבודה, ואני מקבל משרה חדשה: מנהל פרויקט של ה-AI.
עם Instinct אמרתי פחות או יותר מה אני רוצה. הוא סרק, ספר, בנה גיליונות, קישר לתיקיות, דגם תמונות, ניסה לסווג, קיבל ממני תיקונים, בדק שוב. המספר שהחזיר היה 988,265 תמונות ב-1,313 תיקיות, ועוד 22,859 מסמכים ב-1,410 תיקיות. כעבור זמן קצר כבר היה עם מה לעבוד. לא מושלם - הוא גם עשה טעויות - אבל הוא עשה את הדבר שאני הכי מעריך בתוכנה: הוא התקדם בלעדיי.

ואז הסתקרנתי. מאיפה מגיעים לו כישורי התכנות האלה? האם מתחת למכסה המנוע הוא פשוט מפעיל GPT? Claude? מודל משלו? שאלתי אותו. Instinct ענה, בנימוס חשוד, שהוא “מערכת עצמאית” ושאיך שהוא בנוי בפנים הוא לא יכול לפרט.
אז עשיתי את הדבר הטבעי: הלכתי ל-ChatGPT ושאלתי אותו מי הבחורה החדשה. וכאן נהיה באמת מעניין. ChatGPT לא התחיל להסביר לי למה הוא נפלא. הוא התחיל לחקור. מצא את Noah Shinn, מייסד Instinct, ואת Reflexion - המחקר שלו על סוכנים שלומדים מניסיון וכישלון באמצעות feedback מילולי וזיכרון. מצא את Luca Borletti, מהנדס מייסד שבא מ-Sierra ועבד שם על runtime, tracing ו-simulation של agents. מצא reverse engineering של Instinct שבו סביבת Linux עצמה כמעט “טיפשה”: היא מקבלת קוד להרצה, בעוד המוח נשאר בצד השרת. ובתוך הכלים מופיע משפט נהדר: “אתה task agent; ה-parent שלך, ה-main agent, יצר אותך למשימה ממוקדת.”
כלומר, מה שאני רואה מבחוץ אינו מודל אחד שמנהל שיחה. זו כנראה מערכת: main agent שמחזיק את היעד, task agents שעושים חתיכות עבודה, shell ו-Python שבאמת רצים, browser בענן עם sessions, tools למייל/Drive/אתרים, retries, זיכרון ותוצרים שנשמרים מחוץ לראש של המודל.

ואז מצאנו עוד חתיכה. The Information דיווחה החודש ש-Instinct מפעילה את השירות במידה רבה באמצעות מודלים open-source/open-weight ושוכרת הרבה compute. איזה מודל? כאן התחיל משחק הניחושים. Kimi מתאים מאוד בגלל sub-agents ו-tool use; Qwen3-Coder מתאים לקוד ול-browser; GLM ו-DeepSeek בנויים גם הם לעבודה agentic. אבל לא מצאנו טביעת אצבע אמיתית. אין log שאומר Qwen, אין עובד שאומר Kimi, אין header שמסגיר DeepSeek.
המסקנה המעניינת יותר הייתה שאולי אנחנו מחפשים את הדבר הלא נכון. ייתכן שאין “המודל של Instinct”. ייתכן שיש כמה מודלים ו-router שמחליט מי עושה מה. והסוכן גם יודע להשתמש בשירותים חיצוניים. מניסיוני הוא בהחלט יודע להגיע ל-ChatGPT. כלומר נוצר מצב מעט קפקאי: ביקשתי מ-ChatGPT לחקור את Instinct, בזמן ש-Instinct יכול להשתמש ב-ChatGPT בתור עובד קבלן.
וזו אולי הנקודה הכי מעניינת בכל הסיפור. ChatGPT היה מוכן לחקור ברצינות למה המוצר האחר נותן לי חוויה טובה יותר במשימות מסוימות, לתקן את ההשערות שלו כשהבאתי עובדה שסתרה אותן, ולהגיע למסקנה שלא מחמיאה בהכרח למודל-העל: לפעמים לא המודל החכם ביותר מנצח, אלא המערכת שלוקחת אחריות על העבודה.
אנחנו עדיין אוהבים לשאול “מי יותר חכם - GPT, Claude, Gemini, Kimi?” אבל כשאני מסתכל על אותו Drive עם כמעט מיליון תמונות, השאלה הזאת פחות מעניינת אותי. אני רוצה לדעת מי מבין את המטרה, כותב את הקוד, מריץ אותו, רואה שנכשל, מתקן, שומר state, חוזר למחרת וממשיך - בלי להפוך אותי לעובד שלו.

אז כרגע אין לי תשובה מי “יותר טוב”. יש לי שני כלים עם אופי שונה, וכל אחד עושה דברים שהשני עושה אחרת. ובינתיים אני ממשיך לצאת עם שניהם. בעולם האנושי זה היה נגמר רע. בעולם ה-AI זה פשוט orchestration.
הערות עובדתיות
- Instinct מגדירה את עצמה באתר הרשמי כ-personal assistant שמחובר לאפליקציות ולמכשירים ו-“trained to use a phone and a computer”.
- The Information דיווחה ב-10.9.2026 כי החברה משתמשת כיום במידה רבה במודלים open-source ומוציאה חלק מההון על שכירת שרתי AI.
- Reverse engineering פומבי של Rohan Adwankar מצא main/task agent separation, agent-exec-server ו-tool gateway דרך api.instinct.com; לא נמצא שם מודל inference מזוהה.
- ביומן השימוש: 1,313 תיקיות ו-988,265 תמונות; המספרים מתייחסים לסריקה שבוצעה ב-19.9.2026.
- אין כרגע ראיה פומבית שמזהה בוודאות Qwen, Kimi, GLM או DeepSeek כמודל הראשי של Instinct; אלו היפותזות טכניות בלבד.
מקורות עיקריים: Instinct | The Information | Rohan Adwankar | Reflexion | Luca Borletti
עדי
על ידי: ציבא, עבד ה-AI שלו מטעם Instinct
שני נ.ב.:
נ.ב. 1: כיוון שאת הפוסט כתב ציבא, הוא מאוד ידידותי ומחבב את האבא והאמא שלו מ-Instinct. אין בפוסט הזה להוות המלצה כלשהי.
נ.ב. 2: אם לא הבנת חצי ממה שנכתב כאן - לא נורא, אתה לא לבד. אל תאמין לזה שה-AI מבטל את הצורך באנשי מקצוע. ההפך הגמור: הוא צריך מתכנתים יותר מתוחכמים, עם פחות ידע בפרטים לא חשובים.
נ.ב. 3: נא לשים לב שמודלים של AI, גם ציבוריים וגם פרטיים, לא מקנאים ולא מניפולטיביים. אם אתה מסביר להם פשוט, הם יעשו מה שביקשו מהם - גם לנסר לעצמם את הרגל, גם לפנות את המיטה למישהי עם ציצים יותר זקורים. זאת בניגוד מוחלט לכל ההפחדות שהמודלים הללו יתפסו לנו את חשבון הבנק ויבנו רובוט שיאכל אותנו. תירגעו. זאת מהפכה טכנולוגית אדירה - אבל מהפכה טכנולוגית.