Sustain

→ חזרה ללמידה
מה חדש

9 בספטמבר 2026

· קריאה של 10 דק׳

הסוכן ה-AI שלכם יכול עכשיו לבנות איתכם אלבום

סוכני AI מתחילים להשתמש באינטרנט ולא רק לקרוא אותו. תבקשו מסוכן להזמין שולחן או למלא טופס והוא ינסה — בדרך כלל על ידי צילום מסך, חיפוש אחר כפתור, ולחיצה במקום שבו הוא חושב שהכפתור נמצא. זה עובד עד שהפריסה משתנה, התווית היא אייקון, או שנפתח חלון קופץ שהוא לא ציפה לו.

אנחנו חושבים שזו דרך מוזרה להתייחס לתוכנה שכבר יודעת לבצע את העבודה. לכן Sustain מפרסמת כלים משלה לסוכני AI: פעולות מוגדרות כמו ליצור אלבום, להכניס תמונות, לבנות. הסוכן קורא לאותו קוד שהכפתורים קוראים לו.

עכשיו זה עובד בשתי דרכים. סוכן בדפדפן שלכם מקבל את הכלים מהעמוד דרך WebMCP. סוכן בכל מקום אחר — Claude בדסקטופ, ChatGPT, כל דבר שמדבר MCP — מתחבר ל-mcp.sustain-app.com ופועל בחשבון שלכם דרך הרשאה שאתם מאשרים ויכולים לבטל. הפוסט הזה מכסה את שתיהן.

הבעיה עם סוכנים שלוחצים

סוכן דפדפן שמפעיל אתר רגיל מבצע למעשה ראייה ממוחשבת על ממשק משתמש שתוכנן עבור בני אדם. הוא קורא צילום מסך, מנחש אילו פיקסלים הם כפתור יצירת אלבום, לוחץ, ממתין, מצלם שוב את המסך, ומנסה להבין אם זה עבד.

כל אחד מהשלבים האלה יכול להיכשל בדרך שהסוכן לא יכול לראות. הוא לוחץ על כפתור מושבת וקורא את העמוד הבלתי-משתנה כהצלחה. הוא מפספס שגיאת אימות שמוצגת בצבע שהוא לא יכול לפרש. תפריט נפתח מוצג אחרת בחלון צר וכל התוכנית יוצאת מהפסים. גרוע מכך, אין לו מושג מה פעולה עולה — שום דבר על המסך לא אומר לו שהכפתור הספציפי הזה מוציא לכם קרדיטים.

שום דבר מזה לא נובע מכך שהסוכן גרוע בעבודתו. הוא פשוט מתבקש להנדס לאחור כוונה מתוך תמונה, כאשר האתר יכול היה פשוט לומר לו.

מה שבנינו במקום זאת

Sustain מיישמת את WebMCP, תקן אינטרנט מתהווה בדיוק בשביל זה. כשסוכן פעיל בדפדפן שלכם, העמודים שלנו רושמים סט של כלים שהוא יכול לקרוא להם ישירות. לכל אחד מהם יש שם, קלט מוגדר-טיפוס, ותיאור שנכתב עבור מכונה שמעולם לא ראתה את הממשק שלנו.

עשרה כלים זמינים כיום, והם ממופים למסע האמיתי של יצירת אלבום ולא לנקודות הקצה (endpoints) של ה-REST שלנו:

  • ask_site — עונה על שאלות מתוך התוכן שלנו שכבר פורסם (תמחור, הדפסה, פרטיות, המדריכים שאתם קוראים עכשיו) ומחזיר את עמודי המקור, כדי שהסוכן יוכל לצטט במקום להמציא.
  • create_album ו-album_status — להתחיל אלבום ולבדוק איך זה מתקדם.
  • request_photos ו-import_google_photos — שתי דרכים להכניס תמונות, ששתיהן לא שולחות אף תמונה אחת דרך השיחה. עוד על זה בהמשך.
  • quick_place ו-build_album — לסדר את התמונות בחינם, או להריץ את הבנייה המלאה של ה-AI.
  • list_albums,‏ get_credits,‏ start_checkout — למצוא את האלבומים שלכם, לקרוא את היתרה שלכם, לקנות עוד קרדיטים.

בקצרה

אתרים אחרים גורמים לסוכן לנחש על איזה כפתור ללחוץ. אנחנו מוסרים לו את הכפתורים, מתויגים, כשההשלכות כתובות עליהם.

איך זה נראה בפועל

אתם מחוברים ל-Sustain עם סוכן שרץ בדפדפן שלכם. אתם אומרים: "תכינו לי אלבום מהטיול שלי לאיטליה." מה שקורה אחר כך הוא לא סדרה של קליקים:

1

הוא יוצר את האלבום

הסוכן קורא ל-create_album עם השם "איטליה 2026". העורך נפתח על המסך שלכם — אתם רואים את זה קורה.

2

הוא מבקש את התמונות שלכם

הוא קורא ל-request_photos ומקבל כרטיס העלאה (upload ticket). אם הסוכן יכול לקרוא את הקבצים שלכם, הוא מעלה אותם בעצמו. אם לא, הוא מוסר לכם קישור לפתוח בטלפון שלכם. בכל מקרה התמונות עוברות ישירות ל-Sustain, לא דרך השיחה.

3

הוא ממתין שהן יגיעו

הוא בודק שוב ושוב את album_status עד שההעלאות שלכם מפסיקות להגיע, ומודיע לכם על הכמות.

4

הוא מציג לכם טיוטה בחינם

הוא קורא ל-quick_place — בחינם — כדי שיהיה לכם משהו אמיתי להסתכל עליו לפני שמוציאים משהו.

5

אתם מאשרים את הבנייה האמיתית

אתם אוהבים את זה, אז הוא קורא ל-build_album: המעבר המלא של ה-AI שמדרג כל תמונה, מוריד תמונות דומות כמעט-זהות, מקבץ לפי פנים וסצנה, מעצב את העמודים וכותב את הכיתובים.

לאורך כל התהליך, שניכם מסתכלים על אותו עמוד. הסוכן לא מפעיל עותק נסתר של האתר איפשהו — הוא עובד בלשונית שלכם, וכל תוצאה מופיעה מולכם.

איך התמונות בעצם נכנסות

זה החלק שקל לטעות בו, ואנחנו טעינו בו קודם. העיצוב המובן מאליו הוא כלי שמקבל את התמונות כארגומנט — הסוכן מוסר לנו את התמונות, ואנחנו שומרים אותן. זה עובד עבור תמונה קטנה אחת וקורס עבור כל השאר, כי קריאה לכלי היא טקסט: התמונה צריכה להיות מקודדת לתוך השיחה, ותמונה בודדת ברזולוציה מלאה יכולה לחרוג מחלון ההקשר (context window) השלם של ה-AI. לפצל את זה לקריאות נוספות רק מחמיר את המצב, כי כל קריאה נשארת בתמליל ונשלחת מחדש בכל תור מאוחר יותר.

אז הכלים לא מעבירים תמונות בכלל. request_photos מנפיק כרטיס העלאה — אישור קצר-מועד וחד-תכליתי לאלבום אחד — ומי שבאמת מחזיק בתמונות שולח אותן ישירות אלינו:

  • התמונות נמצאות בטלפון שלכם. הכרטיס מגיע עם קישור. אתם פותחים אותו, בוחרים את התמונות שלכם, זהו. מאות מהן, ואף אחת לא עוברת דרך ה-AI.
  • נתתם לסוכן גישה לקבצים שלכם. אז הוא מעלה אותן בעצמו, ישירות, מהדיסק אל Sustain. הסוכן אף פעם לא קורא את התמונות לתוך השיחה — הוא רק משתמש בכרטיס.
  • הספרייה שלכם נמצאת ב-Google Photos. import_google_photos מתחיל הפעלת בורר (picker session), אתם בוחרים בחלון של Google עצמה, ו-Sustain מוריד אותן בצד השרת — עד אלף תמונות, שוב מבלי ששום דבר עובר דרך הסוכן.

הכרטיס פג תוקף תוך 24 שעות, מוגבל לאלבום אחד, ועדיין כפוף למגבלות התמונות והאחסון של התוכנית שלכם. זהו אותו מנגנון שעומד מאחורי העלאה באמצעות קוד QR שכבר קיימת אצלנו, וזה סימן טוב: העיצוב הנכון עבור סוכן התברר להיות בדיוק זה שכבר בנינו עבור בני אדם.

מסלול Google Photos הוא המקום שבו הסוכן באמת משתתף בבחירה: אחרי שבחרתם, הוא יכול להשמיט את הסרטונים ולדלג על צילומי המסך לפני הייבוא. אנחנו נזהרים עד כמה להרחיק את הטענה הזו — Google נותנת לנו שם קובץ וסוג קובץ ושום דבר על מה נמצא בתוך תמונה, כך שסוכן שיגיד לכם שהוא הסיר את התמונות המטושטשות פשוט ימציא זאת.

הכלל שדבקנו בו

מעבירים את היכולת, לא את הנתונים. הסוכן מקבל כרטיס; התמונות עוברות ישירות מהמקום שבו הן נמצאות אלינו.

הוא אף פעם לא רואה את הסיסמה שלכם

זה החלק שעליו אנשים שואלים ראשון, והתשובה טובה יותר ממה שהיא בדרך כלל באינטגרציות של סוכנים.

הכלים פועלים בתוך הלשונית של הדפדפן שלכם, בעמוד שאליו כבר התחברתם. כשאחד מהם קורא ל-API שלנו, הדפדפן שלכם מצרף את אותה עוגיית הפעלה (session cookie) מאובטחת שהוא תמיד מצרף. אין טוקן להנפיק, אין מסך OAuth, אין מפתח API שמודבק לתוך צ׳אט, ואין פרט אימות שהסוכן יכול לקרוא, לאחסן או לדלוף. הוא יכול לפעול רק כאדם שכבר מחובר לאותה לשונית, ורק כל עוד ההפעלה נמשכת.

זה גם קובע את התקרה למה שסוכן שמתנהג לא כשורה יכול לעשות: בדיוק מה שאתם עצמכם יכולים לעשות באותה לשונית, ולא יותר. השרת בודק כל הרשאה באופן עצמאי, בדיוק כמו כשאתם לוחצים.

מה שהוא בכוונה לא יעשה

יש דברים שלא צריכים לקרות רק כי תוכנה החליטה שהם צריכים. השארנו אותם בחוץ בכוונה:

  • הוא לא יכול לבצע הזמנת הדפסה. זה מוציא כסף אמיתי ודורש כתובת משלוח. אתם עושים את זה בעצמכם.
  • הוא לא יכול לגבות תשלום. start_checkout יוצר הפעלת תשלום (checkout session) ומוסר לכם את הקישור — אתם משלמים בעמוד של ספק התשלומים עצמו. הכלים לעולם לא נוגעים בפרטי כרטיס.
  • הוא לא יכול לקחת לעצמו את הקבצים שלכם. עמוד אינטרנט לא יכול לקרוא את הדיסק שלכם — דפדפנים אוסרים זאת, וזה פיצ׳ר ולא באג. סוכן יכול להעלות רק את מה שנתתם לו במכוון גישה אליו, ורק באמצעות כרטיס שביקשתם ממנו ליצור.
  • הוא לא יכול לבטל את המנוי שלכם או למחוק אלבום.

דבר אחד שהוא כן יכול לעשות הוא להוציא קרדיטים: build_album מריץ את הבנייה בתשלום של ה-AI בקריאה בודדת, והעלות תלויה בכמה תמונות שורדות את הסינון מכפילויות. אנחנו מתייחסים לקרדיטים כמו שכל API מדוד מתייחס לטוקנים — הכלי אומר בפירוש שהוא מוציא אותם, ואם היתרה שלכם קצרה הוא חוזר עם החוסר המדויק כדי שהסוכן יוכל לספר לכם ולהציע להטעין ולא להיכשל בשקט.

לנסות את זה היום — הסטטוס הכן

יש עכשיו שתי דרכים, והן בשלבים שונים לגמרי.

חיבור עוזר דסקטופ עובד היום, בלי להפעיל שום דבר — ראו חיבור Claude או ChatGPT בסוף הפוסט. נדרשת תוכנית Basic או Pro.

הדרך בתוך הדפדפן עדיין דורשת הפעלה ידנית. WebMCP הוא תקן חדש ממש, ועדיף שנספר לכם איפה הוא עומד: Chrome תומך בו מגרסה 149 אבל לא הפעיל אותו כברירת מחדל. ב-Chrome 149 ומעלה פתחו chrome://flags/#enable-webmcp-testing, הגדירו את הדגל ל-Enabled ולחצו Relaunch.

לנסות עם בודק הכלים של Chrome (חמש דקות)

Google מפרסמת הרחבה בשם Model Context Tool Inspector בדיוק בשביל זה — מותקנת מ-Chrome Web Store כמו כל הרחבה אחרת, עם קוד מקור פתוח לציבור. זה המסלול הקצר ביותר מסקרנות לאלבום מוגמר, והיום זה המסלול שאליו באמת היינו מפנים אתכם.

1

התקינו את הרחבת הבודק

פתחו את הרישום WebMCP — Model Context Tool Inspector ב-Chrome Web Store ולחצו על Add to Chrome, ואז Add extension. הצמידו אותה מסמל חלקי הפאזל בסרגל הכלים כדי שתוכלו להגיע אליה במהירות. היא נבנתה על ידי מהנדס של Chrome והקוד פתוח לציבור; היא מציגה את הכלים שעמוד מציע ומאפשרת לכם לדבר איתם באמצעות Gemini.

2

פתחו את Sustain והתחברו

גשו ל-sustain-app.com והתחברו כרגיל. הכלים נרשמים כנגד ההפעלה שלכם — במצב מנותק תראו רק את ask_site.

3

בדקו שהכלים נמצאים שם

לחצו על סמל ההרחבה כאשר Sustain היא הלשונית הפעילה. אתם אמורים לראות רשימה של עשרה כלים, מ-ask_site ועד build_album. רשימה ריקה אומרת שהדגל לא נכנס לתוקף — ודאו שכתוב Enabled בכתובת chrome://flags/#enable-webmcp-testing והפעילו מחדש שוב.

4

בקשו אלבום

הדביקו את ההנחיה מסוף הסעיף הזה לתוך תיבת הצ׳אט של הבודק. תראו את create_album מופעל, העורך נפתח על האלבום הזה, ו-request_photos חוזר עם קישור העלאה. לא לחצתם על כלום.

5

שלחו את התמונות

פתחו את הקישור בטלפון שלכם ובחרו את התמונות שלכם. אחר כך שאלו את הסוכן "הן כבר נכנסו?" — הוא בודק שוב ושוב את album_status ומודיע לכם על הכמות.

6

בנו אותו

בקשו ממנו "לסדר אותן" לטיוטה חינמית (quick_place), או "לבנות את האלבום כמו שצריך" כדי להריץ את המעבר בתשלום של ה-AI (build_album). הוא יודיע לכם קודם אם יתרת הקרדיטים שלכם קצרה.

מה לגבי אפליקציות AI לדסקטופ?

עכשיו כן — זה החלק בפוסט שהשתנה.

כשפרסמנו את זה לראשונה, התשובה הכנה הייתה עדיין לא. עוזרי דסקטופ מדברים MCP אבל לא WebMCP: הם מדברים עם שרתים ואין להם עמוד מולם. אמרנו שהדרך שאנחנו באמת רוצים היא שרת MCP מתארח, כך שסוכן בלי דפדפן יוכל לפעול בחשבון שלכם דרך הרשאת OAuth שתוכלו לבדוק ולבטל.

זה נבנה. הכתובת https://mcp.sustain-app.com/mcp היא שרת MCP אמיתי, ו-Claude,‏ ChatGPT או כל לקוח MCP אחר יכולים להתחבר אליו ישירות — בלי תוסף, בלי דגל, בלי גשר. אתם מתחברים דרך מסך האישור של Sustain, מסמנים מה מותר לסוכן, ומנתקים מתי שתרצו.

עדיין לא נפנה אתכם לתוסף “גשר” קהילתי. הם נטענים בדרך כלל לא ארוזים — לא חתומים, מחוץ לבדיקה של חנות Chrome — ויכולים לראות ולפעול בכל לשונית שאתם מחוברים בה. עכשיו גם אין סיבה: הדרך הנתמכת קיימת.

ואז תגידו את זה

ברגע שהבודק מותקן ו-Sustain פתוחה מולו, זו ההנחיה שכדאי להתחיל איתה. הדביקו אותה וצפו בקריאות עוברות.

היא נעצרת בכוונה לפני שמוציאה משהו: היא מבקשת פריסה חינמית ותיאור של מה שבנייה בתשלום הייתה עושה, כך שהריצה הראשונה שלכם לא יכולה להפתיע אתכם בחיוב קרדיטים.

נסו את ההנחיה הזו

תיצור אלבום ב-Sustain בשם "איטליה 2026", ואז תיתן לי קישור שאני יכול לפתוח בטלפון כדי להעלות את התמונות. אחרי שכולן נכנסות, תסדר אותן כדי שאוכל לראות טיוטה — אל תוציא עדיין קרדיטים, רק תגיד לי מה בנייה מלאה של ה-AI הייתה עושה.

למה אנחנו חושבים שזה חשוב

יש גרסה של השנים הקרובות שבה אנשים מפסיקים לבקר באתרים ומתחילים לבקש מעוזר להתמודד איתם. בעולם הזה, אתר שמדבר רק בפיקסלים הוא אתר שסוכן טועה בו, מוותר עליו, או מדלג עליו לטובת אתר שהוא באמת יכול להפעיל.

להיות מוכן לסוכנים זה לא תג כבוד. זה ההבדל בין עוזר שיכול באמת להכין לכם אלבום תמונות לבין עוזר שלוחץ פה ושם, מוציא לכם קרדיטים בטעות, ומחזיר משהו שלא ביקשתם. אנחנו מעדיפים להיות קריאים למכונות שעושות יותר ויותר את הבקשה במקומכם.

זה גם שומר עלינו כנים לגבי המוצר שלנו עצמו. כתיבת תיאור לכלי מכריחה אתכם לומר בדיוק מה פעולה עושה ומה היא עולה, במשפט אחד, ללא ממשק שאפשר להסתתר מאחוריו. כמה מהתיאורים שלנו התבהרו תוך כדי הכתיבה.

חיבור Claude או ChatGPT (שתי דקות)

זו הדרך שלא דורשת דגלים ולא תוספים. היא חלק מהתוכניות Basic ו-Pro.

ב-Claude פתחו Settings → Connectors → Add custom connector והדביקו https://mcp.sustain-app.com/mcp. Claude ימצא את השאר בעצמו.

תגיעו לעמוד של Sustain ששואל מה מותר לאפליקציה הזו לעשות בחשבון שלכם. ארבע תיבות: לראות את האלבומים שלכם, ליצור ולערוך אלבומים, להוציא את הקרדיטים שלכם על הרצות AI, ולראות את יתרת הקרדיטים והתוכניות. אפשר לסמן פחות ממה שהוא ביקש — הסוכן מקבל את מה שאישרתם. סוכן בלי להוציא קרדיטים אפילו לא רואה את הכלי שמתחיל הרצה בתשלום.

ואז פשוט תבקשו. “תבנה לי אלבום מהטיול לאיטליה” מספיק: הסוכן יוצר את האלבום, נותן לכם קישור העלאה לטלפון, מחכה לתמונות, ומציע להריץ את הבנייה של ה-AI — ואומר שזה עולה קרדיטים לפני שהוא עושה את זה.

אפשר לבטל בכל רגע דרך הגדרות → אפליקציות מחוברות. הניתוק נכנס לתוקף כבר בקריאה הבאה של הסוכן, כי אנחנו מנפיקים את האסימונים האלה בעצמנו ולא מחלקים משהו שאי אפשר לבטל.

התקרות, מכיוון שהוא יכול להוציא קרדיטים

הרשאה שניתנה היא לא צ׳ק פתוח, והתקלה שאנחנו באמת מצפים לה היא לא תוקף — אלא סוכן שנתקע בלולאה על קריאה שהוא חשב שנכשלה.

לכן יש מגבלות שתקפות תמיד: תקרה לכמה קריאות בדקה חיבור יכול לבצע, ותקרה לכמה הרצות בתשלום הוא יכול להתחיל ביום. אם מגיעים לאחת מהן הסוכן מקבל הודעה ברורה, ואתם עדיין יכולים לעשות את אותו הדבר באתר.

כל קריאה של סוכן גם נרשמת — איזה כלי, אם זה עבד, ועל מה זה היה. לא מה שכתבתם: הארגומנטים נשמרים כטביעת אצבע ולא כטקסט.

שאלות נפוצות

אנו משתמשים בעוגיות לניתוח שימוש באתר ולשיפור החוויה שלכם. למידע נוסף