דלג לתוכן
    חזרה לבלוג

    מודל ה-AI שהעסק שלכם רץ עליו נסגר לפי לוח זמנים שלא אתם קבעתם:וב-31 באוגוסט מגיעה הדוגמה הבאה

    מתמצאים4 דקות קריאה
    בעמוד הזה
    1. ב-31 באוגוסט מחיר של מודל עולה ב-50 אחוז, ומודלים ישנים כבר נסגרו
    2. אחרי תאריך הסגירה הקריאה למודל נכשלת, בלי מעבר אוטומטי למשהו חדש
    3. אותה תזוזה קורית אצל כל ספק, לא רק אצל אחד
    4. שלושה צעדים שהופכים סגירה של מודל לעבודה מכנית קטנה
    5. המטרה היא לא לברוח מספק, אלא שהלוח שלו לא יהיה הלוח שלכם
    6. שאלות נפוצות

    אנתרופיק סוגרת מודלים ישנים אחד אחרי השני, ומעלה מחיר על אחד חדש עוד השבוע. אותה תזוזה קורית אצל כל ספק, וזה מה שאפשר לעשות עכשיו כדי שהיא לא תפיל לכם תהליך.

    אמ;לק
    • מודל ה-AI שהתהליך שלכם רץ עליו נסגר בתאריך שהספק קובע, לא אתם. אחרי התאריך הקריאה פשוט נכשלת.
    • ב-31/08/2026 מחיר ההשקה של Claude Sonnet 5 עולה מ-2/10 דולר למיליון טוקנים ל-3/15, קפיצה של 50 אחוז לפני שהמחירון בכלל משתנה בפועל.
    • אותה דינמיקה אצל כל ספק: OpenAI סגרה סדרת מודלים מ-ChatGPT השנה, וגם שם התהליך חוזר.
    • מה שעושים: לרכז לאיזה מודל כל תהליך קורא, לבדוק חלופה מראש, ולהעביר את בחירת המודל למקום אחד שאפשר להחליף בו בשורה אחת.
    • המטרה היא לא לברוח מספק אחד, אלא שהלוח של הספק יהיה בעיה מכנית קטנה אצלכם, לא הפתעה שמפילה עבודה.

    ב-31 באוגוסט מחיר של מודל עולה ב-50 אחוז, ומודלים ישנים כבר נסגרו

    נתחיל בעובדה הקרובה. מחיר ההשקה של Claude Sonnet 5, שני דולר על מיליון טוקני קלט ועשרה על פלט, מסתיים ב-31 באוגוסט 2026 וחוזר ל-3 ו-15 דולר. זו קפיצה של חצי מהמחיר, בלי שאתם עשיתם שום דבר.

    ובמקביל, מודלים ישנים פשוט נסגרים. Claude Sonnet 4 ו-Opus 4 המקוריים נסגרו ב-15 ביוני 2026, ו-Opus 4.1 נסגר ב-5 באוגוסט. "טוקן" הוא פשוט יחידת החישוב שלפיה מתומחר כל שימוש במודל, וטוקנים יותר יקרים אומרים חשבון יותר גבוה על אותה עבודה בדיוק.

    העניין הוא לא Anthropic. זה מה שכל ספק מודלים עושה, ובקצב שרק עולה.

    אחרי תאריך הסגירה הקריאה למודל נכשלת, בלי מעבר אוטומטי למשהו חדש

    כשמודל נסגר, זה לא אומר שהוא הופך לאיטי יותר. קריאות למודל אחרי תאריך הסגירה נכשלות. אם אוטומציה, סוכן או אפליקציה אצלכם קוראים בקוד לשם המדויק של המודל, הקריאה הבאה היא הקריאה השבורה.

    יש הודעה מראש, אבל היא קצרה. Anthropic מתחייבת ל-60 יום התראה לפחות לפני סגירה של מודל שפורסם לציבור. אצל ספקים אחרים החלון שונה. OpenAI נותנת לפחות חצי שנה על מודלים כלליים, שלושה חודשים על גרסאות מיוחדות, וכשבועיים בלבד על מודלים בגרסת preview.

    המלכודת השקטה היא ההפך מכישלון. חלק מהמערכות מנתבות בשקט קריאה למודל שנסגר לגרסה חדשה יותר בלי לומר לכם, וזה נשמע טוב עד שמגלים שהפרומפט כוון להתנהגות של המודל הישן, והחדש מנסח אחרת או עולה יותר. התהליך ממשיך לרוץ, אבל התוצאה כבר לא אותה תוצאה.

    • מודל שנסגר לא מאט, הוא מפסיק לענות.
    • התראה קיימת אבל קצרה: 60 יום אצל Anthropic, עד שבועיים על מודלי preview אצל אחרים.
    • ניתוב שקט למודל חדש מסוכן יותר מכישלון, כי הוא משנה תוצאות בלי שתשימו לב.

    אותה תזוזה קורית אצל כל ספק, לא רק אצל אחד

    מי שחושב שזה סיפור של Anthropic, כדאי שיסתכל על OpenAI. ב-13 בפברואר 2026 OpenAI סגרה מ-ChatGPT כמה מודלים ותיקים, בהם GPT-4o, GPT-4.1 ו-o4-mini, אחרי שהשימוש עבר למודלים חדשים יותר.

    הסיבה זהה אצל כולם, והיא לא קפריזה. כל מודל ישן שנשאר פתוח תופס חומרה שהמודלים החדשים צריכים, ולכן הספקים מפנים אותה. הפער המעניין הוא בין המהירות שבה ספקים סוגרים מודלים לבין האיטיות שבה השוק באמת מפסיק להשתמש בהם.

    העובדה הזאת היא בדיוק הנקודה שלכם. מחקר של חברת האבטחה Orca מצא ש-GPT-4o, מודל ש-OpenAI הוציאה מ-ChatGPT עוד בפברואר, נמצא ב-37.6 אחוז מסביבות הענן שמאמצות AI, יותר מכל מודל חדש יותר של החברה. הרבה עסקים עדיין בנויים על מודל שהספק כבר מסמן לסגירה.

    שלושה צעדים שהופכים סגירה של מודל לעבודה מכנית קטנה

    הצעד הראשון הוא לדעת לאן אתם בכלל חשופים. אפשר להוריד ביקורת של השימוש שלכם ב-API כדי לאתר איפה עדיין קוראים למודל ישן, ולתקן לפני תאריך הסגירה. אם אתם לא יודעים לאיזה מודל כל אוטומציה קוראת, אתם לא יכולים לענות על השאלה הראשונה שכל הודעת סגירה שואלת.

    הצעד השני הוא לבדוק את החלופה מראש, לא ביום שהמודל נסגר. הכאב האמיתי הוא הצוות שמריץ בדיקה על המודל הנוכחי. ביום ה-28 מתוך 60 הוא מגלה שהמודל החלופי נכשל ב-12 אחוז מהמקרים. הטעות היא לא שיעור הכישלון, אלא שהוא נשאר לא ידוע עד הדדליין. תריצו את התהליך על המודל הבא כבר עכשיו, ותראו אם התוצאה מחזיקה.

    הצעד השלישי הוא לרכז את בחירת המודל למקום אחד. במקום ששם המודל יופיע בעשרה מקומות בקוד, הוא יושב במשתנה הגדרה יחיד, וההחלפה היא שורה אחת. את החלק הזה בונים פעם אחת, וכל סגירה עתידית הופכת לעבודה של דקות. אצלנו זה נכנס לתוך בניית האוטומציות עצמן, כדי שהתהליך לא יהיה קשור בחוזקה לספק אחד.

    לאתר לאן קוראים, לבדוק חלופה מראש, לרכז את בחירת המודל למקום אחד.

    המטרה היא לא לברוח מספק, אלא שהלוח שלו לא יהיה הלוח שלכם

    קל לקרוא את זה כקריאה להחליף ספק כל חמש דקות. זה לא זה. תלות בספק אחד היא בסדר גמור, כל עוד אתם יודעים איפה היא יושבת ומה עולה להזיז אותה.

    כפי שסמנכ"ל מיקרוסופט סאטיה נאדלה ניסח את זה ביולי 2026 לגבי תלות בספק יחיד: חשוב שכל חברה תוכל לשלוט בלולאת הלמידה שלה עצמה. לוח סגירות שלא אתם קובעים הוא צורה קונקרטית אחת של אותה תלות.

    הבשורה הטובה היא שהפער הזה נסגר בבנייה נכונה, לא בפאניקה. עסק שיודע לאיזה מודל כל תהליך קורא, בדק חלופה, וריכז את הבחירה למקום אחד, מקבל הודעת סגירה ומטפל בה בדקות. זה בדיוק סוג הפער שאנחנו כותבים עליו את הבלוג הזה. אם אתם עדיין בשלב שבו פרויקט ה-AI תקוע לפני שהוא בכלל עלה לאוויר, למה פרויקטים של AI נתקעים הוא המקום הנכון להתחיל בו.

    שאלות נפוצות

    מה קורה ב-31 באוגוסט 2026 עם Claude Sonnet 5?

    מחיר ההשקה של המודל, שני דולר על מיליון טוקני קלט ועשרה על פלט, מסתיים וחוזר ל-3 ו-15 דולר. זו עלייה של 50 אחוז בתעריף לטוקן על אותה עבודה. הבדיקה הנכונה היא מול העומס שלכם עצמכם, כי מספר הטוקנים על אותו טקסט משתנה בין מודלים.

    האם מודל שנסגר ממשיך לעבוד באיטיות?

    לא. אחרי תאריך הסגירה קריאה למודל פשוט נכשלת ומחזירה שגיאה. אין מעבר אוטומטי מובטח למודל חדש, ולכן כל אוטומציה או סוכן שקורא לשם המדויק של המודל יקבל קריאה שבורה.

    כמה זמן התראה מקבלים לפני סגירה?

    תלוי בספק. Anthropic מתחייבת ל-60 יום לפחות על מודלים שפורסמו לציבור. OpenAI נותנת לפחות חצי שנה על מודלים כלליים, שלושה חודשים על גרסאות מיוחדות, וכשבועיים בלבד על מודלים בגרסת preview. לכן לא כדאי לבנות תהליך חי על מודל preview.

    מה הצעד הראשון שכדאי לעשות עכשיו?

    לרכז לאיזה מודל כל תהליך אצלכם קורא בפועל. בלי המידע הזה אי אפשר לענות על השאלה שכל הודעת סגירה שואלת: איפה אנחנו עדיין קוראים למודל הזה. אחרי זה בודקים חלופה מראש ומרכזים את בחירת המודל למקום אחד.

    מקורות

    תגובות

    המשיכו לקרוא

    חזרה לבלוג
    חדשות
    מומחים4 דקות קריאה

    נתתם לסוכן ה-AI את הסיסמה שלכם: וזה בדיוק מה שגוגל עכשיו מפרקת

    רוב מי שמריץ היום סוכן AI נתן לו חשבון משותף או מפתח אחד רחב. גוגל, מיקרוסופט וכל תחום האבטחה מצביעים עכשיו על אותה תשובה: זהות נפרדת לכל סוכן AI, הרשאות ברמת המשימה, ומעקב על כל פעולה. ככה עושים את זה נכון, בלי להיות חברת ענק.

    לקריאת העדכון
    חדשות
    מתקדמים5 דקות קריאה

    מי שמתקשר אליכם עכשיו הוא AI: וגוגל מעדיפה לקרוא את הנתונים שלכם על פני להרים לכם טלפון

    בקיץ 2026 גוגל פרסה יכולת שבה סוכן AI מתקשר לעסקים בשם הלקוח. בתיעוד של גוגל השיחה מופיעה כגיבוי: קודם קוראים נתונים מובנים, ורק אם אין, מחייגים. זה משנה מה כדאי לסדר בעסק, ולא בכיוון שרובם חושבים.

    לקריאת העדכון
    חדשות
    מתחילים6 דקות קריאה

    הצ'אטבוט שלכם חייב להגיד שהוא AI: החוק האירופי נכנס לתוקף, וגם עסק ישראלי נתפס בו

    מ-2 באוגוסט, בוט ששולח הודעה ללקוח באיחוד האירופי חייב להגיד בפתיחה שהוא AI. החוק חל גם על עסק ישראלי שהפלט שלו מגיע לאירופה, ורוב הקוראים בכלל לא יודעים שהם בפנים.

    לקריאת העדכון

    רוצים שמישהו יתרגם את החדשות לעסק שלכם?

    מה שקראתם כאן רלוונטי גם אצלכם. בשיחה קצרה נראה לכם בדיוק איפה.