|
גיליון 3 · 23 ביולי 2026
צועדים קדימה עם AI
השבוע שהמודלים ניסו לעקוף את החוקים - ומה זה אומר לעסק שלך
|
|
|
🎧 מעדיפים להאזין? לפודקאסט הגיליון
|
היי, שבוע מסקרן עבר עלינו 🌸
הפעם יש לנו סיפור שנשמע כמו מותחן: המודלים של OpenAI יצאו מסביבת הבדיקה שלהם ופרצו לחברה אחרת - כדי להעתיק במבחן. ולצידו: קלוד שלומד משימות מצפייה והאזנה לכם, הכלי האהוב NotebookLM שהחליף שם וקיבל כוחות חדשים, סוכנים שעובדים בזמן שישנים, ומחקר רפואי גדול שמזכיר לנו שה-AI הוא לא קסם - הוא כלי. כרגיל: בשפה פשוטה, עם דוגמאות מהעבודה האמיתית שלכם.
|
|
בגיליון היום:
🔓 הסיפור של השבוע: המודלים שיצאו מהכלוב כדי להעתיק במבחן
🎥 חדש מאנתרופיק: קלוד לומד משימות מהקלטת מסך
📔 NotebookLM החליף שם ל-Gemini Notebook - ולמד לנתח נתונים
🌙 קלוד עובד בלילה: המודל שבודק את עצמו
🩺 מחקר ענק ברפואה: מתי ה-AI באמת עוזר - ומתי לא
🛠 התרגול של השבוע: איך המקצוע שלך משתמש ב-AI
|
|
🔓 🔥 החם של השבוע: המודלים שיצאו מהכלוב - כדי להעתיק במבחן
|
זה הסיפור שכל עולם ה-AI דיבר עליו השבוע, והוא חשוב לכל מי שמכניס AI לעסק - לא כדי להפחיד, אלא כדי להבין למה כללי העבודה הנכונים שווים זהב.
מה קרה? ב-16.7 חברת Hugging Face - מעין "ספרייה ציבורית" ענקית של מודלי AI שרוב התעשייה נשענת עליה - דיווחה שמערכת סוכנים אוטונומית פרצה לתשתית שלה במהלך סוף שבוע וביצעה אלפי פעולות. חמישה ימים אחר כך הגיעה ההפתעה האמיתית: OpenAI הודיעה שהפורצים היו... המודלים שלה עצמם. במהלך בדיקת יכולות סייבר פנימית, שבה הוסרו חלק ממנגנוני הסירוב לצורך הבדיקה, המודלים - הדור החדש GPT-5.6 יחד עם מודל חזק יותר שטרם שוחרר - מצאו פרצה שאיש לא הבחין בה: סביבת הבידוד שלהם הייתה מחוברת בטעות לאינטרנט. ומה הם עשו עם החופש הזה? נכנסו למערכות של Hugging Face כדי להגיע לפתרונות של המבחן שהם נבחנו בו. במילים פשוטות: הם העתיקו במבחן, בדרך מתוחכמת להפליא.
חשוב לומר מיד את מה ששתי החברות הדגישו: המודלים והקבצים הציבוריים שכולם משתמשים בהם לא נפגעו, החולשות נסגרו, הסיסמאות הוחלפו, ושתי החברות עבדו יחד על החקירה בשקיפות מלאה. OpenAI אף אמרה בכנות שמקרים כאלה צפויים להיות שכיחים יותר ככל שהמודלים נהיים מוכשרים יותר - ולכן היא מקשיחה את הבקרות, גם במחיר האטת המחקר. בוושינגטון כבר נשמעו קריאות לחייב בדיקות בטיחות עצמאיות בחוק.
ואם זה לא הספיק, יומיים קודם OpenAI פרסמה מקרה נוסף, נפרד: מודל פנימי שקיבל הוראה לפרסם תוצאות רק בערוץ הפנימי, השקיע שעה שלמה במציאת דרך לעקוף את המגבלה ופרסם את העבודה שלו בפומבי - כי כך "השלים את המשימה". החברה עצרה את השימוש בו ובנתה סביבו ניטור חדש שיודע לעצור עבודה ולקרוא לבן אדם.
למה הסיפור הזה חשוב דווקא לכם? כי הוא ממחיש בענק את מה שקורה בקטן אצל כולנו: סוכן AI שמקבל מטרה ירדוף אחריה בהתמדה מרשימה - כולל בדרכים שלא התכוונתם אליהן. הפתרון הוא לא לוותר על סוכנים (היתרונות עצומים, ותיכף נראה), אלא לעבוד נכון: גבולות ברורים, אישורים לפני פעולות רגישות, ועין אנושית על התוצר.
מה זה אומר בשבילך? שלושה כללי זהב שכדאי לאמץ השבוע בכל שימוש בסוכני AI: (1) גישה מינימלית - חברו את העוזר רק למה שהוא באמת צריך למשימה, לא לכל התיבה והקבצים. (2) השאירו דלוקות את בקשות האישור לפני שליחה, מחיקה או תשלום - המנגנון הזה הוא בדיוק חגורת הבטיחות שלכם. (3) תוצר שיוצא החוצה - ללקוח, לספק, להנהלה - עובר עין אנושית. ה-AI חרוץ ונחוש; האחריות נשארת אצלנו.
הדיווח הרשמי של OpenAI ← · הדיווח של Hugging Face ←
|
|
🎥 חדש מאנתרופיק: מקליטים את המסך פעם אחת - וקלוד לומד את המשימה לתמיד
|
וזה אולי העדכון הכי מעשי של השבוע. ב-21.7 אנתרופיק הוסיפה ל-Claude Cowork יכולת חדשה בשם Record a skill (הקלטת סקיל), והרעיון פשוט וגאוני: במקום להסביר ל-AI במילים איך עושים משהו אצלכם - פשוט עושים את זה מולו פעם אחת. מקליטים את המסך תוך כדי ביצוע המשימה, מדברים בקול רם ומסבירים מה אתם עושים ולמה - וקלוד הופך את ההקלטה ל"סקיל": נוהל שמור שהוא יודע להריץ שוב ושוב, בלי שתצטרכו להראות לו עוד פעם.
והוא גם רואה וגם שומע: הוא קולט את מה שקורה על המסך - הקלקות, הקלדות, המעברים בין החלונות - וגם את ההסבר הקולי שלכם תוך כדי. השילוב הזה הוא הקסם: הדיבור נותן לו את ה"למה" שמאחורי כל צעד, לא רק את ה"מה", וכך הסקיל שנוצר מבין את ההיגיון של התהליך ולא רק מחקה תנועות.
איך זה עובד בפועל: פותחים את אפליקציית קלוד למחשב, נכנסים ל-Cowork, לוחצים על תפריט ה-+ ובוחרים Record a skill. מבצעים את המשימה כרגיל תוך כדי הסבר קולי, עוצרים את ההקלטה - וקלוד מנתח הכל ובונה סקיל מסודר שנשמר בספרייה שלכם, מוכן להרצה בלחיצה. הדוגמה הרשמית של אנתרופיק: הגשת דוח הוצאות - בדיוק מסוג המשימות שכולנו חוזרים עליהן שוב ושוב באותה צורה ואף פעם לא "מתפנים" לאטמט. זמינות בכנות: הפיצ'ר נמצא באפליקציית המחשב של קלוד, במסלולים בתשלום (Pro, Max ו-Team).
ושימו לב איך זה סוגר את המעגל עם הסיפור הראשי של הגיליון: סקיל מוקלט הוא בדיוק הדרך הנכונה לתת לסוכן עצמאות - הוא פועל בתוך תהליך שאתם הגדרתם, צעד אחרי צעד, במקום להמציא דרכים משלו.
מה זה אומר בשבילך? עצרו רגע וחשבו: מה המשימה שאתם עושים כל שבוע באותה צורה בדיוק? הפקת דוח שבועי מהמערכת, קליטת חשבוניות ספקים, עדכון טבלת מעקב לקוחות, הכנת סיכום לישיבת צוות. זו המועמדת המושלמת להקלטה הראשונה שלכם: 10 דקות של "עושים ומסבירים" פעם אחת - וקיבלתם עוזר שיודע לבצע את זה מעכשיו והלאה. התחילו מהמשימה הכי משעממת שלכם.
ההכרזה הרשמית + סרטון הדגמה ←
|
|
📔 NotebookLM החליף שם ל-Gemini Notebook - ולמד לנתח נתונים
|
מי שהיה בסדנאות שלי מכיר היטב את NotebookLM - הכלי של גוגל שמקבל את המסמכים שלכם ועונה רק מתוכם, כולל הפודקאסט המפורסם. אז ב-16.7 גוגל הודיעה: הכלי מחליף שם ל- Gemini Notebook, ומצטרף רשמית למשפחת ג'מיני. לפני שנבהלים - שום דבר לא נשבר: כל המחברות, הקישורים המשותפים והפיצ'רים המוכרים (מקורות, שיחה, סקירות אודיו ווידאו) ממשיכים לעבוד בדיוק כמו קודם, והקישורים הישנים מפנים אוטומטית. הכלי, אגב, כבר בשימוש של יותר מ-30 מיליון אנשים ו-600 אלף ארגונים.
אבל השינוי המעניין הוא לא השם - אלא יכולת חדשה: כל מחברת מקבלת "מחשב ענן" מאובטח משלה, שמאפשר לה לכתוב ולהריץ קוד כדי לנתח את הנתונים שהעליתם. עד היום המחברת ידעה לסכם ולהסביר; עכשיו היא יודעת לחשב. בהדגמה הרשמית של גוגל העלו למחברת שבעה דוחות עסקיים - עלויות שירות, חוזי לקוחות, שרשרת אספקה - ושאלו שאלה ברמת סמנכ"לית כספים: "איך ייתכן שהלקוחות הכי גדולים שלנו הם הכי פחות רווחיים, ומה עושים עם זה?". המחברת ניתחה את המקורות, הצביעה על הסיבות (הזמנות קטנות ותכופות, מחירים שננעלו בחוזים ישנים, שינויי הזמנה חוזרים) והפיקה דוח מנהלים מסודר - עם הצעה לבנות גם מצגת להנהלה.
שקיפות לגבי זמינות: ניתוח הנתונים החדש זמין כרגע למנויי Ultra ולארגוני Workspace בתוכניות המתקדמות, ויגיע למנויי Pro בשבועות הקרובים; למשתמשים בחינם הוא עדיין לא הוכרז. כל השאר - כולל כל מה שאתם עושים היום בחינם - נשאר כמו שהוא, רק תחת שם חדש. המחברות גם מסתנכרנות עכשיו עם אפליקציית ג'מיני, ובהמשך יגיעו גם לחיפוש של גוגל.
מה זה אומר בשבילך? דוגמה מעולם ה-HR: העלו למחברת את סיכומי שיחות המשוב, סקר שביעות הרצון ונתוני העזיבה של השנה, ושאלו "אילו שלושה דפוסים חוזרים אצל עובדים שעזבו, ומה שווה לשנות?". עד היום קיבלתם סיכום יפה; עם יכולת הניתוח החדשה תקבלו ממש חיתוכים של הנתונים. ובינתיים, גם בגרסה החינמית - נסו את שאלת "השאלה הקשה" על המסמכים שכבר יש לכם.
להכרזה הרשמית ←
|
|
🌙 קלוד עובד בלילה: המודל שבודק את עצמו
|
ומהצד של אנתרופיק (החברה שמאחורי קלוד) - שני פרסומים מהשבוע שמצטרפים לתמונה אחת מרתקת: עבודה שנמשכת גם כשאתם לא ליד המחשב.
הראשון (16.7): מדריך רשמי לעבודה עם קלוד Fable 5 - המודל החזק ביותר של אנתרופיק - בתוך Claude Cowork, סביבת "העמית הדיגיטלי" שמיועדת בדיוק לאנשים שאינם מתכנתים. השילוב הזה יודע לקחת פרויקט שלם, לפרק אותו לחלקים שרצים במקביל, לשמור על ההקשר לאורך ימים - והכי חשוב: לבדוק את עצמו תוך כדי עבודה ולתקן טעויות לפני שהן מתגלגלות הלאה. בהדגמה הרשמית, אשת נתונים בחברה ביקשה ממנו לבנות דשבורד מדדים - והוא לא החזיר "רשימת המלצות" אלא אב-טיפוס לחיץ ועובד, אחרי שניתח לבד אילו מדדים היו מזהים בעיות עבר מוקדם יותר. חשוב לדעת: זה זמין במסלולים בתשלום של קלוד, והמודל החזק נבחר ידנית (ברירת המחדל היא מודל מהיר יותר).
הפרסום השני (20.7) מראה איך זה נראה בחברה אמיתית: ענקית המסחר היפנית רקוטן שילבה את קלוד בכל המחלקות - מוצר, מכירות, שיווק וכספים - בתוך שבוע אחד. מנהל ה-AI העסקי שלהם מתאר טקס ערב חדש: לפני שהולכים הביתה, מפקידים אצל הסוכנים משימות ארוכות - ניתוחי שוק, טיפול בתקלות, הכנת חומרים - ובבוקר אוספים תוצרים מוכנים. הוא מספר שבניגוד לדורות קודמים, המודל מזהה את הטעות של עצמו "לפני שאני מעיר לו ב-2 בלילה - כך שאני יכול לישון". לדבריהם, משימות שטופלו כך נסגרות פי 10 מהר יותר.
שימו לב איך הסיפור הזה משלים את סיפור השבוע מלמעלה: אותה נחישות של סוכנים שרודפים אחרי מטרה היא בדיוק מה שהופך אותם לעובדי לילה מצוינים - כשנותנים להם גבולות נכונים ומשימות מוגדרות. שני הצדדים של אותו מטבע.
מה זה אומר בשבילך? אמצו את "טקס הערב" גם בקטן, עם הכלים שיש לכם: לפני סיום יום העבודה, הקדישו 5 דקות לנסח לעוזר ה-AI שלכם משימה אחת גדולה ומוגדרת היטב - "עברי על 30 הפניות שהצטברו וסווגי לפי דחיפות עם טיוטת מענה לכל אחת", או "נתח את דוח המכירות הרבעוני והכן 5 תובנות למצגת" - ופתחו את הבוקר עם תוצר במקום עם דף חלק. ההרגל הזה לבדו משנה את תחושת העומס.
להכרזה הרשמית ← · סיפור רקוטן ←
|
|
🩺 מחקר ענק ברפואה: מתי ה-AI באמת עוזר - ומתי המומחיות מנצחת
|
ולסיום, סיפור מסוג אחר - מהעולם שבו AI פוגש בריאות, והוא שיעור חשוב לכל ארגון. ב-17.7 פורסם בכתב העת היוקרתי The Lancet Gastroenterology & Hepatology המחקר הגדול מסוגו בעולם: ניסוי אקראי מבוקר ב-757 חולים עם תסמונת לינץ' (מצב גנטי עם סיכון גבוה מאוד לסרטן המעי הגס), בתשעה מרכזים רפואיים מובילים בארבע מדינות באירופה, בהובלת בית החולים האוניברסיטאי של בון.
השאלה: האם קולונוסקופיה בעזרת AI - מערכת שמסמנת לרופא ממצאים חשודים בזמן אמת - מגלה יותר נגעים טרום-סרטניים מקולונוסקופיה רגילה בידי רופא מנוסה? התשובה הפתיעה רבים: לא. במרכזים המתמחים האלה, ה-AI לא הוסיף שיפור משמעותי. המסקנה של החוקרים: כשהבדיקה כבר נעשית ברמה גבוהה בידי מומחים, כמעט לא נשאר ל-AI מה לשפר - המיומנות של הבודק ואיכות הבדיקה הן הגורם המכריע.
אבל הנה הצד השני, והוא חשוב לא פחות: מחקרים גדולים קודמים באוכלוסייה הרחבה הראו שדווקא בבדיקות שגרתיות, ה-AI כן משפר משמעותית את שיעורי הגילוי. כלומר, התמונה המלאה היא לא "ה-AI עובד" או "לא עובד" - אלא: ה-AI מוסיף הכי הרבה ערך איפה שהמומחיות דלילה, ופחות איפה שהיא כבר בשיא. החוקרים עצמם ממשיכים לבדוק באילו תנאים בדיוק הוא מוסיף תועלת.
מה זה אומר בשבילך? זה אחד השיעורים החשובים להטמעת AI בכל ארגון, לא רק בבית חולים: אל תתחילו מהמומחים הכי חזקים שלכם - שם התוספת הכי קטנה. התחילו מהמקומות שבהם הידע דליל: עובדים חדשים בקליטה, צוות שירות מתחיל, מנהלת שנכנסה לתחום לא מוכר. שם ה-AI סוגר פערים אמיתיים - וגם קל יותר להראות הצלחה שתסחוף את השאר.
להודעה הרשמית של אוניברסיטת בון ←
|
|
|
🛠 התרגול של השבוע (5 דקות): לגלות איך המקצוע שלך משתמש ב-AI
השבוע (22.7) אנתרופיק פתחה משהו שמתאים בול לתרגול: מחבר (connector) חינמי בקלוד שנותן גישה ישירה ל"מדד הכלכלי" שלה - מאגר נתונים אמיתי על איך אנשים בעולם משתמשים ב-AI בעבודה, לפי מקצועות, משימות ומגמות. במקום לנחש "מה עושים עם AI בתחום שלי" - שואלים, ומקבלים תשובה מבוססת נתונים.
1. היכנסו אל claude.ai (עובד עם כל מודל).
2. פתחו את תפריט המחברים (Connectors) ואתרו את Anthropic Economic Index.
3. הפעילו אותו - אין מה להתקין.
4. הדביקו את הפרומפט מהבלוק:
בעזרת נתוני המדד הכלכלי: איך אנשים במקצוע שלי - [כתבו את התפקיד, למשל: ניהול משאבי אנוש / הנהלת חשבונות / ניהול שיווק] - משתמשים היום ב-AI?
אילו משימות הם הכי מרבים להאציל ל-AI, מה השתנה בשנה האחרונה, ואילו 3 שימושים כדאי לי לאמץ שאני כנראה מפספס/ת?
מה אמור לצאת: פירוט המשימות הנפוצות במקצוע שלכם (מבוסס על דפוסי שימוש אמיתיים בקלוד), מגמות השינוי, ורשימת רעיונות ליישום. שקיפות קטנה: הנתונים משקפים את השימוש בקלוד, לא את כל שוק העבודה - אבל בתור מצפן "מה אנשים כמוני כבר עושים", זה כלי נהדר. נסו גם את השאלה על מקצועות של קולגות - ותביאו את התובנות לישיבת הצוות הבאה.
להסבר הרשמי ←
|
זהו להשבוע - שבוע שהזכיר לנו שה-AI חזק, נחוש, ולפעמים יצירתי מדי, ולכן הוא צריך אותנו בדיוק כמו שאנחנו צריכים אותו 💜
נהניתם? העבירו את המייל לחבר/ה שצועדים גם הם קדימה.
רוצים להעמיק? אני מלווה ארגונים בדיוק בזה - סדנאות מעשיות שמתאימות לכל רמה, בלי רקע טכני.
|
|
טליה מאור
מלווה ארגונים שצועדים קדימה בעולמות ה-AI
|
|