TechSignal IL

כל אחד נתן לסוכן איבר שלא היה לו: זיכרון, אוזניים, עיניים וצוות ביום אחד

01.09.2026 · בטלגרם

היום, 1 בספטמבר, שחררו Anthropic, Meta ו-Google שלושה מודלים, ואתמול OpenClaw שחרר גרסה 2.0. אף אחד מהם לא מכר צ'אט חכם יותר.

חברת Anthropic שחררה את Claude Fable 5.1 ואמרה במפורש שהשינויים באו ממשוב לקוחות: תכנות ארוך על בסיס קוד שלם של אפליקציה, תכנון ניסויים מדעיים, סימולציה שלהם וקריאת טבלאות ודיאגרמות צפופות. חלון הקשר של מיליון טוקנים, 128 אלף טוקני פלט, 10 דולר למיליון טוקני קלט ו-50 לפלט, וקריאה מהמטמון ב-0.25 דולר שלפי החברה חותכת כרבע מהעלות בעומס רגיל. Cursor, Databricks ו-Harvey העלו אותו ביום ההשקה, ו-Cursor מדדה 73.4% ב-CursorBench 3.2, השיא שלה. Mythos 5.1, האח הגדול, נשאר בגישה מוגבלת לסייבר ולמדעי החיים.

בצד השמיעה, Meta הציגה את Muse Voice Transcribe, מודל התפיסה הקולית הראשון בזמן אמת של Meta Superintelligence Labs. האודיו נכנס במקטעים של 80 אלפיות שנייה, כל מקטע נדחס לטוקן אחד, ובכל מקטע המודל מחליט אם להמשיך להקשיב או לפלוט מילה. מודל אחד מתמלל, מפריד יותר מ-20 דוברים ומזהה סוף משפט, ב-70 שפות כולל מעבר שפה באמצע משפט. צוקרברג טוען מקום ראשון בתמלול זורם ובהפרדת דוברים. זמין היום ב-Meta Model API וב-Meta AI ל-Mac.

בצד הראייה, Google נתנה ל-Gemini 3.7 Flash, 3.6 Flash ו-3.5 Flash-Lite הבנת וידאו סוכנותית. עד היום המודל בלע וידאו בקצב פריימים קבוע מההתחלה עד הסוף. עכשיו הוא מחליט מה לראות, באיזו מהירות ודרך איזה ערוץ, פריימים, אודיו או תמלול, טוען רק את הקטע שהשאלה צריכה, ומחליט אם צריך להסתכל במקום נוסף. לפי Google זה חותך עד 88% מהטוקנים ועד 66% מהעלות. זה עובד כבר על קישורי YouTube דרך ה-API, ויגיע לאפליקציית Gemini ול-Ask YouTube בחודשים הקרובים.

בצד הצוות, OpenClaw של פיטר שטיינברגר שחרר אתמול גרסה 2.0, בפועל 2026.8.1. סשנים משותפים בענן: מנהל קובע לכל חבר צוות אם הוא קורא, מציע, מנסח או עובד ישירות, והמפתחים כותבים בעצמם שזה לא גבול אבטחה. הסשנים עברו ל-SQLite, ההתקנה סורקת מפתחות קיימים ומאמתת אותם לפני שמירה, מצב אינקוגניטו שומר שיחות בזיכרון בלבד, וזמן העלייה ירד מ-1.6 שניות ל-575 אלפיות.

דעתי: הקלט נהיה זול מהר יותר מהפלט. Google חתכה 66% מעלות הווידאו, ו-Anthropic הוזילה את הקריאה מהמטמון ולא את הפלט. המודלים כבר טובים מספיק, והמחסום הוא כמה עולה להראות להם את העולם. הרגע שבו מודל רואה תנועה ומבין אותה, לא פריים בודד, הוא הרגע שבו המרחק בינו לראייה אנושית מצטמצם מאוד, וכל מוצר שבנוי על ראייה, רובוט, רכב, מצלמה, מקבל פתאום את החלק שהיה חסר לו. אם אני צודק, המודל הבא של OpenAI, שלפי השמועות קרוב, יימכר על מה שהוא רואה ושומע ובכמה זה עולה, לא על ציון בבנצ'מרק. אם ההשקה תיפתח בציון, טעיתי.

הצטרפו לערוץ בטלגרם
→ כל הכתבות