tgindex
צוף בר אור

צוף בר אור

Статистика

ברוכים הבאים לערוץ הטלגרם שלי! צוף, 30, לקראת סיום תואר שני בדאטה סאיינס וקודח מקצועי בטוויטר: https://twitter.com/tsoofbaror אעדכן פה בכל פעם שאעלה משהו משמעותי לטוויטר, או כל דבר מעניין אחר. בתאכלס, יותר מעניין כאן מבטוויטר שלי.

Последний пост
13 авг.
Последнее чтение
13 авг.
Постов за неделю
5
Всего постов
21
Тип
открытый
Язык
he
В каталоге с
13 авг.
Подписчики
3 265
0 за 2 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
1 238
21 постов
Вовлечённость
37,9%
к подписчикам
Постов в день
0,7
всего 21
Упоминаний
0
каналов
Охват размещения
оценка
1/24сутки в ленте
835
1/48двое суток
956
1/72трое суток
1 032

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • видео или голосовое, без подписи

  • 2$/6$ מעניין מאד מאד. גרוק 4.6

  • 11 авг.951161из MathyAIwithMike

    בינה מלאכותית התקרבה לראשונה לאחת משתי השאלות הפתוחות המפורסמות במתמטיקה (השנייה היא P עפ NP). התקרב. לא פתר. הסיפור בקצרה. ב-1859 רימן ניחש ניחוש: לפונקציה מסוימת יש אינסוף נקודות מיוחדות, וכולן לדעתו יושבות על קו ישר אחד. 167 שנה אף אחד לא הצליח להוכיח את זה. הניחוש הזה שווה מיליון דולר. כשלא מצליחים להוכיח "כולן", מוכיחים "לפחות אחוז מסוים מהן". האחוז הזה תקוע שנים על 41.66%. קלוד, גרסת מחקר שעדיין לא שוחררה, הביא אותו ל-67.25%. להשוואה: בני אדם הצליחו להזיז אותו 0.8 נקודות ב-37 שנה. זו קפיצה אמיתית. אבל היא לא "שני שליש מהדרך", ומשתי סיבות: סיבה ראשונה: האחוז מודד אותנו, לא את המתמטיקה. 67% לא אומר ששני שליש מהנקודות על הקו והשאר מחוצה לו. בפועל בדקו כבר 20 טריליון נקודות ואף אחת לא חרגה. כולם משוכנעים שהתשובה היא כל הנקודות. פשוט אין הוכחה. סיבה שנייה: אפילו 100% לא היה מוכיח את הניחוש. נשמע מוזר, אז דוגמה. קחו את כל המספרים, ומתוכם רק את 10, 100, 1000, 10000... יש אינסוף כאלה. ובכל זאת, אם תספרו כמה אחוז הם מכל המספרים, תקבלו כמעט אפס. הם דלילים מדי מכדי להירשם. עכשיו החזרה לענייננו: גם אם נוכיח "100% מהנקודות על הקו", עדיין יכולים להסתובב שם אינסוף חריגים. פשוט דלילים מדי מכדי להוריד את האחוז. לכן הפער בין 67% למיליון דולר הוא לא 33 נקודות אחוז. זו שאלה אחרת לגמרי. אנטרופיק אומרים את זה בעצמם: הם לא מצפים שהשיטה תגיע להוכחה. ומה כן קרה כאן, בעיניי: קלוד לא המציא מתמטיקה. הוא לקח מאמר מ-2000 וחיבר אותו לעבודה עדכנית של ארבעה חוקרים. מישהו כבר הגיע ל-67% קודם אבל רק בהנחה נוספת. כאן ההנחה ירדה. שני החלקים ישבו על המדף שנים, בשני חדרים שונים, ואף אחד לא הכניס אותם לאותו חדר. כלומר: מה שחסר לא היה גאונות. מה שחסר היה מישהו שקרא הכל. מה עוד לא סגור: אין ביקורת עמיתים רגילה, ואי אפשר לשחזר את הריצה כי המודל לא שוחרר. מצד שני ההוכחה נכתבה בצורה שמחשב יכול לבדוק, ושני מומחים חיצוניים עברו עליה. על התהליך אפשר להתווכח. על ההוכחה עצמה פחות. ולסיום, הפרט האהוב עליי: הניסיון הראשון נכשל אחרי 650 רעיונות. סוף סוף AI שחווה דוקטורט אמיתי.   https://www.anthropic.com/research/riemann-zeta

  • המלצת קריאה

  • 11 авг.1 00636

    (לא ממומן) וובינר לצוותי R&D על subagents & parallel agents יום חמישי, 13 באוגוסט, מבית Latent AI למי הוובינר מיועד? •⁠ ⁠מפתחים וצוותי פיתוח שעובדים עם קלוד (או רוצים לעבוד עם קלוד) •⁠ ⁠למי שמפעיל אייג'נט אחד בכל פעם (ולא כמה במקביל) •⁠ ⁠למי שרוצה לעבוד עם worktrees ולא לשבור את הקודבייס •⁠ ⁠למי שרוצה לעבוד עם סאב-אייג'נטים כדי לשמור על ה-context window הזדמנות מיוחדת לקבל הצצה לקורס המלא של Latent AI לצוותי פיתוח להרשמה ופרטים נוספים >> https://bit.ly/4gmoIIb על המרצה: יונתן ירקוני, מנכ"ל ו-co-founder של Latent AI, לשעבר בצוות ה-AI של גוגל, מפתח וראש צוות

  • 8 авг.1 434173

    אחרי שהיינו במתמטיקה, הסייבר חזר שוב לאופנה. אופןAI שלנו מדווחת עוד ועוד על כמה שהמודל שלהם Astra פיצח את האטום בעולם הסייבר, פורץ, נושך. אם אתם עוקבים אחרי כבר תקופה, אתם בטח יודעים שלחברות יש סוג של ״רמות סיווג״ למודלים, שמעריכים את המסוכנות שלהם במגוון תחומים - נשק כימי וביולוגי, סייבר וכו. אז OAI מגדירים את Astra ברמת ״critical״ בסיווג שלהם. מה זה אומר? יותר אבטחה על המשקולות שלו, יותר כלי ניתור וניהול.. בסדר. אחלה. השאלה המתבקשת היא למה כל הPR הזה. המודל עוד לא שוחרר. בספר של פיטר תיל, Zero to One, הוא כותב: ״מונופולים משקרים כדי להגן על עצמם, מפריזים בכוח של התחרות שלהם שלא באמת קיימת. לא-מונופולים עושים ההפך, אומרים שהם בליגה משלהם״. אני מרגיש, באיזשהו מקום, שחברות הAI חיות בcycle. יום אחד AI זה קומודיטי, הסינים עושים אותו דבר, אין שום יחודיות, כולם אותו דבר. יום אחרי זה - אנחנו מיוחדים, צריך עלינו רגולציה, אנחנו מייצרים מפלצת חסרת מעצורים. אני רגע אתן פה טיעון, שאולי אפשר להתווכח איתו, אבל חשוב שיכתב ונמשיך הלאה. אין ספק שיש פה מפלצת כשהAI הרצחני רק בצד התוקף. בסייבר, כמו בעצם בעולם המלחמה הסטנדרטי, ברגע שיש לצד אחד יתרון יחסי עוצמתי הוא אכן החזק, וככל שעובר הזמן ההגנה משתפרת - ומגיעים לאקוויליבריום. אם הסטנדרט בתקיפה הוא מודלים גאונים שמתקיפים, לא חוכמה להראות שיש פה סכנה לאנושות כשאין בצד השני מודלים גאונים שמגינים. האזהרה על היציאה מאיזון חשובה, אבל כאמור, אני מרגיש שיש כאן בניית נרטיב הרבה יותר מאשר ניסיון להגיד את האמת. יש פה באמת מלכוד: 1. חברות הAI מבינים שהם מפתחות כלים שיש בהם סיכון בטווח הקצר. 2. המשקיעים כבר רוצים לראות רווחים, עבר הרבה זמן, וצריך להיות הכי טובים. 3. הסינים בזנב, רחוקים בעיני 8-10 חודשים (למרות שאני יודע שחלק מכם יגידו פחוות), אבל רודפים. 4. החברות ישמחו לרגולציה שתעכב את המתחרים שלהם ותיתן להן עוד קצת זמן ומרחב נשימה לעבוד, ושתרגיע גם את המשקיעים - שבסדר שדברים לוקחים קצת יותר זמן, יש רגולציה. הבעיה שכל הדברים האלה לא מתכנסים. אי אפשר גם לרוץ קדימה, גם לנסות לרצות את המשקיעים בהצגת יכולות מפחידות בסדר גודל מהסינים (אולי?) ולהגיד ״אנחנו הכי טובים״, גם להגיד ״צריך רגולציה, כי כולם פה אותו דבר וצריך רגע להאט את הקצב״ ובסוף המעגל - לגייס עוד כסף כי צריך עוד דאטה סנטרים. בקיצור, אני מרגיש שיש פה מעגל בלבול רציני מאד בעולם חברות הAI. התחלנו מבליץ סייבר (Mythos), המשכנו לבליץ רגולציה (המכתב של דמיס הסביס, הפוסט של סאטיה ועוד ועוד), המשכנו לבליץ "Open Source ישלוט״ (כתבתי פה לא מזמן, המכתב של ג׳נסן, אלכס קארפ) ועכשיו אנחנו שוב ב״סייבר מפחיד סייבר״. בקיצור, החברות צריכות להחליט - הן מונופול? הן קומודיטי? תלוי ביום בשבוע?

  • 6 авг.1 50531

    Muse Spark 1.2 המודל של Meta. כמובן שיהיה "Muse Code״. מערכת אייג׳נטית: ״Muse Code runs specialized background agents that stay active your whole session, so they build up context over time instead of starting from scratch on every task.״ קיצר, הנה מארק: https://x.com/finkd/status/2085080750034940201/photo/1

  • צוף בר אור pinned «https://x.com/tsoofbaror/status/2085335292400296331 והנה זה קורה: אני מחפש מישהו לעבוד איתי. גיוס ראשון. אם אתם מהתחום ואני נראה לכם מגניב, יש פה הזדמנות. אשמח לשיתופים, תגובות וכל השבאנג שיעזרו לי למצוא את האחד (או האחת).»

  • 6 авг.1 406152

    https://x.com/tsoofbaror/status/2085335292400296331 והנה זה קורה: אני מחפש מישהו לעבוד איתי. גיוס ראשון. אם אתם מהתחום ואני נראה לכם מגניב, יש פה הזדמנות. אשמח לשיתופים, תגובות וכל השבאנג שיעזרו לי למצוא את האחד (או האחת).

  • 6 авг.1 2252

    הממ, רגע משהו על ARC AGI 3 - נראה שהם השיגו תוצאה כזו על הpublic data set, ולא על סט הבחינה הפנימי. יש מצב שזו אזעקת שוא, הרבה כבר הצליחו https://arcprize.org/leaderboard/community

  • 6 авг.1 12991

    שני אירועים חדשותיים לא בלתי-מעניינים: 1. דמיס הסביס מפסיק להיות מנכ״ל דיפמיינד - והופך להיות ה... unit chairman? זה בא ביחד עם העזיבה של ג׳ף דין, המדען הראשי המיתולוגי של גוגל, שהולך להקים חברת AI משלו. הסביס הולך להיות גם הchief scientist של גוגל, ולהמשיך להוביל את Isomorphic Labs - חברת הAI של גוגל שעוסקת בפיתוח תרופות. איזה ג׳וב. 2. חברה בשם Prime Intellect יצרו Harness שלטענתם פותר את ARC-AGI 3, בציון 95%+-. המבחן ARC AGI 3 הוא סוג של מבחן ״משחקים״ שמצריכים תכנון לטווח ארוך (יחסית). הממוצע היום עומד על 10-30 אחוז בקרב המודלים החזקים השונים. למיטב הבנתי זה עוד לא אומת סופית ע״י ARC AGI עצמם.

  • 6 авг.1 1047

    החגיגה של מחירי היצף מסין נגמרת?

  • 5 авг.1 416112

    ובנושא אחר, החבר׳ה של קודקס מדברים על ״שלב חדש באבולוציה של שימוש בAI״ עוד חודשיים שלושה. בטוויטר מדברים על זה שיהיה מעבר מ״קודקס (או קלוד קוד) על המחשב שלי״ ל״קודקס בענן״. רק שכבר יש קודקס בענן. ככה שצריכה להיות פה סוג של פריצת דרך פרודקטית. אולי קודקס יגיע עם סוג של מחשב על הענן על-מלא? זה בעיה. כי מה הם יתנו, לינוקס? ואם אני צריך ווינדוס או מק? בכל מקרה, מסקרן.

  • 5 авг.1 38693

    מודל עסקי מעניין. מציעים פלטפורמה אייג׳נטית ״ללא לימיטים״ - ואיך? בעצם כל סוכן שרץ במקביל, משלמים עליו קבוע כמו על חברת סלולאר. כמו ״קו״. בסוף אפשר לחשב בדיוק כמה טוקנים סוכן שעובד 24.7 לוקח ולתמחר בצורה כלשהי (?) וזה רעיון די חמוד בעיני. מוריד את הלחץ של לראות את הפס יורד - פשוט לשלם ״פר SIM״.

  • 3 авг.1 290761

    אפשר לברך על זה שנגמר ה״תהליך״, אחרי אי אילו עיכובים טפשיים. MSc.

  • 1 авг.1 931351

    כלומר, יש פה מכנה משותף מאד ספציפי לכל הבעיות - בכולן היה צריך למצוא משהו בעזרת שכל, ניסוי, טעיה (חסם, דוגמה נגדית). זה בדיוק בדיוק הדפוס שאני מדבר עליו פה בערך בכל פוסט שלישי. ההשלכות של ההבנה הזו עצומות בעיני. זה ההבדל בין ״זהו, הAI הולך להשתלט על הכל״ לבין ״הAI כרגע מתקדם בנתיב ברור לסוג מסויים של בעיות והולך ומשתפר בהן״. זה ההבדל בין להרגיש שהאפוקליפסה בדרך, לבין להבין שיש פה אוטומציה של תחומים מסויימים מאד באנושות. וכמובן - אני לא יודע מה העתיד, ואני לא יודע מה עוד מסתתר במחשכי חברות הAI, אבל בינתיים כל פרסום מפוצץ מוח כזה, (ושימו לב פותח סוגריים רגע, זה לא ״מפוצץ מוח״ במרכאות. זה באמת מפוצץ מוח, כי זה משוגע שהמודלים עולים על הדברים האלה) מרגיש לי יותר מטעה את הציבור מאשר מסייע להבין לאן הAI הולך.

  • 1 авг.1 84142

    והנה ההסבר. אם נסתכל על ״מה בדיוק הAI מצא בכל אחת מ10 הבעיות״, נראה: 1. חסם עליון חדש 2. חסם עליון חדש 3. דוגמה נגדית 4. דוגמה נגדית 5. חסם תחתון 6. חסם עליון 7. חסם תחתון 8. חסם עליון (סוג של?) 9. חסם תחתון 10. דוגמאות נגדיות

  • 1 авг.1 5612

    קודם כל, תקרית PR נפלאה. סיפור הסייבר הוא סיפור ענק. העובדה שאפשר להריץ את המודלים האלה בגרסה הכי קשוחה שלהם בלי מגבלות, ואשכרה לבקש מהם לתקוף בגדול צריכה לגרום לכל המחוקקים בעולם לא לישון בלילה. סייבר הוא משחק של המון שכל - אבל גם המון זמן ומשאבי בדיקה,…

  • 1 авг.1 52172

    בקצרה, מודל פנימי של OpenAI בשם Astra פתר 10 בעיות פתוחות (או, ״יצר 10 התקדמויות״) בעולם המתמטיקה. כמובן שמעולם לא שמעתי על אף אחת מהבעיות האלה. אחרי קצת קריאה ונבירה, ויתקנו אותי המתמטיקאים שעוקבים פה בערוץ אם אני מדבר שטויות, נראה שהתגליות האלה מתכתבות 1:1 עם כל מה שנכתב כאן בערוץ בתקופה האחרונה.

  • 1 авг.1 4942

    https://openai.com/index/ten-advances-in-mathematics/ אבל זה כנראה הדבר הכי מעניין שקורה כרגע

צוף בר אור — tgindex