רברס עם פלטפורמה
רברס עם פלטפורמה
Ran Tavory && Ori Lahav
433 Breaking Down Observability with Nitay Milner
1 seconds Posted Feb 8, 2022 at 9:22 am.
0:00
0:01
Download MP3
Show notes
[קישור לקובץ mp3] פודקאסט מספר 433 של רברס עם פלטפורמה - התאריך היום הוא ה 1 בפברואר 2022 והיום אנחנו מתכבדים לארח את ניתאי מילנר, שמגיע אלינו מחברת Epsagon כדי לדבר על Observability ומה זה אומר בכלל.(רן) אז ניתאי, לפני שנצלול פנימה - ספר לנו קצת על עצמך וקצת על Epsagon, או על הגלגול הנוכחי של החברה:(ניתאי) אז קודם כל, אנחנו Epsagon - ואני Product Lead ב-Epsagonהייתי בעצם ה-Core Product Manager הראשון בחברהאני מגיע מעולמות היזמות וה-Product Management - בעיקר בסטארטאפים, פחות יצא לי להתנסות ב-Enterprises.שזה Spoiler להמשך . . . .ואנחנו Epsagon - אנחנו בעצם APM מודרני - כש-APM זה Application Performance Monitoring Toolזה מה שמאפשר למפתחים לנטר את הסביבות שלהםואנחנו בעצם APM שהוא Cloud-Native - אנחנו עוזרים למפתחים לפתור בעיות בעולמות שהם מאוד Native לסביבות ה-Cloud וה-microServices.וממש לפני חצי שנה נמכרנו ל-Cisco בערך בחצי מיליארד דולר - היה  אקזיט מאוד משמעותי - והיום אנחנו מפתחים מוצר חדש, מאוד גדול ומשמעותי באותם עולמות, אבל תחת המטריה  של Cisco.(רן) Cisco - שעד היום, לפחות למיטב ידיעתי, היו יותר באיזור של ה-Networking, של דברים שהם ככה מאוד Low-level, ובעצם אתם נותנים זוית אחרת לגמרי - זאת אומרת, אתם מתחילים מהאפליקציה כמו שאמרת . . .(אורי)  . . . Cisco עושה גם Server-ים ועושה גם כל מיני  . . . .(רן) כן - אבל לפחות לפי מיטב ידיעתי, אלו דברים שהם, ככה, Low-level, הרבה סוגים של חומרות - ופה אתה [ניתאי] מגיע מלמעלה, מזוית אחרת, מכיוון האפליקציה.(ניתאי) נכון - Cisco מגיעה יותר מעולמות ה-Hardware - זה יכול להיות Switch-ים וכל החומרה של Networking וכו’ועכשיו הם בעצם מנסים לשנות את הגישה ולהכנס מאוד חזק לעולמות האפליקציה ואפשר לראות ש-Cisco עושה השקעות מאוד משמעותיות בעולם הזה - למשל, היא הוציאה הרבה מאוד כסף בקנייה של AppDynamics, שזה גם APM מודרני, בקנה מידה הרבה יותר גדולוגם ThousandEyes, שזה כלי אפליקטיבי לניטור של בעיות רשתיותמשקיעים בדברים פנימיים - כלים כמו Intersight, שעוזר לך לעשות Monitoring על ה-IT שלךואתה רואה ש-Cisco מנסה לשנות את התדמית שלה - ולעשות אולי את מה ש-Microsoft עשתה לפני כמה שנים: להפוך להיות בעצם חברה מודרנית ואולי מהגדולות הבאות.(רן) בסדר, אז בוא נדבר על הנושא שלשמו התכנסנו: Observability - המילה בעלת אלפי האותיות . . . אז אני יודע מה זה Monitoring וגם יש לי Log-ים - למה צריך להמציא לכל זה מילה חדשה? מה זה Observability? מה נשתנה הלילה הזה?(ניתאי) כן, מעניין כמה פעמים אנחנו נגמגם כשנגיד Observability בפודקאסט הזה . . . . אז בוא נתחיל מה-Basics - בוא נשבור את זה מ-Buzzword למונחים שאנחנו מכיריםאת מה זה Monitoring? זה להבין את ה-State של המערכת שלי, כפי שהיא עכשיוזה אומר שאם יש לי איזושהי בעיה במערכת שלי - Error-ים שנזרקים בדרך כלל, ה-Latency לדף האינטרנט שאני מנסה לגשת אליו עולה - ואני צריך לדעת.זה Monitoring - וה-Traditional Monitoring לרוב קורה בעזרת מטריקות (Metrics).כמו שאנחנו מכירים ויש לנו Chart-ים מאוד יפים - ברגע שהוא עולה מעל איזשהו Threshold אנחנו מקבלים איזשהו Alert ואנחנו צריכים לטפל בזה.כש-Observability, לעומת זאת, זו הדרך לדבג (Debug) את הבעיה שה-Monitoring מצא לך - בעצם זה לקבל ויזיביליות (Visibility) לתוך המערכת שלך, כדי - בצורה Ad-hoc-ית - להבין איך היא מתנהגת כרגע ומה ה-Root Causeמה מקור הבעיה? מאיפה זה נובע? למה הוא נובע?ואיך אני מתקן את זה הכי מהר שאפשר.(רן) אמרת פה הרבה דברים . . . . אז נניח שיש לי End-Point, איזושהי HTTP End-Point, ופתאום היא יותר איטית.איך Observability יכול לעשות את הקסם הזה של לדבג - מה, אתה שם Breakpoint ויש לך Debugger?(ניתאי) מצויין . . . אז בעצם, Observability יתן לך להבין איזה Down-stream Service של אותו שרת HTTP . . . כי כמו שאמרנו, רוב המערכות שאנחנו מכירים היום הן מערכות מבוזרות, וזו הנקודה של למה Observability זה חשוב בעולמות המודרנייםאז אני צריך להבין איזה Down-stream Service של אותו HTTP End-Point גורם לבעיה - בוא נגיד שזה איזשהו  User שעשה Checkout.אז ה-Checkout הזה זה ה-HTTP Service הראשון שהוא פוגש - אבל אחרי זה הוא מתפצל ומנסה לדבר עם עוד חמישה Service-ים אחרים, ויכול להיות שהם מדברים עם עוד חמישה אחרים . . . .(רן) אז אתה אומר  . . . .(אורי) . . . . ו…