האזינו באפליקציית Podli 🎧
עקבו אחרי הפודקאסטים האהובים עליכם, האזינו לא מקוון וברכב עם CarPlay ו-Android Auto, ותמיד המשיכו מאיפה שהפסקתם. אפשר לנסות בחינם.
[קישור לקובץ mp3] פודקאסט מספר 433 של רברס עם פלטפורמה - התאריך היום הוא ה 1 בפברואר 2022 והיום אנחנו מתכבדים לארח את
ניתאי מילנר, שמגיע אלינו מחברת
Epsagon כדי לדבר על Observability ומה זה אומר בכלל.
(רן) אז
ניתאי, לפני שנצלול פנימה - ספר לנו קצת על עצמך וקצת על
Epsagon, או על הגלגול הנוכחי של החברה:
- (ניתאי) אז קודם כל, אנחנו Epsagon - ואני Product Lead ב-Epsagon
- הייתי בעצם ה-Core Product Manager הראשון בחברה
- אני מגיע מעולמות היזמות וה-Product Management - בעיקר בסטארטאפים, פחות יצא לי להתנסות ב-Enterprises.
- שזה Spoiler להמשך . . . .
- ואנחנו Epsagon - אנחנו בעצם APM מודרני - כש-APM זה Application Performance Monitoring Tool
- זה מה שמאפשר למפתחים לנטר את הסביבות שלהם
- ואנחנו בעצם APM שהוא Cloud-Native - אנחנו עוזרים למפתחים לפתור בעיות בעולמות שהם מאוד Native לסביבות ה-Cloud וה-microServices.
- וממש לפני חצי שנה נמכרנו ל-Cisco בערך בחצי מיליארד דולר - היה אקזיט מאוד משמעותי - והיום אנחנו מפתחים מוצר חדש, מאוד גדול ומשמעותי באותם עולמות, אבל תחת המטריה של Cisco.
(רן) Cisco - שעד היום, לפחות למיטב ידיעתי, היו יותר באיזור של ה-Networking, של דברים שהם ככה מאוד Low-level, ובעצם אתם נותנים זוית אחרת לגמרי - זאת אומרת, אתם מתחילים מהאפליקציה כמו שאמרת . . .(אורי) . . . Cisco עושה גם Server-ים ועושה גם כל מיני . . . .(רן) כן - אבל לפחות לפי מיטב ידיעתי, אלו דברים שהם, ככה, Low-level, הרבה סוגים של חומרות - ופה אתה [ניתאי] מגיע מלמעלה, מזוית אחרת, מכיוון האפליקציה.
- (ניתאי) נכון - Cisco מגיעה יותר מעולמות ה-Hardware - זה יכול להיות Switch-ים וכל החומרה של Networking וכו’
- ועכשיו הם בעצם מנסים לשנות את הגישה ולהכנס מאוד חזק לעולמות האפליקציה
- ואתה רואה ש-Cisco מנסה לשנות את התדמית שלה - ולעשות אולי את מה ש-Microsoft עשתה לפני כמה שנים: להפוך להיות בעצם חברה מודרנית ואולי מהגדולות הבאות.
(רן) בסדר, אז בוא נדבר על הנושא שלשמו התכנסנו: Observability - המילה בעלת אלפי האותיות . . . אז אני יודע מה זה Monitoring וגם יש לי Log-ים - למה צריך להמציא לכל זה מילה חדשה? מה זה Observability?
מה נשתנה הלילה הזה?
- (ניתאי) כן, מעניין כמה פעמים אנחנו נגמגם כשנגיד Observability בפודקאסט הזה . . . . אז בוא נתחיל מה-Basics - בוא נשבור את זה מ-Buzzword למונחים שאנחנו מכירים
- את מה זה Monitoring? זה להבין את ה-State של המערכת שלי, כפי שהיא עכשיו
- זה אומר שאם יש לי איזושהי בעיה במערכת שלי - Error-ים שנזרקים בדרך כלל, ה-Latency לדף האינטרנט שאני מנסה לגשת אליו עולה - ואני צריך לדעת.
- זה Monitoring - וה-Traditional Monitoring לרוב קורה בעזרת מטריקות (Metrics).
- כמו שאנחנו מכירים ויש לנו Chart-ים מאוד יפים - ברגע שהוא עולה מעל איזשהו Threshold אנחנו מקבלים איזשהו Alert ואנחנו צריכים לטפל בזה.
- כש-Observability, לעומת זאת, זו הדרך לדבג (Debug) את הבעיה שה-Monitoring מצא לך -
- בעצם זה לקבל ויזיביליות (Visibility) לתוך המערכת שלך, כדי - בצורה Ad-hoc-ית - להבין איך היא מתנהגת כרגע ומה ה-Root Cause
- מה מקור הבעיה? מאיפה זה נובע? למה הוא נובע?
- ואיך אני מתקן את זה הכי מהר שאפשר.
(רן) אמרת פה הרבה דברים . . . . אז נניח שיש לי End-Point, איזושהי HTTP End-Point, ופתאום היא יותר איטית.איך Observability יכול לעשות את הקסם הזה של לדבג - מה, אתה שם Breakpoint ויש לך Debugger?
- (ניתאי) מצויין . . . אז בעצם, Observability יתן לך להבין איזה Down-stream Service של אותו שרת HTTP . . .
- כי כמו שאמרנו, רוב המערכות שאנחנו מכירים היום הן מערכות מבוזרות, וזו הנקודה של למה Observability זה חשוב בעולמות המודרניים
- אז אני צריך להבין איזה Down-stream Service של אותו HTTP End-Point גורם לבעיה - בוא נגיד שזה איזשהו User שעשה Checkout.
- אז ה-Checkout הזה זה ה-HTTP Service הראשון שהוא פוגש - אבל אחרי זה הוא מתפצל ומנסה לדבר עם עוד חמישה Service-ים אחרים, ויכול להיות שהם מדברים עם עוד חמישה אחרים . . . .
(רן) אז אתה אומר . . . .(אורי) . . . . ובסוף כל זה מגיע לאיזשהו Database - שהוא איטי . . . .
- (ניתאי) בדיוק . . . . ואני צריך להבין איפה מקור הבעיה - ולמה היא קוראת עכשיו.
(רן) אז אתה אומר שבעולם ה-Monolith זה היה יותר פשוט - יש End-Point, הכל קורה In-process, ואם יש משהו איטי אז מה זה כבר יכול להי