[קישור לקובץ mp3]פרק מספר 464 של רברס עם פלטפורמה, שהוקלט ב-3 באוגוסט 2023 - אורי ורן מארחים באולפן בכרכור (עדיין גל-חום, אבל עם קצת רוח) את
גור שץ מחברת
Cato Networks כדי לדבר על המשמעות של לתחזק Infrastructure קריטי - וה-Infrastructure ש-
Cato מתחזקים הוא לחלוטין קריטי ללקוחות שלהם: מה המשמעות? איך עושים את זה? מה קורה כשיש תקלות? איך מגיבים אליהן? איך מפתחים DNA בחברה כך שתדע לטפל ב-Infrastructure קריטי ונושאים אחרים.הנושא עצמו קרוב לליבם של רן ושל אורי, אז אזהרת תוכן מראש על התערבויות באמצע : - )
01:24 גור ו-
Cato(רן) אז קודם כל
גור - ברוך הבא, כמה מילים עליך ועל
Cato?
- טוב, אז אני הסתובבתי בשטח ככה, 20 משהו שנים בערך - אבל לפני 12-13 שנים בערך גיליתי את עולם ה-Service-ים.
- ואז התגלגלתי לעולם ה-Service-ה-Mission-Critical - כש-Incapsula הייתה החברה שהקמתי שעסקה בזה
- היא עשתה הגנה על אתרים - בהתחלה הגנה על התקפות רגילות, על אתרים מההתקפות רגילות,
- ואחר כך התקפות DDoS
- זו הייתה חברה שעסקה באמת בהגנה על אתרים ושמירה עליהם
- ואחרי Incapsula בעצם, הדבר הבא היה Cato.
- ו-Cato בעצם לוקחת את הרשת הארגונית - ובונה אותה מחדש, בענן.
- כלומר, ארגון שיש לו כמה Location-ים וכן הלאה - בעצם כולם מחוברים ל-Cato, ו-Cato הופך להיות הרשת.
- וזה Mission-Critical Infrastructure - בעצם, מה שזה אומר זה שאם יש בעיה ב-Cato, אז הלקוחות - אין להם אינטרנט, אין להם מייל, אין להם SAP . . .
- אין להם שום דבר שהם מסוגלים לעבוד איתו - זו ההגדרה של Mission-Critical וזה בעצם התחום הזה.
- כלומר, בסופו של דבר, זו החוכמה.
- אני לא יודע מאיזו שנה אתם נמצאים בעולם ה-Service-ים - אבל העולם הזה שבו כולם נמצאים אצלך כל הזמן ואתה צריך בעצם לדאוג להם, זו מנטליות מאוד מאוד הפוכה לעולם ה-Enterprise Applications שהתחלתי ממנו, נכון?
(רן) שאלה טובה . . . . מאיזו שנה אני נמצא שם? אני לא יודע . . . . מתישהו משנות ה-2000+ , אני מניח . . .
03:18 הקו האדום של הכנרת(רן) אחד הדברים המעניינים שאני חושב שכדאי להתחיל בהם את השיחה - אני זוכר שקראתי, יש ספר מאוד טוב שנקרא
SRE Book של גוגל, שבו הם מדברים על איך מייצרים Infrastructure, איך מתחזקים Infrastructure, ואחד הפרקים שם מדבר על מה זה “Uptime”, אוקיי? זאת אומרת, Service - זה לא שהוא רק “למעלה” או “למטה”, אלא יש גם אחוזים, זאת אומרת: “כמה אחוזים למעלה?”, “כמה אחוזים למטה?”. זאת אומרת, אתה תיארת מצב שבו אתם ה-Infrastructure, אתם הרשת, ה-Network של הארגון, ואם אתם “למטה”, אז גם הארגון “למטה” - הוא לא יכול לעבוד, אבל האם זה . . .(אורי) . . . הלקוח למטה . . .(רן) כן, הלקוח למטה . . . האם זה בינארי? כלומר, האם זה “למעלה” או “למטה” או שיש אחוזים, יש זה . . . . מתי, בעצם, אנחנו מתחילים לדבר על “אוקיי - ירדנו מתחת לקו האדום של הכנרת”,
אם מישהו זוכר את זה . . . . ?
- (גור) אז קודם כל, ברגע שאתה מתעסק באמת ב-Critical-Infrastructure, אז אתה מהר מאוד מגיע ל”חמש תשיעיות”, שזה ה-Common Denominator של Critical-Infrastructure
- אתה לא יכול לרדת מתחת לזה
- אבל גם אם לא ירדת . . .
(אורי) . . . . ולמאזיננו שלא חיים את עולם ה-Infrastructure? . . .
- (גור) - 99.999% מהזמן אתה צריך להיות למעלה
(רן) חמש פעמים תשע . . . . מה המשמעות של זה? נגיד - כמה בשנה? . . . כמה? מה? . . .
(רן) דקות [ספורות] בחודש . . .
- (גור) . . . . מועטות . . . לדעתי אפילו פחות מזה.
- אבל זה גם לא . . . . זה לא כזה נתון נכון כשאתה מסתכל עליו - כי בסופו של דבר, הבעיה שלך זה שכשאתה סופר את ה-Uptime, אז זה שאתה צריך לספור את ה-Uptime מהנקודה הכי גרועה.
- כלומר, תחשוב נגיד, אם יש לך חברה, ובחברה - יש לה עשרה משרדים.
- ועכשיו, אחד המשרדים - יש לו בעיה.
- עדיין, אותם אנשים באותו המשרד - יש להם בעיה חמורה, הם לא מאושרים, הם לא יכולים לעבוד.
- ולכן, הדרך הנכונה אצלנו למדוד את ה-Uptime זה Uptime אפליקטיבי (Application uptime)
- כלומר, האפליקציות עובדות - ועל פני כל האתרים של הלקוח.
- ולא רק באופן כללי - בממוצע ובסך הכל.
(רן) כן, אז זה למשל, הבדל בין הדרך שאתם מודדים לבין הדרך שבא תיארו
בגוגל בספר הזה שלהם איך מודדים - למשל, הם באו ואמרו “אוקיי, נגיד אם יש Downtime בגרמניה, יש שם נגיד X לקוחות, נגיד 90 מיליון לקוחות, מכלל אוכלוסיית הלקוחות של גוגל בעולם, זה אולי 10% - אז יש לנו עשרה אחוז Downtime”, נניח, משהו כזה.זאת אומרת, אצלכם לא? זה “OR”, זאת אומרת, מספיק שב-Branch של הלקוח יש Down