Help us improve your experience.

Let us know what you think.

Do you have time for a two-minute survey?

 
이 페이지의 내용
 

WAN SLE

WAN 서비스 수준 경험(SLE)을 사용하여 WAN 에지 상태, WAN 링크 상태 및 애플리케이션 상태와 같은 사용자에게 영향을 미치는 WAN 요소를 평가합니다.

개요

WAN SLE 대시보드 찾기

WAN SLE 대시보드를 찾으려면 왼쪽 메뉴에서 > 서비스 수준 모니터링을 선택한 다음 WAN 버튼을 클릭합니다.

WAN Button on the Monitor Page

참고:

버튼은 필요한 구독이 있는 경우에만 나타납니다. 요구 사항을 참조하세요.

SLE 필터 버튼

  • 왼쪽의 버튼을 사용하여 성공률 또는 값을 표시합니다.

  • 사용자 지정 앱 표시 토글을 사용하여 사용자 지정 애플리케이션을 표시하거나 숨깁니다.

    아래 예에서 버튼은 끄기 위치에 있으므로 모든 응용 프로그램이 포함됩니다. 버튼을 짐 위치로 드래그하면 사용자 지정 애플리케이션만 표시됩니다.

  • 오른쪽의 설정 버튼을 사용하여 서비스 메트릭을 사용자 지정합니다. 서비스 수준 사용자 정의 팝업 창에서 다음을 수행합니다.

    • 요구 사항에 따라 서비스 메트릭(WAN Edge 상태, WAN 링크 상태, 애플리케이션, 애플리케이션 상태WAN Edge 대역폭)을 선택, 선택 취소 및 재정렬할 수 있습니다.

    • 애플리케이션 서비스 메트릭 탭에서 애플리케이션을 선택 및 선택 취소할 수 있으며 SRX 시리즈 방화벽에 대해 최대 10개의 사용자 지정 애플리케이션을 구성할 수 있습니다. 새 응용 프로그램을 추가하려면 먼저 기존 응용 프로그램 중 하나를 선택 취소한 다음 응용 프로그램 추가를 클릭합니다.

비디오: WAN Assurance 개요

Juniper MIST WAN Assurance delivers insights and troubleshooting driven by MIST AI into the WAN, exposing many factors that impact user experience across your distributed enterprise. WAN Assurance complements your SD-WAN deployment and is focused on delivering the best user experience, from client to the cloud. SD-WAN solutions dynamically optimize traffic flows across the WAN based on an SLA policy for your applications.

However, these SLAs are set once at the beginning and don't account for changes over time that impact the WAN, rendering these static SLAs ineffective. In contrast, WAN Assurance is centered around the concept of the user minute, which is represented by Service Level Expectations, or SLE for short. If a user is experiencing a poor Microsoft Teams call, then the user is having bad user minutes.

Let's see what this looks like in a Juniper Cloud instance. From the monitor view, we select WAN, choosing from the time frame over the last seven days, and we see three SLEs for the WAN. The first one is Gateway Health, which accounts for the overall state of the SRX WAN Edge device itself.

We track CPU, memory, temperature, fan, and power, all of which account for the overall device health. WAN Link Health represents the overall state of the WAN connections to the device. It tracks IPsec status, routing, and the WAN interfaces.

Thirdly, there's App Experience, which accounts for factors that impact application performance based on traffic. This SLE tracks latency, jitter, packet loss, and round-trip time. Together, these three SLEs describe how WAN performance is impacting overall user experience.

Let's ask Marvis what's happening with Microsoft Teams. By simply typing, obvious Teams call is bad, Marvis begins a root cause analysis. Marvis first responds by listing five Teams sessions from the past 24 hours.

We select the troublesome session from the list. Marvis quickly responds that the bad Teams experience was due to high latency on the Gateway SRX. Marvis also shows where the issue is in a simplified network diagram.

It displays how Abhi's MacBook is connected wirelessly to an access point, which in turn is connected to an EX access switch, and finally, the traffic is sent to the WAN via the SRX gateway. Marvis visually shows how each of these points in the network are impacting user experience. We see the AP and the gateway devices may be impacting experience.

We click the AP first. There is some non-Wi-Fi interference in the 5GIG band that could be impacting users. Next, we select the gateway device.

We see it has high latency in one of its WAN links due to slow response from the application server. Marvis makes it that easy to determine root cause analysis of issues impacting user experience. By correlating across Wi-Fi, wired, and WAN, we are able to drive a better user experience within our sites, out of our sites, from client to cloud.

비디오: SLE를 사용한 WAN 문제 해결

Looking at our recently deployed Cupertino site, we can see that it is not meeting Service Levels. Clicking into the site, we get a closer look at the SLEs. They are broken down into three important health categories that play a role in user experience: the WAN Edge device health, the health of WAN links and paths, and the health of applications themselves. Each SLE is broken down into a simple unit of measure for the user experience called a User Minute.

Simply put, this is telling us what our user experiences on the WAN are per user, per minute. Behind these seemingly simple measurements are the complex and powerful AI models of the Mist Cloud, fed by rich telemetry from the Session Smart Network. For each SLE, we get a breakdown of the root cause of the issues identified. Whenever user experience is poor on the WAN, Mist not only tells us the root cause, but also tells us what was affected, such as the impacted applications, users, links, paths and devices.

WAN SLE 블록

다음 예에서 볼 수 있듯이 각 SLE 블록은 유용한 정보를 제공합니다.

  • 왼쪽을 보면 이 서비스 수준 경험(SLE)의 성공률이 35%입니다. 필터 단추를 선택하면 대신 숫자가 표시됩니다.

  • 중앙에는 기간에 따른 변동이 타임라인에 표시됩니다. 마우스 포인터를 아무 포인트 위로나 가져가면 정확한 시간과 SLE 결과를 확인할 수 있습니다.

  • 오른쪽에는 각 근본 원인에 기인한 문제의 비율이 분류기가 표시됩니다. 이 예에서는 문제의 100%가 손실에 기인했습니다.

    • 오른쪽의 분류자를 클릭하면 근본 원인 분석 페이지에 자세한 정보가 표시됩니다. 대부분의 분류기에는 정확한 원인에 대한 더 큰 통찰력을 위한 하위 분류기가 있습니다. 근본 원인 분석 페이지에서는 문제의 범위와 영향에 대한 추가 세부 정보도 제공합니다.

      WAN Application Health SLE

참고:

사이트(페이지 상단 중앙)를 선택하면 SLE 블록이 표시됩니다. 그러나 전체 조직을 선택하면 모든 사이트 및 모든 SLE에 대한 개략적인 요약 정보가 표시됩니다.

WAN SLE 및 분류자에 대한 자세한 내용은 다음 표를 참조하십시오.

표 1: WAN SLE 설명
SLE SLE 설명 분류자 분류자 설명
WAN 에지 상태

주니퍼 Mist는 WAN 에지 디바이스의 상태나 성능이 최적이 아닌 경우 사용자 시간(분)을 모니터링합니다. 최적이 아닌 상태는 트래픽을 전달하는 디바이스의 기능을 낮추어 디바이스에 연결된 모든 클라이언트에 직접적인 영향을 미칩니다.

WAN 에지 연결 끊김 주니퍼 Mist 클라우드와의 연결 끊김
시스템

용량 대비 높은 시스템 사용량

하위 분류자:

  • 전력—90% 이상의 전력 소비

  • 메모리 - 80% 이상의 메모리 사용률

  • CPU 데이터 플레인—CPU 데이터 플레인 사용률 90% 이상

  • CPU 컨트롤 플레인—CPU 컨트롤 플레인 사용률 90% 이상

  • Temp Chassis—규정된 임계값 범위를 벗어난 섀시 온도

  • 임시 CPU - 규정된 임계값 범위를 벗어난 CPU 온도

테이블 용량

용량 대비 많은 테이블 항목 수

하위 분류자:

  • FIB—포워딩 정보 베이스(FIB) 테이블 활용도

  • 플로우—세션 플로우 테이블 활용도

DHCP 풀

풀 크기 대비 높은 DHCP 사용률

하위 분류자:

  • DHCP 헤드룸

  • DHCP 거부됨

WAN 링크 상태

주니퍼 Mist는 WAN 링크의 상태가 SLE 임계값을 충족하거나 충족하지 못할 때 사용자 시간(분)을 모니터링합니다. WAN 링크 상태가 좋지 않으면 디바이스의 트래픽 전달 기능이 저하되므로 해당 링크를 사용하는 모든 클라이언트에 직접적인 영향을 미칩니다.

네트워크

네트워크 문제

하위 분류자:

  • 피어 경로 다운—Session Smart 라우터 간의 다운 피어 경로 연결이 네트워크 장애에 기여한 시간의 백분율입니다.

  • 손실—손실된 패킷

  • 지터 - 주니퍼 Mist는 특정 WAN 링크에 대해 5분에서 10분 동안 RTT의 변동(표준 편차)을 사용하여 지터를 계산합니다. 계산된 값을 하루 또는 일주일 동안의 RTT 평균 편차와 비교합니다.

  • 지연 시간 - 주니퍼 Mist는 일정 기간 동안의 트래픽에 대한 RTT(Round-Trip Time)의 평균값을 사용하여 지연 시간을 계산합니다.

인터페이스

실패한 WAN 링크 상태로 인해 인터페이스 문제가 발생한 시간의 백분율입니다.

하위 분류자:

  • 케이블 문제

  • 혼잡—많은 수의 출력 패킷 드롭. 패킷이 인터페이스에 들어가면 버퍼링을 위해 대기열에 들어갑니다. 버퍼가 가득 차면 패킷(TxDrops)을 삭제하기 시작합니다.

  • LTE 신호

  • 포트 다운

  • 협상 불완전(SRX만 해당)

  • VPN

애플리케이션 상태

주니퍼 Mist는 WAN 애플리케이션의 지연 시간을 모니터링하여 최적이 아닌 성능을 발휘하는 애플리케이션을 식별합니다.

이 SLE는 애플리케이션에 액세스할 때 최종 사용자 경험을 이해하는 데 도움이 될 수 있습니다. 예를 들어 네트워크 연결이 약하면 FTP 또는 SMTP 기반 애플리케이션에는 좋은 사용자 경험을 제공하지만 VoIP 애플리케이션에는 좋지 않은 사용자 경험을 제공할 수 있습니다.

성능 메트릭은 디바이스마다 다릅니다.

  • SSR—값은 피어 간의 Session Smart BFD(Bidirectional Forward Detection)에서 나옵니다

  • SRX - RTT에 대한 변동 탐지, 패킷 손실 및 RTT 이상의 지연에서 값이 나옵니다

미세 조정을 위해 블록 위의 설정 버튼을 클릭하여 포함하거나 제외할 개별 애플리케이션을 선택할 수 있습니다.

지터

일관되지 않은 패킷 전송 시간

지연 시간

느린 응답 시간(지연)

손실

패킷 손실

애플리케이션 서비스(SSR만 해당)

애플리케이션 요청에 대한 느린 응답, 반복되는 연결 끊김, 대역폭 부족 등의 문제

하위 분류자:

  • 느린 적용

  • 애플리케이션 대역폭

  • 애플리케이션 연결 끊김

게이트웨이 대역폭

주니퍼 Mist는 SD-WAN을 구성하는 IPsec 오버레이를 평가합니다.

이 SLE를 사용하여 사이트에 더 많은 WAN 대역폭이 필요한지 결정합니다.

대역폭 헤드룸

지난 14일 동안 가장 높은 사용량에 따라 결정되는 기준을 초과하는 현재 사용량입니다.

자동 속도 테스트를 활성화한 경우 이러한 결과는 대역폭 헤드룸 분류자에도 통합됩니다. 이 경우 헤드룸 임계값은 최대 사용량과 속도 테스트 결과(둘 다 가능한 경우)를 기반으로 합니다.

속도 테스트는 조직 설정에 구성된 경우 그리고 WAN 에지 템플릿, 허브 프로필 또는 WAN 에지 디바이스에 대한 WAN 설정에서 사용하도록 설정된 경우 WAN 테스트가 발생합니다.

혼잡 업링크(SRX만 해당) 전송된 총 패킷(TX 패킷)에 대한 총 전송 바이트 손실(TX 드롭)의 비율이 높습니다.