Vận hành, giám sát và tối ưu hạ tầng mạng
phục vụ hệ thống multi-cluster (Kubernetes, cloud FCI/AWS) và các Business Unit của công ty. Đảm bảo tính sẵn sàng, bảo mật và hiệu năng kết nối giữa các thành phần hạ tầng, datacenter/cloud và điểm bán (cửa hàng).
* Trách nhiệm chính:
Thiết kế, triển khai, vận hành hệ thống mạng: routing, switching, firewall, VPN, load balancer (LB/ALB/Nginx), DNS
Giám sát, phát hiện và xử lý sự cố network (latency, packet loss, kết nối gián đoạn giữa cluster/site)
Quản lý whitelist/firewall rule cho các API, ứng dụng nội bộ và đối tác
Làm việc với đội hạ tầng cloud (FCI/AWS) để cấu hình network trên VPC, security group, peering, transit gateway
Đảm bảo an toàn thông tin ở lớp network: segmentation, access control, giám sát traffic bất thường
Phối hợp với team platform/DevOps khi sự cố liên quan tới network ảnh hưởng tới microservices hoặc database connectivity
Viết tài liệu vận hành (runbook), quy trình xử lý sự cố network
Yêu cầu bắt buộc:
Kinh nghiệm 2-5 năm quản trị hệ thống mạng doanh nghiệp
Vững kiến thức TCP/IP, routing protocol (BGP/OSPF), VLAN, firewall, VPN
Kinh nghiệm với thiết bị mạng thực tế (Cisco/Juniper/Fortinet hoặc tương đương) và/hoặc network trên cloud (AWS VPC, security group)
Kinh nghiệm xử lý sự cố mạng trong môi trường production, có khả năng làm việc dưới áp lực (on-call)
Hiểu biết cơ bản về Linux administration
Điểm cộng:
Kinh nghiệm
quản trị server/system (Linux/Windows Server): patching, hardening, capacity planning
Kiến thức Kubernetes networking (CNI, ingress, service mesh)
Kinh nghiệm với IaC (Terraform) để quản lý hạ tầng network
Hiểu biết cơ bản về database (connectivity, port, replication traffic) để hỗ trợ troubleshoot khi sự cố network ảnh hưởng DB
Chứng chỉ CCNA/CCNP, AWS Networking Specialty, hoặc tương đương
Kỹ năng mềm:
Tư duy hệ thống, khả năng phân tích root cause
Giao tiếp rõ ràng khi phối hợp liên team (platform, DBA, security)
Chủ động, chịu trách nhiệm khi xử lý sự cố production