后端开发工程师
烟台贵凯人力资源有限公司
高级 Go 后端工程师 / 后端架构师
20-35k
岗位职责
负责核心后端系统的架构设计、技术方案设计及落地,参与高并发、高可用、分布式系统的建设与持续优化。
负责大型业务系统的服务架构设计,包括服务拆分、流量治理、负载均衡、容灾、高可用、数据一致性及性能优化等。
负责设计和建设 CDN + 应用层 + Redis 等多级缓存体系,解决热点数据、高并发访问、缓存穿透、缓存击穿、缓存雪崩、缓存一致性及大规模流量场景下的性能问题。
参与大型企业级 统一入口 / 统一接入体系建设,包括 API Gateway、统一域名入口、流量调度、服务发现、健康检查、限流、熔断、故障切换等,并建设相应的监控及管理面板。
负责生产环境完整的 监控、可观测性及故障定位体系建设,能够从基础设施、网络、网关、应用、数据库、缓存到业务指标建立完整的监控体系。
基于 OpenTelemetry 建立统一的 Metrics、Logs、Traces 可观测性体系,实现跨服务的全链路追踪,并通过 TraceID、日志、指标、调用链等信息快速定位生产环境问题。
建立生产环境故障快速定位和分析机制,能够针对 CPU、内存、网络、连接池、GC、线程/Goroutine、QPS、错误率、P99 延迟、缓存命中率、数据库慢查询、消息堆积等问题进行快速分析和定位。
参与大数据及实时数据处理相关系统建设,负责海量日志、用户行为、订单、风控事件等数据的采集、处理、分析及查询架构设计。
参与或负责基于 Flink 的实时计算、实时风控、实时指标及事件处理系统建设,理解 State、Checkpoint、Watermark、Window、Exactly-Once 等核心机制。
参与 Doris / Elasticsearch / ClickHouse 等大数据及分析系统的建设、性能优化和生产环境运维,解决海量数据写入、查询、索引、分片、数据生命周期及集群扩展等问题。
参与大型日志平台、风控系统、数据分析平台或实时监控平台建设,能够针对海量数据场景进行系统容量规划、性能优化及故障排查。
积极使用 AI 提升研发效率,包括 AI Coding、代码分析、问题排查、技术方案设计、测试生成、日志分析等场景。
任职要求
核心要求
5 年以上后端开发经验,3 年以上 Go 开发经验,具备扎实的 Go 语言基础,熟悉 Goroutine、Channel、Context、网络编程及 Go 服务性能优化。
具备较强的 系统架构设计能力,有实际负责大型分布式系统、高并发系统或核心业务系统架构设计和落地经验。
有丰富的 CDN + 应用缓存 + Redis 多级缓存架构经验,理解缓存一致性、热点数据、缓存穿透/击穿/雪崩等问题。
有大型企业 统一入口 / 统一接入平台建设经验,熟悉 API Gateway、流量治理、限流、熔断、服务发现、健康检查、故障切换等。
有完整的 生产环境监控和可观测性体系建设经验,能够从 0 到 1 设计和建设一套覆盖基础设施、网络、网关、应用、数据库、中间件及业务指标的监控体系。
具备较强的 线上问题快速定位能力,能够通过 Metrics、Logs、Traces、调用链、系统指标及业务指标,快速判断问题所在层级,并建立从“发现问题 → 告警 → 定位 → 分析 → 处理 → 复盘”的完整闭环。
有 OpenTelemetry 或同类可观测性体系的实际使用经验,理解 Metrics、Logs、Traces、TraceID、Span、Context Propagation 等概念。
具备较好的 大数据系统经验,有海量日志、实时数据、用户行为分析、风控、监控或数据分析平台的实际项目经验。
对以下技术有实际生产环境使用经验:
Flink
Doris
Elasticsearch
ClickHouse
不要求每项都达到专家级,但至少有其中 1~2 项较深入的生产实践,并理解其核心原理、数据模型、性能特点及适用场景。
有 大规模日志系统 / 实时风控系统 / 实时监控系统 / 数据分析平台中的一种或多种实际建设经验。
具备一定的 AI 工具使用经验,能够使用 AI 辅助编码、代码阅读、问题排查、技术方案设计、测试及日常研发工作。
加分项
有百万级、千万级甚至更大规模请求量或数据量的系统建设经验。
有大型互联网、金融、电商、支付、广告、内容平台等高并发业务经验。
熟悉 Kafka、Pulsar 等消息队列的大规模生产实践。
熟悉 Kubernetes、Docker、云原生及微服务体系。
熟悉 Prometheus、Grafana、Loki、Tempo、Jaeger 等监控及可观测性组件。
熟悉 MySQL / PostgreSQL,并具备数据库性能优化经验。
有 Iceberg、数据湖、实时数仓等相关经验。
有大型风控规则引擎、实时决策引擎或事件驱动系统建设经验。
有大型企业基础设施平台、统一接入平台、监控平台或内部 PaaS 平台建设经验。
有 AI Agent、RAG、MCP、AI Coding 或其他 AI 工程实践经验。
岗位核心能力
我们更看重 真实的大规模系统建设和线上问题处理经验,而不是简单的技术栈罗列。
理想候选人应该能够独立完成:
架构设计 → 系统开发 → 性能优化 → 监控建设 → 线上故障定位 → 系统稳定性优化
并且具备以下完整技术视野:
用户请求
↓
CDN / DNS / 统一入口
↓
Gateway / 流量治理
↓
Go 应用集群
↓
本地缓存 / Redis 多级缓存
↓
MySQL / PostgreSQL
同时具备:
OpenTelemetry
→ Metrics / Logs / Traces
→ 统一监控平台
→ 告警
→ 链路追踪
→ 故障快速定位
以及:
Kafka → Flink → Doris / ClickHouse / Elasticsearch
→ 实时计算 / 日志分析 / 风控 / 数据分析
能够从 架构、性能、稳定性、可观测性及数据处理多个维度解决复杂生产环境问题。