区块链节点运维工程师

未知

区块链节点运维工程师

一、岗位职责

1. 负责公司区块链节点基础设施的部署、运维、监控及故障处理。
2. 负责主流公链节点的搭建、升级、同步、数据维护及性能优化,包括但不限于:

  • EVM:Ethereum 、BSC 、Arbitrum 、Optimism 、Base 、Polygon 、Avalanche 等

  • UTXO:BTC 、BCH 、LTC 、DOGE 、DASH 、RVN 、DCR 、ZEC 等

  • 其他公链:Solana 、Sui 、TON 、XRP 、Cardano 、Monero 等
    3. 负责区块链节点 RPC 服务的部署、维护和性能优化,包括 JSON-RPC 、WebSocket 、gRPC 等。
    4. 负责节点数据同步、区块追赶、数据库维护、Snapshot/State 数据恢复及节点异常恢复。
    5. 负责节点磁盘、CPU 、内存、网络、IOPS 、吞吐量等基础设施资源的监控和容量规划。
    6. 负责处理节点常见异常,包括但不限于:

  • Block Sync / State Sync 异常

  • 区块高度落后

  • 节点长时间 Catching Up

  • 数据库损坏及恢复

  • State Missing / Rewind

  • Chain Reorg

  • RPC 超时及请求异常

  • P2P 连接异常

  • 磁盘 IO / 文件系统异常
    7. 负责节点版本升级、配置变更、数据迁移以及升级后的稳定性验证。
    8. 建立和维护节点监控体系,使用 Prometheus 、Grafana 、ELK/Loki 等工具进行指标及日志监控。
    9. 参与区块链基础设施自动化建设,提高节点部署、升级、扩容和故障恢复效率。
    10. 配合研发、产品及业务团队处理链上数据、RPC 服务及节点相关问题。
    11. 编写和维护节点运维文档、故障处理 SOP 、监控告警规则及自动化脚本。

---

二、任职要求

1. 区块链基础

  • 熟悉区块链基本原理,理解 Block 、Transaction 、State 、Mempool 、Consensus 、P2P 、RPC 等基本概念。
  • 有实际生产环境节点部署和维护经验。

2. Linux / 运维能力

  • 熟练使用 Linux ,具备较强的系统问题排查能力。
  • 熟悉 systemdjournalctltophtopiostatvmstatpidstatlsofsstcpdump 等工具。
  • 熟悉 Linux CPU 、内存、磁盘 IO 、网络性能分析。
  • 熟悉 NVMe 、SSD 、云盘及 AWS EBS 等存储系统。
  • 能够独立分析磁盘 IOPS 、吞吐量、IO Wait 、IOPS Queue 等性能指标。

3. 云计算及网络

  • 熟悉 AWS 、EC2 、EBS 、VPC 、安全组、负载均衡等基础设施。
  • 熟悉 TCP/IP 、DNS 、防火墙、安全组、NAT 、端口映射等网络知识。
  • 熟悉区块链 P2P 网络及节点端口配置。

5. 监控与自动化

  • 熟悉 Prometheus 、Grafana 等监控体系。
  • 熟悉 Shell / Python / Go 中至少一种脚本或编程语言。
  • 能够编写自动化脚本完成节点部署、监控、重启、数据检查和故障恢复。
  • 有 Ansible 、Docker 、Kubernetes 等自动化运维经验优先。

---

三、加分项

具备以下经验者优先:

  • 交易所、钱包、区块链基础设施或 Web3 公司节点运维经验。
  • 有大规模公链节点集群维护经验。
  • 熟悉多个主流公链的节点运行机制。
  • 有 RPC Gateway 、RPC Load Balance 、节点集群、高可用架构经验。
  • 有节点自动化部署、自动故障转移、自动恢复经验。
  • 熟悉区块链 Reorg 、Rollback 、Fork 、Consensus Upgrade 等问题。
  • 有处理大型节点数据库、Snapshot 、State Pruning 、State Sync 经验。
  • 熟悉 AWS 高性能 EBS 、NVMe 、本地盘等存储方案。
  • 熟悉 Docker / Kubernetes / Terraform / Ansible 等基础设施工具。
  • 有 Go / Rust / C++ 阅读或调试经验,能够分析区块链客户端源码优先。

---

四、岗位核心能力

我们希望你不仅能够:

“把节点跑起来”

还能够做到:

“节点为什么异常、异常发生在哪里、如何恢复、如何避免再次发生”

需要具备从 区块链客户端 → 数据库 → Linux → 磁盘 IO → 网络 → 云基础设施 → 监控系统 逐层定位问题的能力。

邮箱: Ym9iYnljaGVuMTk5MkBwcm90b25tYWlsLmNvbQ==