1. 负责公司区块链节点基础设施的部署、运维、监控及故障处理。
2. 负责主流公链节点的搭建、升级、同步、数据维护及性能优化,包括但不限于:
EVM:Ethereum 、BSC 、Arbitrum 、Optimism 、Base 、Polygon 、Avalanche 等
UTXO:BTC 、BCH 、LTC 、DOGE 、DASH 、RVN 、DCR 、ZEC 等
其他公链:Solana 、Sui 、TON 、XRP 、Cardano 、Monero 等
3. 负责区块链节点 RPC 服务的部署、维护和性能优化,包括 JSON-RPC 、WebSocket 、gRPC 等。
4. 负责节点数据同步、区块追赶、数据库维护、Snapshot/State 数据恢复及节点异常恢复。
5. 负责节点磁盘、CPU 、内存、网络、IOPS 、吞吐量等基础设施资源的监控和容量规划。
6. 负责处理节点常见异常,包括但不限于:
Block Sync / State Sync 异常
区块高度落后
节点长时间 Catching Up
数据库损坏及恢复
State Missing / Rewind
Chain Reorg
RPC 超时及请求异常
P2P 连接异常
磁盘 IO / 文件系统异常
7. 负责节点版本升级、配置变更、数据迁移以及升级后的稳定性验证。
8. 建立和维护节点监控体系,使用 Prometheus 、Grafana 、ELK/Loki 等工具进行指标及日志监控。
9. 参与区块链基础设施自动化建设,提高节点部署、升级、扩容和故障恢复效率。
10. 配合研发、产品及业务团队处理链上数据、RPC 服务及节点相关问题。
11. 编写和维护节点运维文档、故障处理 SOP 、监控告警规则及自动化脚本。
---
systemd、journalctl、top、htop、iostat、vmstat、pidstat、lsof、ss、tcpdump 等工具。---
具备以下经验者优先:
---
我们希望你不仅能够:
“把节点跑起来”
还能够做到:
“节点为什么异常、异常发生在哪里、如何恢复、如何避免再次发生”
需要具备从 区块链客户端 → 数据库 → Linux → 磁盘 IO → 网络 → 云基础设施 → 监控系统 逐层定位问题的能力。
邮箱: Ym9iYnljaGVuMTk5MkBwcm90b25tYWlsLmNvbQ==