招聘 [远程] 区块链节点运维工程师

bobby_chen · September 09, 2026 · 36 hits

区块链节点运维工程师

一、岗位职责

  1. 负责公司区块链节点基础设施的部署、运维、监控及故障处理。
  2. 负责主流公链节点的搭建、升级、同步、数据维护及性能优化,包括但不限于:
  • EVM:Ethereum、BSC、Arbitrum、Optimism、Base、Polygon、Avalanche 等
  • UTXO:BTC、BCH、LTC、DOGE、DASH、RVN、DCR、ZEC 等
  • 其他公链:Solana、Sui、TON、XRP、Cardano、Monero 等

    1. 负责区块链节点 RPC 服务的部署、维护和性能优化,包括 JSON-RPC、WebSocket、gRPC 等。
    2. 负责节点数据同步、区块追赶、数据库维护、Snapshot/State 数据恢复及节点异常恢复。
    3. 负责节点磁盘、CPU、内存、网络、IOPS、吞吐量等基础设施资源的监控和容量规划。
    4. 负责处理节点常见异常,包括但不限于:
  • Block Sync / State Sync 异常

  • 区块高度落后

  • 节点长时间 Catching Up

  • 数据库损坏及恢复

  • State Missing / Rewind

  • Chain Reorg

  • RPC 超时及请求异常

  • P2P 连接异常

  • 磁盘 IO / 文件系统异常

    1. 负责节点版本升级、配置变更、数据迁移以及升级后的稳定性验证。
    2. 建立和维护节点监控体系,使用 Prometheus、Grafana、ELK/Loki 等工具进行指标及日志监控。
    3. 参与区块链基础设施自动化建设,提高节点部署、升级、扩容和故障恢复效率。
    4. 配合研发、产品及业务团队处理链上数据、RPC 服务及节点相关问题。
    5. 编写和维护节点运维文档、故障处理 SOP、监控告警规则及自动化脚本。

二、任职要求

1. 区块链基础

  • 熟悉区块链基本原理,理解 Block、Transaction、State、Mempool、Consensus、P2P、RPC 等基本概念。
  • 有实际生产环境节点部署和维护经验。

2. Linux / 运维能力

  • 熟练使用 Linux,具备较强的系统问题排查能力。
  • 熟悉 systemdjournalctltophtopiostatvmstatpidstatlsofsstcpdump 等工具。
  • 熟悉 Linux CPU、内存、磁盘 IO、网络性能分析。
  • 熟悉 NVMe、SSD、云盘及 AWS EBS 等存储系统。
  • 能够独立分析磁盘 IOPS、吞吐量、IO Wait、IOPS Queue 等性能指标。

3. 云计算及网络

  • 熟悉 AWS、EC2、EBS、VPC、安全组、负载均衡等基础设施。
  • 熟悉 TCP/IP、DNS、防火墙、安全组、NAT、端口映射等网络知识。
  • 熟悉区块链 P2P 网络及节点端口配置。

5. 监控与自动化

  • 熟悉 Prometheus、Grafana 等监控体系。
  • 熟悉 Shell / Python / Go 中至少一种脚本或编程语言。
  • 能够编写自动化脚本完成节点部署、监控、重启、数据检查和故障恢复。
  • 有 Ansible、Docker、Kubernetes 等自动化运维经验优先。

三、加分项

具备以下经验者优先:

  • 交易所、钱包、区块链基础设施或 Web3 公司节点运维经验。
  • 有大规模公链节点集群维护经验。
  • 熟悉多个主流公链的节点运行机制。
  • 有 RPC Gateway、RPC Load Balance、节点集群、高可用架构经验。
  • 有节点自动化部署、自动故障转移、自动恢复经验。
  • 熟悉区块链 Reorg、Rollback、Fork、Consensus Upgrade 等问题。
  • 有处理大型节点数据库、Snapshot、State Pruning、State Sync 经验。
  • 熟悉 AWS 高性能 EBS、NVMe、本地盘等存储方案。
  • 熟悉 Docker / Kubernetes / Terraform / Ansible 等基础设施工具。
  • 有 Go / Rust / C++ 阅读或调试经验,能够分析区块链客户端源码优先。

四、岗位核心能力

我们希望你不仅能够:

“把节点跑起来”

还能够做到:

“节点为什么异常、异常发生在哪里、如何恢复、如何避免再次发生”

需要具备从 区块链客户端 → 数据库 → Linux → 磁盘 IO → 网络 → 云基础设施 → 监控系统 逐层定位问题的能力。

例如能够独立处理:

Node Height 落后
       ↓
检查 P2P / CPU / IO / 网络
       ↓
判断 Sync / Catching Up 原因
       ↓
检查数据库 / State / Snapshot
       ↓
定位 State Missing / DB Corruption
       ↓
选择 Recovery / Snapshot / Resync
       ↓
恢复节点
       ↓
验证 RPC / 数据一致性

六、我们提供

  • 有竞争力的薪资及绩效奖金
  • 完善的五险一金/商业保险福利
  • 接触多种主流公链及 Web3 基础设施
  • 大规模节点集群和高性能 RPC 基础设施实践
  • 技术氛围开放,鼓励自动化和工程化建设
  • 丰富的区块链底层及基础设施技术实践机会

邮箱:Ym9iYnljaGVuMTk5MkBwcm90b25tYWlsLmNvbQ==

No Reply at the moment.
You need to Sign in before reply, if you don't have an account, please Sign up first.