网站访问变慢、服务器负载升高时,通常要先检查CPU、内存、磁盘和网络。如果管理着多台服务器,逐台登录查看会比较费时间,也容易错过短暂出现的异常。
Netdata可以持续采集服务器运行指标,通过图表查看资源变化,并在达到设定条件时发送告警。安装在不同服务器上的Agent,还可以接入Netdata Cloud,在同一个页面集中查看。
下面以Linux服务器为例,介绍Netdata的安装、访问保护、云端接入和通知配置。RackNerd KVM VPS提供完整root权限,可以自行安装Netdata,适合用来监控网站和应用的运行情况。
本教程使用的是Linux安装流程。如果选择RackNerd Windows VPS,则不能直接套用上述命令。
查看方案:RackNerd VPS官网
RackNerd美国KVM VPS新一轮促销方案(限量销售,售完即止):
| 方案 | CPU | 内存 | SSD存储 | 月流量 | 端口 | 价格 | 购买链接 |
| 1GB KVM VPS | 1核 | 1GB | 20GB SSD | 3TB | 1Gbps | $21.99/年 | 点击购买 |
| 2GB KVM VPS | 2核 | 2GB | 35GB SSD | 5TB | 1Gbps | $35.99/年 | 点击购买 |
| 4GB KVM VPS | 3核 | 4GB | 60GB SSD | 7TB | 1Gbps | $59.99/年 | 点击购买 |
| 6GB KVM VPS | 6核 | 6GB | 100GB SSD | 12TB | 1Gbps | $89.99/年 | 点击购买 |
| 8GB KVM VPS | 7核 | 8GB | 150GB SSD | 20TB | 1Gbps | $119.99/年 | 点击购买 |
一、Netdata能监控哪些内容
Netdata可以查看CPU、内存、磁盘、网络等系统指标,也可以通过采集器监控数据库、Web服务器等应用。
常用功能包括:
- 查看服务器资源的实时变化;
- 通过图表回看异常发生前后的情况;
- 自动发现部分服务并采集指标;
- 设置告警条件及通知渠道;
- 接入Netdata Cloud,集中查看多台服务器。
以下步骤适用于使用systemd管理服务的Linux服务器,需要root或sudo权限。操作前,建议先备份重要数据,并确认服务器有足够的可用空间。
1、下载安装脚本连接服务器,下载Netdata安装脚本。
curl -fsSL https://get.netdata.cloud/kickstart.sh -o /tmp/netdata-kickstart.sh
可以先查看脚本内容,确认后再执行。
less /tmp/netdata-kickstart.sh
使用稳定版通道安装。
sudo sh /tmp/netdata-kickstart.sh --release-channel stable
如果已经使用root账号登录,可以省略sudo。安装程序会识别系统环境,并尝试使用合适的软件包完成安装。
2、检查服务状态安装完成后,执行以下命令。
sudo systemctl status netdata --no-pager
如果显示active (running),说明服务正在运行。若启动失败,可以查看日志。
sudo journalctl -u netdata -n 100 --no-pager
Netdata的Web服务默认使用19999端口。先完成下一节的访问限制,再通过浏览器访问面板。
http://你的服务器IP:19999
不要为了打开页面,直接将19999端口向所有公网地址放行。
三、保护Netdata监控面板监控面板会展示服务器和应用运行信息,应限制访问范围。可以按使用方式选择IP限制或HTTPS反向代理。
方式一,仅允许管理IP访问原生软件包安装的配置文件通常位于以下位置,其他安装方式的目录可能不同。
sudo nano /etc/netdata/netdata.conf
找到已有的[web]部分,修改允许连接的地址;没有该部分时再添加。
[web]
allow connections from = localhost 203.0.113.10
将203.0.113.10替换为自己的管理公网IP,不要照搬示例地址。如果办公网络的公网IP发生变化,也需要相应更新配置。
保存后重启Netdata。
sudo systemctl restart netdata
同时检查云防火墙和系统防火墙,只允许管理IP访问19999端口。如果此前存在向所有地址开放该端口的规则,需要一并调整。
方式二,使用HTTPS反向代理需要通过域名长期访问时,可以使用Nginx或Apache进行反向代理,并配置HTTPS和身份认证。
这种情况下,可以让Netdata只监听本机地址。
[web]
bind to = 127.0.0.1
重启后,由反向代理转发访问请求。配置完成前,浏览器将无法继续通过服务器公网IP直接访问19999端口。
仅配置请求转发并不能完成访问保护,HTTPS和身份认证也需要设置。
四、接入Netdata Cloud集中监控安装本地Agent后,可以将服务器接入Netdata Cloud,在统一页面查看多个节点。
1、登录云端控制台在浏览器中打开以下地址。
https://app.netdata.cloud
注册或登录账号后,进入自己的Space,找到添加节点入口,选择对应的服务器环境。
Netdata Cloud提供不同套餐,节点数量、团队功能和使用条件应以账号页面显示为准,不要默认所有功能都能无限免费使用。
2、连接服务器云端页面会提供节点接入说明或命令,按当前页面操作即可。已经安装Agent的服务器,也可以从本地面板的连接入口完成接入。
如果命令中包含Claim Token,请妥善保管,不要放进公开截图、文章或代码仓库。
3、添加其他节点在其他Linux服务器上重复安装和连接操作,将节点加入同一个Space。
接入完成后,就可以从云端查看各台服务器,再进入具体节点检查CPU、内存、磁盘和网络指标。这里实现的是集中查看,不等于已经配置了自建Parent节点的数据汇聚。
五、配置告警与通知Netdata内置了多种告警规则。刚开始使用时,可以先观察已有告警,再根据服务器用途调整阈值,避免一次添加过多规则,导致通知过于频繁。
1、调整告警规则本地告警配置通常位于Netdata配置目录下的health.d目录。先查看现有文件。
sudo ls /etc/netdata/health.d/
找到需要修改的具体配置后再编辑。自定义规则也可以放入单独的配置文件中,但需要按照Netdata告警语法编写,并对应实际采集到的指标。
修改完成后,可以重启服务,并检查日志和面板中的告警状态。
sudo systemctl restart netdata sudo journalctl -u netdata -n 50 --no-pager
不要只看服务是否启动,还要确认规则是否加载成功。
2、设置通知渠道本地Agent的通知配置文件通常为:
sudo nano /etc/netdata/health_alarm_notify.conf
根据需要设置邮件、Slack等渠道,填写对应接收地址、Webhook或其他凭据。不同渠道的配置项目不同,按文件中的说明逐项填写。
设置后应执行对应渠道的通知测试,确认消息能够送达。能在面板看到告警,并不代表邮件或聊天工具已经收到通知。
相关阅读:《12个热门VPS服务器监控工具分享》
(本文由美国主机侦探原创,转载请注明出处“美国主机侦探”和原文地址!)
微信扫码加好友进群
主机优惠码及时掌握
QQ群号:938255063
主机优惠发布与交流




