cephfs-top尝鲜体验

根据ceph 16版本的changelog,16版本提供了cephfs-top文件系统监控工具。刚好手头最近有个16版本的集群,便体验一下。

统计原理

文件系统客户端周期性向元数据服务发送各类监控指标(metrics),这部分数据由元数据服务路由到mds为rank 0的节点 。
元数据服务器(多活部署)同样会将自身的指标数据发送至rank 0节点。并由rank 0汇集之后发送给Ceph mgr服务。

工具的使用者可以看到两类和文件系统相关的数据:
1、全局数据。窥探文件系统整体情况,比如客户端延迟。
2、每个MDS服务的数据。比如每个MDS拥有的子树(但是实际体验没看到)。

MGR的stats插件

ceph-mgr作为管理组件,具有集成插件的能力。stats负责统计插件。使用前开启stats插件

ceph mgr module enable stats

由stats插件提供的文件系统性能统计命令

ceph fs perf stats [<mds_rank>] [<client_id>] [<client_ip>]

(注:方括号代表可选)

不加mds_rank查看到的是整体文件系统监控指标。利用json形式查看。

ceph fs perf stats | python3 -m json.tool

输出如下:

{
    "version": 1,         //stat格式的版本号
    "global_counters": [   //全局的性能统计参数:8个
        "cap_hit",            
        "read_latency",     
        "write_latency",
        "metadata_latency",
        "dentry_lease",
        "opened_files",
        "pinned_icaps",
        "opened_inodes"
    ],
    "counters": [],           //每个mds的性能统计参数 
    "client_metadata": {   //客户端的元数据信息(这里的元数据非文件元数据)
        "client.6459": {
            "IP": "10.101.17.11",
            "hostname": "jtfast01",
            "root": "/",
            "mount_point": "/mnt/cephfs",
            "valid_metrics": [
                "cap_hit",
                "read_latency",
                "write_latency",
                "metadata_latency",
                "dentry_lease",
                "opened_files",
                "pinned_icaps",
                "opened_inodes"
            ]
        }
    },
    "global_metrics": {  //全局的性能统计情况
        "client.6459": [
            [
                0,
                0
            ],
            [
                0,
                31697
            ],
            .....
            [
                0,
                1003
            ]
        ]
    },
    "metrics": {        //每个mds的统计情况
        "delayed_ranks": [],
        "mds.0": {
            "client.6459": []
        },
        "mds.1": {
            "client.6459": []
        }
    }
}

尝试之后发现展示的信息还是不够直观。另外,MDS的统计信息都是空的。

其中属于客户端几个主要的参数:

参数 含义 备注
cap_hit cap命中率 衡量MDS实际分配(客户端保有)和客户端所需的cap之间的差异
read_latency 读读操作总延迟 单位秒
write_latency 写读操作总延迟 单位秒
metadata_latency 元数据操作总延迟 单位秒
dentry_lease 客户端dentry lease有效情况 dentry在该客户端上可用比例
opened_files 打开文件的数量 客户端有打开操作时数量有所变化
pinned_icaps 在该节点pin的caps数量 caps含p标志位
opened_inodes 打开inode数量 一般和opened_files保持一致

几个延迟是总延迟,除以操作量才是平均延迟。

cephfs-top

cephfs-top是类似top的形式,依赖组件是mgr中的stats插件。使用python语言实现,展示主要是客户端的统计情况。

cephfs-top获取数据实现.png

cephfs-top源码中,获取数据实现部分。

部署

创建client.fstop用户,该用户为cephfs-top工具默认使用的用户

ceph auth get-or-create client.fstop mon 'allow r' mds 'allow r' osd 'allow r' mgr 'allow r'

安装cephfs-top工具

yum install cephfs-top

如果出现 “RADOS permission denied”的错误。使用ceph auth get命令获得fstop的keyring至本地ceph默认配置目录。

ceph auth get client.fstop -o /etc/ceph/ceph.client.fstop.keyring

运行监控命令

cephfs-top

选项 -d 可以支持0.5s以上的展示频率。

内容展示

cephfs-top内容显示.png

可展示信息:
1、客户端数量,统计FUSE、内核、libcephfs使用者。
2、客户端id;
3、客户端对应cephfs挂载目录;
4、客户端本地目录,IP地址;
5、chit cap的命中率。
6、rlat 读操作总延迟(单位s)
7、wlat 写操作总延迟(单位s)。
8、mlat 元数据操作总延迟(单位s)。
9、dlease dentry lease即客户端dentry可用率。
10、oicaps 该客户端持有caps的数量。
11、oinodes 该客户端打开文件持有inode的数量。

写在最后

在统计插件stats和cephfs-top出现前,ceph支持到各个组件所在节点通过命令查看性能统计。

ceph daemon /var/run/ceph/<instance>.asok perf dump

比如客户端的延迟只能登陆到各个挂载节点查看。MDS的情况也只能在对应的节点通过ceph daemon方式查看。现在做了部分信息的汇总,对于运维和性能优化工作而言非常方便。

但是,统计的信息覆盖面还比较窄,组件的统计信息细节没有完全展示,如果要查看某个客户端或者MDS的统计信息,还是需要到各个节点上查看。cephfs-top还有可完善的空间。

最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 199,711评论 5 468
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 83,932评论 2 376
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 146,770评论 0 330
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 53,799评论 1 271
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 62,697评论 5 359
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 48,069评论 1 276
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 37,535评论 3 390
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 36,200评论 0 254
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 40,353评论 1 294
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 35,290评论 2 317
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 37,331评论 1 329
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 33,020评论 3 315
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 38,610评论 3 303
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 29,694评论 0 19
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 30,927评论 1 255
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 42,330评论 2 346
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 41,904评论 2 341

推荐阅读更多精彩内容