Skip to content

Commit 02daddd

Browse files
committed
Remove cluster label
Signed-off-by: clyang82 <chuyang@redhat.com>
1 parent bff262d commit 02daddd

4 files changed

Lines changed: 64 additions & 88 deletions

File tree

pkg/cloudevents/generic/metrics_collector.go

Lines changed: 27 additions & 35 deletions
Original file line numberDiff line numberDiff line change
@@ -17,7 +17,6 @@ const (
1717
const (
1818
metricsSourceLabel = "source"
1919
metricsOriginalSourceLabel = "original_source"
20-
metricsClusterLabel = "cluster"
2120
metricsDataTypeLabel = "type"
2221
metricsSubResourceLabel = "subresource"
2322
metricsActionLabel = "action"
@@ -31,7 +30,6 @@ const noneOriginalSource = "none"
3130
// cloudeventsReceivedMetricsLabels - Array of labels added to cloudevents received metrics:
3231
var cloudeventsReceivedMetricsLabels = []string{
3332
metricsSourceLabel, // source
34-
metricsClusterLabel, // cluster
3533
metricsDataTypeLabel, // data type, e.g. manifests, manifestbundles
3634
metricsSubResourceLabel, // subresource, eg, spec or status
3735
metricsActionLabel, // action, eg, create, update, delete, resync_request, resync_response
@@ -41,7 +39,6 @@ var cloudeventsReceivedMetricsLabels = []string{
4139
var cloudeventsSentMetricsLabels = []string{
4240
metricsSourceLabel, // source
4341
metricsOriginalSourceLabel, // original source, if no, set to "none"
44-
metricsClusterLabel, // cluster
4542
metricsDataTypeLabel, // data type, e.g. manifests, manifestbundles
4643
metricsSubResourceLabel, // subresource, eg, spec or status
4744
metricsActionLabel, // action, eg, create, update, delete, resync_request, resync_response
@@ -50,7 +47,6 @@ var cloudeventsSentMetricsLabels = []string{
5047
// cloudeventsResyncMetricsLabels - Array of labels added to cloudevents resync metrics:
5148
var cloudeventsResyncMetricsLabels = []string{
5249
metricsSourceLabel, // source
53-
metricsClusterLabel, // cluster
5450
metricsDataTypeLabel, // data type, e.g. manifests, manifestbundles
5551
}
5652

@@ -77,10 +73,10 @@ const (
7773

7874
// The cloudevents received counter metric is a counter with a base metric name of 'received_total'
7975
// and a help string of 'The total number of received CloudEvents.'
80-
// For example, 2 CloudEvents received from source1 to agent on cluster1 with data type manifests, one for resource create,
81-
// another for resource updatewould result in the following metrics:
82-
// cloudevents_received_total{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",subresource="spec",action="create"} 1
83-
// cloudevents_received_total{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",subresource="spec",action="update"} 1
76+
// For example, 2 CloudEvents received from source1 to agent with data type manifests, one for resource create,
77+
// another for resource update would result in the following metrics:
78+
// cloudevents_received_total{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",subresource="spec",action="create"} 1
79+
// cloudevents_received_total{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",subresource="spec",action="update"} 1
8480
var cloudeventsReceivedCounterMetric = prometheus.NewCounterVec(
8581
prometheus.CounterOpts{
8682
Subsystem: cloudeventsMetricsSubsystem,
@@ -93,9 +89,9 @@ var cloudeventsReceivedCounterMetric = prometheus.NewCounterVec(
9389
// The cloudevents sent counter metric is a counter with a base metric name of 'sent_total'
9490
// and a help string of 'The total number of sent CloudEvents.'
9591
// For example, 1 cloudevent sent from source1 with data type manifestbundles for resource spec create (original source is empty),
96-
// and 2 CloudEvents sent from agent on cluster1 back to source1 for resource status update would result in the following metrics:
97-
// cloudevents_sent_total{source="source1",original_source="none",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",subresource="spec",action="create"} 1
98-
// cloudevents_sent_total{source="cluster1-work-agent",original_source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",subresource="status",action="update"} 2
92+
// and 2 CloudEvents sent from agent back to source1 for resource status update would result in the following metrics:
93+
// cloudevents_sent_total{source="source1",original_source="none",type="io.open-cluster-management.works.v1alpha1.manifestbundles",subresource="spec",action="create"} 1
94+
// cloudevents_sent_total{source="cluster1-work-agent",original_source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",subresource="status",action="update"} 2
9995
var cloudeventsSentCounterMetric = prometheus.NewCounterVec(
10096
prometheus.CounterOpts{
10197
Subsystem: cloudeventsMetricsSubsystem,
@@ -111,16 +107,16 @@ var cloudeventsSentCounterMetric = prometheus.NewCounterVec(
111107
// 2. the total sum of all observed values, exposed as 'resource_spec_resync_duration_seconds_sum'
112108
// 3. the count of events that have been observed, exposed as 'resource_spec_resync_duration_seconds_count' (identical to 'resource_spec_resync_duration_seconds_bucket{le="+Inf"}' above)
113109
// For example, 2 resource spec resync for manifests type that have been observed, one taking 0.5s and the other taking 0.7s, would result in the following metrics:
114-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="0.1"} 0
115-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="0.2"} 0
116-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="0.5"} 1
117-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="1.0"} 2
118-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="2.0"} 2
119-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="10.0"} 2
120-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="30.0"} 2
121-
// resource_spec_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests",le="+Inf"} 2
122-
// resource_spec_resync_duration_seconds_sum{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests"} 1.2
123-
// resource_spec_resync_duration_seconds_count{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifests"} 2
110+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="0.1"} 0
111+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="0.2"} 0
112+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="0.5"} 1
113+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="1.0"} 2
114+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="2.0"} 2
115+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="10.0"} 2
116+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="30.0"} 2
117+
// resource_spec_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests",le="+Inf"} 2
118+
// resource_spec_resync_duration_seconds_sum{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests"} 1.2
119+
// resource_spec_resync_duration_seconds_count{source="source1",type="io.open-cluster-management.works.v1alpha1.manifests"} 2
124120
var resourceSpecResyncDurationMetric = prometheus.NewHistogramVec(
125121
prometheus.HistogramOpts{
126122
Subsystem: resourcesMetricsSubsystem,
@@ -145,16 +141,16 @@ var resourceSpecResyncDurationMetric = prometheus.NewHistogramVec(
145141
// 2. the total sum of all observed values, exposed as 'resource_status_resync_duration_seconds_sum'
146142
// 3. the count of events that have been observed, exposed as 'resource_status_resync_duration_seconds_count' (identical to 'resource_status_resync_duration_seconds_bucket{le="+Inf"}' above)
147143
// For example, 2 resource status resync for manifestbundles type that have been observed, one taking 0.5s and the other taking 1.1s, would result in the following metrics:
148-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="0.1"} 0
149-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="0.2"} 0
150-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="0.5"} 1
151-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="1.0"} 1
152-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="2.0"} 2
153-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="10.0"} 2
154-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="30.0"} 2
155-
// resource_status_resync_duration_seconds_bucket{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="+Inf"} 2
156-
// resource_status_resync_duration_seconds_sum{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles"} 1.6
157-
// resource_status_resync_duration_seconds_count{source="source1",cluster="cluster1",type="io.open-cluster-management.works.v1alpha1.manifestbundles"} 2
144+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="0.1"} 0
145+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="0.2"} 0
146+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="0.5"} 1
147+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="1.0"} 1
148+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="2.0"} 2
149+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="10.0"} 2
150+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="30.0"} 2
151+
// resource_status_resync_duration_seconds_bucket{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles",le="+Inf"} 2
152+
// resource_status_resync_duration_seconds_sum{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles"} 1.6
153+
// resource_status_resync_duration_seconds_count{source="source1",type="io.open-cluster-management.works.v1alpha1.manifestbundles"} 2
158154
var resourceStatusResyncDurationMetric = prometheus.NewHistogramVec(
159155
prometheus.HistogramOpts{
160156
Subsystem: resourcesMetricsSubsystem,
@@ -229,7 +225,6 @@ func ResetCloudEventsMetrics() {
229225
func increaseCloudEventsReceivedCounter(source, cluster, dataType, subresource, action string) {
230226
labels := prometheus.Labels{
231227
metricsSourceLabel: source,
232-
metricsClusterLabel: cluster,
233228
metricsDataTypeLabel: dataType,
234229
metricsSubResourceLabel: subresource,
235230
metricsActionLabel: action,
@@ -245,7 +240,6 @@ func increaseCloudEventsSentCounter(source, originalSource, cluster, dataType, s
245240
labels := prometheus.Labels{
246241
metricsSourceLabel: source,
247242
metricsOriginalSourceLabel: originalSource,
248-
metricsClusterLabel: cluster,
249243
metricsDataTypeLabel: dataType,
250244
metricsSubResourceLabel: subresource,
251245
metricsActionLabel: action,
@@ -257,7 +251,6 @@ func increaseCloudEventsSentCounter(source, originalSource, cluster, dataType, s
257251
func updateResourceSpecResyncDurationMetric(source, cluster, dataType string, startTime time.Time) {
258252
labels := prometheus.Labels{
259253
metricsSourceLabel: source,
260-
metricsClusterLabel: cluster,
261254
metricsDataTypeLabel: dataType,
262255
}
263256
duration := time.Since(startTime)
@@ -268,7 +261,6 @@ func updateResourceSpecResyncDurationMetric(source, cluster, dataType string, st
268261
func updateResourceStatusResyncDurationMetric(source, cluster, dataType string, startTime time.Time) {
269262
labels := prometheus.Labels{
270263
metricsSourceLabel: source,
271-
metricsClusterLabel: cluster,
272264
metricsDataTypeLabel: dataType,
273265
}
274266
duration := time.Since(startTime)

pkg/cloudevents/generic/metrics_collector_test.go

Lines changed: 8 additions & 8 deletions
Original file line numberDiff line numberDiff line change
@@ -99,9 +99,9 @@ func TestCloudEventsMetrics(t *testing.T) {
9999
time.Sleep(time.Second)
100100

101101
// ensure metrics are updated
102-
sentTotal := cloudeventsSentCounterMetric.WithLabelValues(c.sourceID, noneOriginalSource, c.clusterName, c.dataType.String(), string(c.subresource), string(c.action))
102+
sentTotal := cloudeventsSentCounterMetric.WithLabelValues(c.sourceID, noneOriginalSource, c.dataType.String(), string(c.subresource), string(c.action))
103103
require.Equal(t, len(c.resources), int(toFloat64Counter(sentTotal)))
104-
receivedTotal := cloudeventsReceivedCounterMetric.WithLabelValues(c.sourceID, c.clusterName, c.dataType.String(), string(c.subresource), string(c.action))
104+
receivedTotal := cloudeventsReceivedCounterMetric.WithLabelValues(c.sourceID, c.dataType.String(), string(c.subresource), string(c.action))
105105
require.Equal(t, len(c.resources), int(toFloat64Counter(receivedTotal)))
106106

107107
cancel()
@@ -235,20 +235,20 @@ func TestResyncMetrics(t *testing.T) {
235235
// receive resync request and publish associated resources
236236
source.receive(ctx, evt)
237237

238-
receivedTotal := cloudeventsReceivedCounterMetric.WithLabelValues(c.clusterName, c.clusterName, c.dataType.String(), string(types.SubResourceSpec), string(types.ResyncRequestAction))
238+
receivedTotal := cloudeventsReceivedCounterMetric.WithLabelValues(c.clusterName, c.dataType.String(), string(types.SubResourceSpec), string(types.ResyncRequestAction))
239239
require.Equal(t, 1, int(toFloat64Counter(receivedTotal)))
240240

241241
// wait 1 seconds to respond to the spec resync request
242242
time.Sleep(1 * time.Second)
243243

244244
// check spec resync duration metric as a histogram
245-
h := resourceSpecResyncDurationMetric.WithLabelValues(c.sourceID, c.clusterName, c.dataType.String())
245+
h := resourceSpecResyncDurationMetric.WithLabelValues(c.sourceID, c.dataType.String())
246246
count, sum := toFloat64HistCountAndSum(h)
247247
require.Equal(t, uint64(1), count)
248248
require.Greater(t, sum, 0.0)
249249
require.Less(t, sum, 1.0)
250250

251-
sentTotal := cloudeventsSentCounterMetric.WithLabelValues(c.sourceID, noneOriginalSource, c.clusterName, c.dataType.String(), string(types.SubResourceSpec), string(types.ResyncResponseAction))
251+
sentTotal := cloudeventsSentCounterMetric.WithLabelValues(c.sourceID, noneOriginalSource, c.dataType.String(), string(types.SubResourceSpec), string(types.ResyncResponseAction))
252252
require.Equal(t, len(c.resources), int(toFloat64Counter(sentTotal)))
253253
}
254254

@@ -274,20 +274,20 @@ func TestResyncMetrics(t *testing.T) {
274274
// receive resync request and publish associated resources
275275
agent.receive(ctx, evt)
276276

277-
receivedTotal := cloudeventsReceivedCounterMetric.WithLabelValues(c.sourceID, c.clusterName, c.dataType.String(), string(types.SubResourceStatus), string(types.ResyncRequestAction))
277+
receivedTotal := cloudeventsReceivedCounterMetric.WithLabelValues(c.sourceID, c.dataType.String(), string(types.SubResourceStatus), string(types.ResyncRequestAction))
278278
require.Equal(t, 1, int(toFloat64Counter(receivedTotal)))
279279

280280
// wait 1 seconds to respond to the resync request
281281
time.Sleep(1 * time.Second)
282282

283283
// check status resync duration metric as a histogram
284-
h := resourceStatusResyncDurationMetric.WithLabelValues(c.sourceID, c.clusterName, c.dataType.String())
284+
h := resourceStatusResyncDurationMetric.WithLabelValues(c.sourceID, c.dataType.String())
285285
count, sum := toFloat64HistCountAndSum(h)
286286
require.Equal(t, uint64(1), count)
287287
require.Greater(t, sum, 0.0)
288288
require.Less(t, sum, 1.0)
289289

290-
sentTotal := cloudeventsSentCounterMetric.WithLabelValues(testAgentName, noneOriginalSource, c.clusterName, c.dataType.String(), string(types.SubResourceStatus), string(types.ResyncResponseAction))
290+
sentTotal := cloudeventsSentCounterMetric.WithLabelValues(testAgentName, noneOriginalSource, c.dataType.String(), string(types.SubResourceStatus), string(types.ResyncResponseAction))
291291
require.Equal(t, len(c.resources), int(toFloat64Counter(sentTotal)))
292292
}
293293

0 commit comments

Comments
 (0)