OpenTelemetry 最终用户讨论摘要 2023 年 4 月
博客文章在发布后不会更新。这篇文章已经发布一年多了,其内容可能已过时,部分链接可能无效。在依赖任何信息之前,请务必核实。
2023 年 4 月,OpenTelemetry 最终用户组会议面向亚太地区 (APAC) 的用户举行。由于 KubeCon EU 的原因,AMER 和 EMEA 的会议没有举行;然而,我们将在 5 月份为所有三个地区再次举行会议。
讨论采用 精益咖啡(Lean Coffee)格式 进行,与会者可以将他们的话题发布到 Agile Coffee 板上,像这个一样,然后所有与会者投票决定他们想讨论什么。
我们讨论了什么
我们讨论了在大型组织中推广 OpenTelemetry 的采用,并讨论了如何优化大规模的可观测性数据。
讨论要点
以下是本月讨论的摘要。
注意:这些回答由 OTel 社区成员和最终用户根据他们的知识提供。这些回答并非 OpenTelemetry 的官方建议。
在大型组织中推广 OpenTelemetry 的采用
问:如何在大型组织中推广 OpenTelemetry 的采用?
答:在一个大型组织中,第一步是向领导层阐述当前可观测性方面的痛点。采用开源标准进行可观测性有其优势。如果没有统一的标准,跨不同团队的沟通将变得非常困难。如果使用 OpenTelemetry,您不必依赖任何供应商代理,并且可以灵活地将数据发送到多个后端。
如何优化大规模的可观测性数据?
问:在一个大型组织中,可观测性数据每天可能达到 TB 级别,这会带来相关成本。但总感觉捕获数据的 80% 是无用的。没有供应商能帮助您理解数据的使用情况,也无法将这种可见性带给发送数据的工程团队。
答:优化大规模可观测性的一种方法是采样。这是一篇关于使用 OpenTelemetry 进行 尾部采样 的文章。您有多种选项可以减少 SDK 和 Collector 级别的数据量。
此外,OpenTelemetry Collector 方面正在积极进行工作,以更有效地处理大规模数据。例如,正在研究使用 Apache Arrow 进行序列化,以优化网络成本。
优化大规模可观测性数据的另一种方法是决定您希望存储多少数据以供将来使用。您应该优化数据存储,以便产生更低的成本。
其他重要讨论点
OpenTelemetry 的成熟度模型
问:是否有关于理解在组织中采用 OTel 达到一定成熟度水平的步骤的文献?例如,我应该能够找到一个团队并告诉他们从 X 开始,然后做 Y 来前进。在一个大型企业中,您必须提供一些东西供人们理解 OpenTelemetry 的成熟度。
答:对于采用 OpenTelemetry 的团队来说,一个好主意是开始时进行最少的更改。例如,团队可以从支持自动插装的语言开始。从小的改变中看到价值可以增强团队更深入地采用 OpenTelemetry 的信心。
还有几个 OpenTelemetry 接收器 可用。这些接收器有助于收集最终用户已有的遥测数据。例如,Prometheus 接收器 可以帮助您以 Prometheus 格式接收指标数据。使用这些接收器,您可以开始从应用程序的不同组件发送遥测数据。
会议记录和录音
关于以上主题的更深入的探讨,请查看以下内容
- APAC 会议记录
立即加入我们!
如果您有关于您如何在组织中使用 OpenTelemetry 的故事要分享,我们很乐意倾听!分享方式
- 加入 #otel-endusers 频道,该频道位于 CNCF Community Slack
- 加入我们每月一次的 最终用户讨论小组电话会议
- 参加我们的 OTel 实践 会话
- 在 OpenTelemetry 博客 上分享您的故事
请务必在 Mastodon 和 Twitter 上关注 OpenTelemetry,并使用 #OpenTelemetry 标签分享您的故事!