【Application Insights】采样率对Function App日志收集的影响和解决方法

简介: Azure Functions日志在Application Insights中缺失,主因是默认启用的采样功能(每秒限采20项遥测)。可通过`host.json`配置`excludedTypes`排除Request/Exception等关键类型,或查询`RetainedPercentage`确认采样状态。

问题描述

在使用Application Insights来收集日志中,发现Function App的执行记录中缺少了日志。但这个Function确确实实的执行了。

那么,会是什么情况导致了Applicaiton Insights中收集日志信息不完善呢?

 

问题解答

根本原因是Application Insights默认启用了采样率(Sampling功能,在Function App中,默认每一秒最多采集20项日志数据。

Application Insights 具有采样功能,可以防止在峰值负载时为已完成的执行生成过多的遥测数据。

当传入执行的速率超过指定的阈值时,Application Insights 开始随机忽略某些传入执行。

每秒执行的最大次数的默认设置为 20

( 参考文档: https://docs.azure.cn/zh-cn/azure-functions/configure-monitoring?tabs=v2#configure-sampling )

 

当知道有采样率功能后,那么:

  • 如何来判断真实的情况呢?
  • 是否真的是采样率导致了日志数据的不完整呢?

具体的检查方法是:在Application Insights 的门户上,进入Logs 页面,执行如下语句来查看采样百分比:

union requests,dependencies,pageViews,browserTimings,exceptions,traces
| where timestamp > ago(1d)
| summarize RetainedPercentage = 100/avg(itemCount) by bin(timestamp, 1h), itemType

(RetainedPercentage < 100 则表示该类型的数据在统计周期中,执行了采样,日志数据收集并不完整)


实际效果图

RetainedPercentage 的解释:

RetainedPercentage 含义
= 100 未采样,数据完整
< 100 该时间窗口内发生了采样,数据不完整。比如第一个红圈中, Trace只收集了50%的数据, Exception 只收集了68.72%的数据

itemCount 的解释:

  • 采样(Sampling):SDK 在客户端按比例随机丢弃部分遥测数据,仅上报代表性的样本。
  • itemCount:每一条上报的遥测记录都会带这个字段,表示「这条样本背后实际代表了多少条原始记录」。
  • itemCount == 1:未采样,1 条记录就是 1 次真实调用;
  • itemCount == 10:采样了,这一条记录其实代表了 10 次原始调用(其余 9 次被丢弃)。
  • 聚合统计时(如 count()sum())需要按 itemCount 加权,否则数字会偏低。

 

解决方法

是的,可以避免采样情况的发生。

对于Request和Exception等关键的日志数据,需要100%收集,就可以修改Function App的 host.json 配置来实现。

{
  "version": "2.0",
  "logging": {
    "applicationInsights": {
      "samplingSettings": {
        "isEnabled": true,
        "maxTelemetryItemsPerSecond": 20,
        "excludedTypes": "Request;Exception"
      }
    }
  }
}


要点说明:

  • isEnabled: true 保留对 traces / dependencies 等高频数据的采样,控制成本;
  • excludedTypes 用分号分隔,可选值包括 Request / Exception / Trace / Dependency / PageView / Event
  • 也可以通过 maxTelemetryItemsPerSecond 调整阈值,而不是一刀切关掉。


操作截图:

 

 

参考资料

配置采样 : https://docs.azure.cn/zh-cn/azure-functions/configure-monitoring?tabs=v2#configure-sampling

了解采样是否正在进行中 : https://learn.microsoft.com/zh-cn/previous-versions/azure/azure-monitor/app/sampling-classic-api#knowing-whether-sampling-is-in-operation

itemCount 属性值介绍:https://learn.microsoft.com/zh-cn/previous-versions/azure/azure-monitor/app/classic-api?tabs=dotnet%2Cnet#requests-in-log-analytics


 


当在复杂的环境中面临问题,格物之道需:浊而静之徐清,安以动之徐生。 云中,恰是如此!

相关文章
|
3月前
|
人工智能 自然语言处理 数据挖掘
一人公司办公必备
一人公司办公必备,是任务拆解+AI协同+智能体辅助+知识沉淀+工作流复用的个人系统。告别单点工具堆砌,聚焦流程化、可复用、能进化的高效办公范式。
399 2
|
3月前
|
人工智能 编解码 安全
一站式AI视频翻译的技术架构:ASR→NMT→TTS→字幕压制的全链路设计
本文提出一套可落地的AI视频翻译系统架构,强调构建稳定、可追踪的数据管线而非简单串联模型。全链路分为输入、ASR、说话人分离、NMT、TTS、后处理和任务编排7层,以带时间轴/角色/状态的segment为核心数据结构,确保时间轴精准、声音不串、成品直发,专为出海、课程本地化与短剧翻译等场景优化。
|
3月前
|
JSON 缓存 人工智能
【剪映小助手】媒体处理接口
CapCut Mate 是基于 FastAPI 的剪映自动化媒体处理接口,支持视频、音频、图片、贴纸的批量添加与轨道管理,提供草稿创建/保存/获取及标准化错误处理,助力高效、可控的AI视频编辑流程。(239字)
|
3月前
|
设计模式 人工智能 数据可视化
Agentic 设计模式拆解:6 种结构的优缺点与应用场景
本文系统梳理Agentic AI六大核心设计模式:单一、顺序、并行智能体,循环评审,协调者与子智能体,以及作为工具的子智能体。聚焦智能体、用户、模型与工具间的结构化交互,提炼可复用的工程骨架,助力规模化落地。
324 5
Agentic 设计模式拆解:6 种结构的优缺点与应用场景
人工智能 运维 Cloud Native
527 6
|
3月前
|
机器学习/深度学习 人工智能 数据可视化
YOLO26如何涨点系列篇(NEU-DET缺陷检测) | CVPR2026 DEGConv方向引导边缘门控,破解细长裂缝检测难题 ,实现涨点
在NEU-DET数据集下验证:原始mAP50原始为 0.722提升至 0.732 , R 原始为 0.643 提升至 0.682 , mAP50-95原始为0.407提升至0.413
423 6
|
3月前
|
机器学习/深度学习 数据采集 人工智能
水稻病害检测数据集分享(适用于YOLO系列深度学习分类检测任务)
本数据集含7000+张水稻病害图像,覆盖细菌性叶斑病、褐斑病、叶霉病三类,标注规范(YOLO格式),已划分训练/验证/测试集(8:1:1),支持YOLO系列等主流检测模型,助力智慧农业病害识别研究与落地。(239字)
386 7