azure-ai-vision-imageanalysis-py - Azure AI Vision 图像分析 Python SDK
适用于 Azure AI Vision 4.0 图像分析的 Python SDK,支持字幕、标签、目标检测、OCR、人员检测与智能裁剪。
标签
更新于: 2026-09-17能力
典型输入
典型输出
该技能可以做什么
- 从 URL 分析图像
- 从文件分析图像
- 生成图像字幕
- 提取图像标签
- 检测图像中的物体
- 使用 OCR 提取文本
- 检测图像中的人员
- 生成智能裁剪区域
输入
- Azure Vision 端点
- Azure Vision API 密钥或 Entra ID 凭据
- 图像 URL 或图像文件数据
输出
- 图像字幕及置信度
- 图像标签及置信度
- 检测到的物体边界框
- OCR 文本行与词语
- 人员检测边界框
- 智能裁剪边界框
要求
- Python 包 azure-ai-vision-imageanalysis
- Azure AI Vision 资源端点与身份验证
- 图像格式为 JPEG、PNG、GIF、BMP、WEBP、ICO、TIFF 或 MPO
- 图像文件最大 20 MB
- 图像尺寸在 50x50 至 16000x16000 像素之间
