锚框生成算法anchors
迪丽瓦拉
2025-05-31 23:56:43
0
import six
from six import __init__  # 兼容python2和python3模块def generate_anchor_base(base_size=16, ratios=[0.5, 1, 2],anchor_scales=[8, 16, 32]):"""Generate base anchors by enumerating aspect ratio and scales.Args:base_size (number): The width and the height of the reference window.ratios (list of floats): anchor 的宽高比anchor_scales (list of numbers): anchor 的尺度Returns: Base anchors in a single-level feature maps.`(R, 4)`.bounding box is `(x_{min}, y_{min}, x_{max}, y_{max})`"""import numpy as nppy = base_size / 2.px = base_size / 2.anchor_base = np.zeros((len(ratios) * len(anchor_scales), 4),dtype=np.float32)for i in six.moves.range(len(ratios)):for j in six.moves.range(len(anchor_scales)):// 乘以感受野值,得到缩放后的 anchor 大小h = base_size * anchor_scales[j] * np.sqrt(ratios[i])w = base_size * anchor_scales[j] * np.sqrt(1. / ratios[i])index = i * len(anchor_scales) + janchor_base[index, 0] = px - w / 2.anchor_base[index, 1] = py - h / 2.anchor_base[index, 2] = px + h / 2.anchor_base[index, 3] = py + w / 2.return anchor_base# test
if __name__ == "__main__":bbox_list = generate_anchor_base()print(bbox_list)

这段代码实现了生成一组基础的 anchor box(锚框)。

在目标检测中,anchor box 是预设的一些矩形框框,它们是用来覆盖图像中可能存在物体的区域。在网络训练过程中,锚框会和 ground truth boxes(真实标签框)进行匹配并计算损失,从而学习到更好的目标检测模型。

该函数的输入有三个参数:

base_size:原始的 anchor 框大小,其宽和高都等于 base_size。
ratios:存储 anchor 的宽高比例,分别为 0.5、1 和 2。
anchor_scales:缩放比例,共 3 个,分别为 8、16、32。可以认为是对锚框做卷积的尺度步长,即每次缩小的倍数。
函数返回值是一个 (9, 4) 的 numpy 数组,表示共生成了九个不同尺寸的 anchor box,每个 box 包含四个坐标值 (x_min, y_min, x_max, y_max),这四个值分别代表框的左上角和右下角两个点的坐标。

具体实现过程如下:

创建一个 numpy 数组,大小为 (9, 4)。
遍历所有的 ratios 和 anchor_scales 组合,得到缩放后的 anchor box 尺寸。
计算 anchor box 左上和右下角坐标,并保存到 anchor_base 数组中。
最后打印出生成的所有 anchor box。
运行结果:
[[ -82.50967 -37.254833 53.254833 98.50967 ]
[-173.01933 -82.50967 98.50967 189.01933 ]
[-354.03867 -173.01933 189.01933 370.03867 ]
[ -56. -56. 72. 72. ]
[-120. -120. 136. 136. ]
[-248. -248. 264. 264. ]
[ -37.254833 -82.50967 98.50967 53.254833]
[ -82.50967 -173.01933 189.01933 98.50967 ]
[-173.01933 -354.03867 370.03867 189.01933 ]]

相关内容

热门资讯

linux入门---制作进度条 了解缓冲区 我们首先来看看下面的操作: 我们首先创建了一个文件并在这个文件里面添加了...
C++ 机房预约系统(六):学... 8、 学生模块 8.1 学生子菜单、登录和注销 实现步骤: 在Student.cpp的...
A.机器学习入门算法(三):基... 机器学习算法(三):K近邻(k-nearest neigh...
数字温湿度传感器DHT11模块... 模块实例https://blog.csdn.net/qq_38393591/article/deta...
有限元三角形单元的等效节点力 文章目录前言一、重新复习一下有限元三角形单元的理论1、三角形单元的形函数(Nÿ...
Redis 所有支持的数据结构... Redis 是一种开源的基于键值对存储的 NoSQL 数据库,支持多种数据结构。以下是...
win下pytorch安装—c... 安装目录一、cuda安装1.1、cuda版本选择1.2、下载安装二、cudnn安装三、pytorch...
MySQL基础-多表查询 文章目录MySQL基础-多表查询一、案例及引入1、基础概念2、笛卡尔积的理解二、多表查询的分类1、等...
keil调试专题篇 调试的前提是需要连接调试器比如STLINK。 然后点击菜单或者快捷图标均可进入调试模式。 如果前面...
MATLAB | 全网最详细网... 一篇超超超长,超超超全面网络图绘制教程,本篇基本能讲清楚所有绘制要点&#...
IHome主页 - 让你的浏览... 随着互联网的发展,人们越来越离不开浏览器了。每天上班、学习、娱乐,浏览器...
TCP 协议 一、TCP 协议概念 TCP即传输控制协议(Transmission Control ...
营业执照的经营范围有哪些 营业执照的经营范围有哪些 经营范围是指企业可以从事的生产经营与服务项目,是进行公司注册...
C++ 可变体(variant... 一、可变体(variant) 基础用法 Union的问题: 无法知道当前使用的类型是什...
血压计语音芯片,电子医疗设备声... 语音电子血压计是带有语音提示功能的电子血压计,测量前至测量结果全程语音播报࿰...
MySQL OCP888题解0... 文章目录1、原题1.1、英文原题1.2、答案2、题目解析2.1、题干解析2.2、选项解析3、知识点3...
【2023-Pytorch-检... (肆十二想说的一些话)Yolo这个系列我们已经更新了大概一年的时间,现在基本的流程也走走通了,包含数...
实战项目:保险行业用户分类 这里写目录标题1、项目介绍1.1 行业背景1.2 数据介绍2、代码实现导入数据探索数据处理列标签名异...
记录--我在前端干工地(thr... 这里给大家分享我在网上总结出来的一些知识,希望对大家有所帮助 前段时间接触了Th...
43 openEuler搭建A... 文章目录43 openEuler搭建Apache服务器-配置文件说明和管理模块43.1 配置文件说明...