弥川

deep learning object detection

Author: deep learning object detection

Paper list from 2014 to now(2019)

The part highlighted with red characters means papers that i think “must-read”.
However, it is my personal opinion and other papers are important too, so I recommend to read them if you have time.

Performance table

FPS(Speed) index is related to the hardware spec(e.g. CPU, GPU, RAM, etc), so it is hard to make an equal comparison. The solution is to measure the performance of all models on hardware with equivalent specifications, but it is very difficult and time consuming.

Detector	VOC07 (mAP@IoU=0.5)	VOC12 (mAP@IoU=0.5)	COCO (mAP@IoU=0.5:0.95)	Published In
R-CNN	58.5	-	-	CVPR’14
SPP-Net	59.2	-	-	ECCV’14
MR-CNN	78.2 (07+12)	73.9 (07+12)	-	ICCV’15
Fast R-CNN	70.0 (07+12)	68.4 (07++12)	19.7	ICCV’15
Faster R-CNN	73.2 (07+12)	70.4 (07++12)	21.9	NIPS’15
YOLO v1	66.4 (07+12)	57.9 (07++12)	-	CVPR’16
G-CNN	66.8	66.4 (07+12)	-	CVPR’16
AZNet	70.4	-	22.3	CVPR’16
ION	80.1	77.9	33.1	CVPR’16
HyperNet	76.3 (07+12)	71.4 (07++12)	-	CVPR’16
OHEM	78.9 (07+12)	76.3 (07++12)	22.4	CVPR’16
MPN	-	-	33.2	BMVC’16
SSD	76.8 (07+12)	74.9 (07++12)	31.2	ECCV’16
GBDNet	77.2 (07+12)	-	27.0	ECCV’16
CPF	76.4 (07+12)	72.6 (07++12)	-	ECCV’16
R-FCN	79.5 (07+12)	77.6 (07++12)	29.9	NIPS’16
DeepID-Net	69.0	-	-	PAMI’16
NoC	71.6 (07+12)	68.8 (07+12)	27.2	TPAMI’16
DSSD	81.5 (07+12)	80.0 (07++12)	33.2	arXiv’17
TDM	-	-	37.3	CVPR’17
FPN	-	-	36.2	CVPR’17
YOLO v2	78.6 (07+12)	73.4 (07++12)	-	CVPR’17
RON	77.6 (07+12)	75.4 (07++12)	27.4	CVPR’17
DeNet	77.1 (07+12)	73.9 (07++12)	33.8	ICCV’17
CoupleNet	82.7 (07+12)	80.4 (07++12)	34.4	ICCV’17
RetinaNet	-	-	39.1	ICCV’17
DSOD	77.7 (07+12)	76.3 (07++12)	-	ICCV’17
SMN	70.0	-	-	ICCV’17
Light-Head R-CNN	-	-	41.5	arXiv’17
YOLO v3	-	-	33.0	arXiv’18
SIN	76.0 (07+12)	73.1 (07++12)	23.2	CVPR’18
STDN	80.9 (07+12)	-	-	CVPR’18
RefineDet	83.8 (07+12)	83.5 (07++12)	41.8	CVPR’18
SNIP	-	-	45.7	CVPR’18
Relation-Network	-	-	32.5	CVPR’18
Cascade R-CNN	-	-	42.8	CVPR’18
MLKP	80.6 (07+12)	77.2 (07++12)	28.6	CVPR’18
Fitness-NMS	-	-	41.8	CVPR’18
RFBNet	82.2 (07+12)	-	-	ECCV’18
CornerNet	-	-	42.1	ECCV’18
PFPNet	84.1 (07+12)	83.7 (07++12)	39.4	ECCV’18
Pelee	70.9 (07+12)	-	-	NIPS’18
HKRM	78.8 (07+12)	-	37.8	NIPS’18
M2Det	-	-	44.2	AAAI’19
R-DAD	81.2 (07++12)	82.0 (07++12)	43.1	AAAI’19
ScratchDet	84.1 (07++12)	83.6 (07++12)	39.1	CVPR’19
Libra R-CNN	-	-	43.0	CVPR’19
Reasoning-RCNN	82.5 (07++12)	-	43.2	CVPR’19
FSAF	-	-	44.6	CVPR’19
AmoebaNet + NAS-FPN	-	-	47.0	CVPR’19
Cascade-RetinaNet	-	-	41.1	CVPR’19
HTC	-	-	47.2	CVPR’19
TridentNet	-	-	48.4	ICCV’19
DAFS	85.3 (07+12)	83.1 (07++12)	40.5	ICCV’19
Auto-FPN	81.8 (07++12)	-	40.5	ICCV’19
FCOS	-	-	44.7	ICCV’19
FreeAnchor	-	-	44.8	NeurIPS’19
DetNAS	81.5 (07++12)	-	42.0	NeurIPS’19
NATS	-	-	42.0	NeurIPS’19
AmoebaNet + NAS-FPN + AA	-	-	50.7	arXiv’19
SpineNet	-	-	52.1	arXiv’19
CBNet	-	-	53.3	AAAI’20
EfficientDet	-	-	52.6	CVPR’20
DetectoRS	-	-	54.7	arXiv’20

2014

[R-CNN] Rich feature hierarchies for accurate object detection and semantic segmentation | [CVPR’ 14] |[pdf] [official code - caffe]
[OverFeat] OverFeat: Integrated Recognition, Localization and Detection using Convolutional Networks | [ICLR’ 14] |[pdf] [official code - torch]
[MultiBox] Scalable Object Detection using Deep Neural Networks | [CVPR’ 14] |[pdf]
[SPP-Net] Spatial Pyramid Pooling in Deep Convolutional Networks for Visual Recognition | [ECCV’ 14] |[pdf] [official code - caffe] [unofficial code - keras] [unofficial code - tensorflow]

2015

Improving Object Detection with Deep Convolutional Networks via Bayesian Optimization and Structured Prediction | [CVPR’ 15] |[pdf] [official code - matlab]
[MR-CNN] Object detection via a multi-region & semantic segmentation-aware CNN model | [ICCV’ 15] |[pdf] [official code - caffe]
[DeepBox] DeepBox: Learning Objectness with Convolutional Networks | [ICCV’ 15] |[pdf] [official code - caffe]
[AttentionNet] AttentionNet: Aggregating Weak Directions for Accurate Object Detection | [ICCV’ 15] |[pdf]
[Fast R-CNN] Fast R-CNN | [ICCV’ 15] |[pdf] [official code - caffe]
[DeepProposal] DeepProposal: Hunting Objects by Cascading Deep Convolutional Layers | [ICCV’ 15] |[pdf] [official code - matconvnet]
[Faster R-CNN, RPN] Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks | [NIPS’ 15] |[pdf] [official code - caffe] [unofficial code - tensorflow] [unofficial code - pytorch]

2016

[YOLO v1] You Only Look Once: Unified, Real-Time Object Detection | [CVPR’ 16] |[pdf] [official code - c]
[G-CNN] G-CNN: an Iterative Grid Based Object Detector | [CVPR’ 16] |[pdf]
[AZNet] Adaptive Object Detection Using Adjacency and Zoom Prediction | [CVPR’ 16] |[pdf]
[ION] Inside-Outside Net: Detecting Objects in Context with Skip Pooling and Recurrent Neural Networks | [CVPR’ 16] |[pdf]
[HyperNet] HyperNet: Towards Accurate Region Proposal Generation and Joint Object Detection | [CVPR’ 16] |[pdf]
[OHEM] Training Region-based Object Detectors with Online Hard Example Mining | [CVPR’ 16] |[pdf] [official code - caffe]
[CRAPF] CRAFT Objects from Images | [CVPR’ 16] |[pdf] [official code - caffe]
[MPN] A MultiPath Network for Object Detection | [BMVC’ 16] |[pdf] [official code - torch]
[SSD] SSD: Single Shot MultiBox Detector | [ECCV’ 16] |[pdf] [official code - caffe] [unofficial code - tensorflow] [unofficial code - pytorch]
[GBDNet] Crafting GBD-Net for Object Detection | [ECCV’ 16] |[pdf] [official code - caffe]
[CPF] Contextual Priming and Feedback for Faster R-CNN | [ECCV’ 16] |[pdf]
[MS-CNN] A Unified Multi-scale Deep Convolutional Neural Network for Fast Object Detection | [ECCV’ 16] |[pdf] [official code - caffe]
[R-FCN] R-FCN: Object Detection via Region-based Fully Convolutional Networks | [NIPS’ 16] |[pdf] [official code - caffe] [unofficial code - caffe]
[PVANET] PVANET: Deep but Lightweight Neural Networks for Real-time Object Detection | [NIPSW’ 16] |[pdf] [official code - caffe]
[DeepID-Net] DeepID-Net: Deformable Deep Convolutional Neural Networks for Object Detection | [PAMI’ 16] |[pdf]
[NoC] Object Detection Networks on Convolutional Feature Maps | [TPAMI’ 16] |[pdf]

2017

[DSSD] DSSD : Deconvolutional Single Shot Detector | [arXiv’ 17] |[pdf] [official code - caffe]
[TDM] Beyond Skip Connections: Top-Down Modulation for Object Detection | [CVPR’ 17] |[pdf]
[FPN] Feature Pyramid Networks for Object Detection | [CVPR’ 17] |[pdf] [unofficial code - caffe]
[YOLO v2] YOLO9000: Better, Faster, Stronger | [CVPR’ 17] |[pdf] [official code - c] [unofficial code - caffe] [unofficial code - tensorflow] [unofficial code - tensorflow] [unofficial code - pytorch]
[RON] RON: Reverse Connection with Objectness Prior Networks for Object Detection | [CVPR’ 17] |[pdf] [official code - caffe] [unofficial code - tensorflow]
[RSA] Recurrent Scale Approximation for Object Detection in CNN | | [ICCV’ 17] |[pdf] [official code - caffe]
[DCN] Deformable Convolutional Networks | [ICCV’ 17] |[pdf] [official code - mxnet] [unofficial code - tensorflow] [unofficial code - pytorch]
[DeNet] DeNet: Scalable Real-time Object Detection with Directed Sparse Sampling | [ICCV’ 17] |[pdf] [official code - theano]
[CoupleNet] CoupleNet: Coupling Global Structure with Local Parts for Object Detection | [ICCV’ 17] |[pdf] [official code - caffe]
[RetinaNet] Focal Loss for Dense Object Detection | [ICCV’ 17] |[pdf] [official code - keras] [unofficial code - pytorch] [unofficial code - mxnet] [unofficial code - tensorflow]
[Mask R-CNN] Mask R-CNN | [ICCV’ 17] |[pdf] [official code - caffe2] [unofficial code - tensorflow] [unofficial code - tensorflow] [unofficial code - pytorch]
[DSOD] DSOD: Learning Deeply Supervised Object Detectors from Scratch | [ICCV’ 17] |[pdf] [official code - caffe] [unofficial code - pytorch]
[SMN] Spatial Memory for Context Reasoning in Object Detection | [ICCV’ 17] |[pdf]
[Light-Head R-CNN] Light-Head R-CNN: In Defense of Two-Stage Object Detector | [arXiv’ 17] |[pdf] [official code - tensorflow]
[Soft-NMS] Improving Object Detection With One Line of Code | [ICCV’ 17] |[pdf] [official code - caffe]

2018

[YOLO v3] YOLOv3: An Incremental Improvement | [arXiv’ 18] |[pdf] [official code - c] [unofficial code - pytorch] [unofficial code - pytorch] [unofficial code - keras] [unofficial code - tensorflow]
[ZIP] Zoom Out-and-In Network with Recursive Training for Object Proposal | [IJCV’ 18] |[pdf] [official code - caffe]
[SIN] Structure Inference Net: Object Detection Using Scene-Level Context and Instance-Level Relationships | [CVPR’ 18] |[pdf] [official code - tensorflow]
[STDN] Scale-Transferrable Object Detection | [CVPR’ 18] |[pdf]
[RefineDet] Single-Shot Refinement Neural Network for Object Detection | [CVPR’ 18] |[pdf] [official code - caffe] [unofficial code - chainer] [unofficial code - pytorch]
[MegDet] MegDet: A Large Mini-Batch Object Detector | [CVPR’ 18] |[pdf]
[DA Faster R-CNN] Domain Adaptive Faster R-CNN for Object Detection in the Wild | [CVPR’ 18] |[pdf] [official code - caffe]
[SNIP] An Analysis of Scale Invariance in Object Detection – SNIP | [CVPR’ 18] |[pdf]
[Relation-Network] Relation Networks for Object Detection | [CVPR’ 18] |[pdf] [official code - mxnet]
[Cascade R-CNN] Cascade R-CNN: Delving into High Quality Object Detection | [CVPR’ 18] |[pdf] [official code - caffe]
Finding Tiny Faces in the Wild with Generative Adversarial Network | [CVPR’ 18] |[pdf]
[MLKP] Multi-scale Location-aware Kernel Representation for Object Detection | [CVPR’ 18] |[pdf] [official code - caffe]
Cross-Domain Weakly-Supervised Object Detection through Progressive Domain Adaptation | [CVPR’ 18] |[pdf] [official code - chainer]
[Fitness NMS] Improving Object Localization with Fitness NMS and Bounded IoU Loss | [CVPR’ 18] |[pdf]
[STDnet] STDnet: A ConvNet for Small Target Detection | [BMVC’ 18] |[pdf]
[RFBNet] Receptive Field Block Net for Accurate and Fast Object Detection | [ECCV’ 18] |[pdf] [official code - pytorch]
Zero-Annotation Object Detection with Web Knowledge Transfer | [ECCV’ 18] |[pdf]
[CornerNet] CornerNet: Detecting Objects as Paired Keypoints | [ECCV’ 18] |[pdf] [official code - pytorch]
[PFPNet] Parallel Feature Pyramid Network for Object Detection | [ECCV’ 18] |[pdf]
[Softer-NMS] Softer-NMS: Rethinking Bounding Box Regression for Accurate Object Detection | [arXiv’ 18] |[pdf]
[ShapeShifter] ShapeShifter: Robust Physical Adversarial Attack on Faster R-CNN Object Detector | [ECML-PKDD’ 18] |[pdf] [official code - tensorflow]
[Pelee] Pelee: A Real-Time Object Detection System on Mobile Devices | [NIPS’ 18] |[pdf] [official code - caffe]
[HKRM] Hybrid Knowledge Routed Modules for Large-scale Object Detection | [NIPS’ 18] |[pdf]
[MetaAnchor] MetaAnchor: Learning to Detect Objects with Customized Anchors | [NIPS’ 18] |[pdf]
[SNIPER] SNIPER: Efficient Multi-Scale Training | [NIPS’ 18] |[pdf]

2019

[M2Det] M2Det: A Single-Shot Object Detector based on Multi-Level Feature Pyramid Network | [AAAI’ 19] |[pdf] [official code - pytorch]
[R-DAD] Object Detection based on Region Decomposition and Assembly | [AAAI’ 19] |[pdf]
[CAMOU] CAMOU: Learning Physical Vehicle Camouflages to Adversarially Attack Detectors in the Wild | [ICLR’ 19] |[pdf]
Feature Intertwiner for Object Detection | [ICLR’ 19] |[pdf]
[GIoU] Generalized Intersection over Union: A Metric and A Loss for Bounding Box Regression | [CVPR’ 19] |[pdf]
Automatic adaptation of object detectors to new domains using self-training | [CVPR’ 19] |[pdf]
[Libra R-CNN] Libra R-CNN: Balanced Learning for Object Detection | [CVPR’ 19] |[pdf]
[FSAF] Feature Selective Anchor-Free Module for Single-Shot Object Detection | [CVPR’ 19] |[pdf]
[ExtremeNet] Bottom-up Object Detection by Grouping Extreme and Center Points | [CVPR’ 19] |[pdf] | [official code - pytorch]
[C-MIL] C-MIL: Continuation Multiple Instance Learning for Weakly Supervised Object Detection
| [CVPR’ 19] |[pdf] | [official code - torch]
[ScratchDet] ScratchDet: Training Single-Shot Object Detectors from Scratch | [CVPR’ 19] |[pdf]
Bounding Box Regression with Uncertainty for Accurate Object Detection | [CVPR’ 19] |[pdf] | [official code - caffe2]
Activity Driven Weakly Supervised Object Detection | [CVPR’ 19] |[pdf]
Towards Accurate One-Stage Object Detection with AP-Loss | [CVPR’ 19] |[pdf]
Strong-Weak Distribution Alignment for Adaptive Object Detection | [CVPR’ 19] |[pdf] | [official code - pytorch]
[NAS-FPN] NAS-FPN: Learning Scalable Feature Pyramid Architecture for Object Detection | [CVPR’ 19] |[pdf]
[Adaptive NMS] Adaptive NMS: Refining Pedestrian Detection in a Crowd | [CVPR’ 19] |[pdf]
Point in, Box out: Beyond Counting Persons in Crowds | [CVPR’ 19] |[pdf]
Locating Objects Without Bounding Boxes | [CVPR’ 19] |[pdf]
Sampling Techniques for Large-Scale Object Detection from Sparsely Annotated Objects | [CVPR’ 19] |[pdf]
Towards Universal Object Detection by Domain Attention | [CVPR’ 19] |[pdf]
Exploring the Bounds of the Utility of Context for Object Detection | [CVPR’ 19] |[pdf]
What Object Should I Use? - Task Driven Object Detection | [CVPR’ 19] |[pdf]
Dissimilarity Coefficient based Weakly Supervised Object Detection | [CVPR’ 19] |[pdf]
Adapting Object Detectors via Selective Cross-Domain Alignment | [CVPR’ 19] |[pdf]
Fully Quantized Network for Object Detection | [CVPR’ 19] |[pdf]
Distilling Object Detectors with Fine-grained Feature Imitation | [CVPR’ 19] |[pdf]
Multi-task Self-Supervised Object Detection via Recycling of Bounding Box Annotations | [CVPR’ 19] |[pdf]
[Reasoning-RCNN] Reasoning-RCNN: Unifying Adaptive Global Reasoning into Large-scale Object Detection | [CVPR’ 19] |[pdf]
Arbitrary Shape Scene Text Detection with Adaptive Text Region Representation | [CVPR’ 19] |[pdf]
Assisted Excitation of Activations: A Learning Technique to Improve Object Detectors | [CVPR’ 19] |[pdf]
Spatial-aware Graph Relation Network for Large-scale Object Detection | [CVPR’ 19] |[pdf]
[MaxpoolNMS] MaxpoolNMS: Getting Rid of NMS Bottlenecks in Two-Stage Object Detectors | [CVPR’ 19] |[pdf]
You reap what you sow: Generating High Precision Object Proposals for Weakly-supervised Object Detection | [CVPR’ 19] |[pdf]
Object detection with location-aware deformable convolution and backward attention filtering | [CVPR’ 19] |[pdf]
Diversify and Match: A Domain Adaptive Representation Learning Paradigm for Object Detection | [CVPR’ 19] |[pdf]
Hybrid Task Cascade for Instance Segmentation | [CVPR’ 19] |[pdf]
[GFR] Improving Object Detection from Scratch via Gated Feature Reuse | [BMVC’ 19] |[pdf] | [official code - pytorch]
[Cascade RetinaNet] Cascade RetinaNet: Maintaining Consistency for Single-Stage Object Detection | [BMVC’ 19] |[pdf]
Soft Sampling for Robust Object Detection | [BMVC’ 19] |[pdf]
Multi-adversarial Faster-RCNN for Unrestricted Object Detection | [ICCV’ 19] |[pdf]
Towards Adversarially Robust Object Detection | [ICCV’ 19] |[pdf]
A Robust Learning Approach to Domain Adaptive Object Detection | [ICCV’ 19] |[pdf]
A Delay Metric for Video Object Detection: What Average Precision Fails to Tell | [ICCV’ 19] |[pdf]
Delving Into Robust Object Detection From Unmanned Aerial Vehicles: A Deep Nuisance Disentanglement Approach | [ICCV’ 19] |[pdf]
Employing Deep Part-Object Relationships for Salient Object Detection | [ICCV’ 19] |[pdf]
Learning Rich Features at High-Speed for Single-Shot Object Detection | [ICCV’ 19] |[pdf]
Structured Modeling of Joint Deep Feature and Prediction Refinement for Salient Object Detection | [ICCV’ 19] |[pdf]
Selectivity or Invariance: Boundary-Aware Salient Object Detection | [ICCV’ 19] |[pdf]
Progressive Sparse Local Attention for Video Object Detection | [ICCV’ 19] |[pdf]
Minimum Delay Object Detection From Video | [ICCV’ 19] |[pdf]
Towards Interpretable Object Detection by Unfolding Latent Structures | [ICCV’ 19] |[pdf]
Scaling Object Detection by Transferring Classification Weights | [ICCV’ 19] |[pdf]
[TridentNet] Scale-Aware Trident Networks for Object Detection | [ICCV’ 19] |[pdf]
Generative Modeling for Small-Data Object Detection | [ICCV’ 19] |[pdf]
Transductive Learning for Zero-Shot Object Detection | [ICCV’ 19] |[pdf]
Self-Training and Adversarial Background Regularization for Unsupervised Domain Adaptive One-Stage Object Detection | [ICCV’ 19] |[pdf]
[CenterNet] CenterNet: Keypoint Triplets for Object Detection | [ICCV’ 19] |[pdf]
[DAFS] Dynamic Anchor Feature Selection for Single-Shot Object Detection | [ICCV’ 19] |[pdf]
[Auto-FPN] Auto-FPN: Automatic Network Architecture Adaptation for Object Detection Beyond Classification | [ICCV’ 19] |[pdf]
Multi-Adversarial Faster-RCNN for Unrestricted Object Detection | [ICCV’ 19] |[pdf]
Object Guided External Memory Network for Video Object Detection | [ICCV’ 19] |[pdf]
[ThunderNet] ThunderNet: Towards Real-Time Generic Object Detection on Mobile Devices | [ICCV’ 19] |[pdf]
[RDN] Relation Distillation Networks for Video Object Detection | [ICCV’ 19] |[pdf]
[MMNet] Fast Object Detection in Compressed Video | [ICCV’ 19] |[pdf]
Towards High-Resolution Salient Object Detection | [ICCV’ 19] |[pdf]
[SCAN] Stacked Cross Refinement Network for Edge-Aware Salient Object Detection | [ICCV’ 19] |[official code] |[pdf]
Motion Guided Attention for Video Salient Object Detection | [ICCV’ 19] |[pdf]
Semi-Supervised Video Salient Object Detection Using Pseudo-Labels | [ICCV’ 19] |[pdf]
Learning to Rank Proposals for Object Detection | [ICCV’ 19] |[pdf]
[WSOD2] WSOD2: Learning Bottom-Up and Top-Down Objectness Distillation for Weakly-Supervised Object Detection | [ICCV’ 19] |[pdf]
[ClusDet] Clustered Object Detection in Aerial Images | [ICCV’ 19] |[pdf]
Towards Precise End-to-End Weakly Supervised Object Detection Network | [ICCV’ 19] |[pdf]
Few-Shot Object Detection via Feature Reweighting | [ICCV’ 19] |[pdf]
[Objects365] Objects365: A Large-Scale, High-Quality Dataset for Object Detection | [ICCV’ 19] |[pdf]
[EGNet] EGNet: Edge Guidance Network for Salient Object Detection | [ICCV’ 19] |[pdf]
Optimizing the F-Measure for Threshold-Free Salient Object Detection | [ICCV’ 19] |[pdf]
Sequence Level Semantics Aggregation for Video Object Detection | [ICCV’ 19] |[pdf]
[NOTE-RCNN] NOTE-RCNN: NOise Tolerant Ensemble RCNN for Semi-Supervised Object Detection | [ICCV’ 19] |[pdf]
Enriched Feature Guided Refinement Network for Object Detection | [ICCV’ 19] |[pdf]
[POD] POD: Practical Object Detection With Scale-Sensitive Network | [ICCV’ 19] |[pdf]
[FCOS] FCOS: Fully Convolutional One-Stage Object Detection | [ICCV’ 19] |[pdf]
[RepPoints] RepPoints: Point Set Representation for Object Detection | [ICCV’ 19] |[pdf]
Better to Follow, Follow to Be Better: Towards Precise Supervision of Feature Super-Resolution for Small Object Detection | [ICCV’ 19] |[pdf]
Weakly Supervised Object Detection With Segmentation Collaboration | [ICCV’ 19] |[pdf]
Leveraging Long-Range Temporal Relationships Between Proposals for Video Object Detection | [ICCV’ 19] |[pdf]
Detecting 11K Classes: Large Scale Object Detection Without Fine-Grained Bounding Boxes | [ICCV’ 19] |[pdf]
[C-MIDN] C-MIDN: Coupled Multiple Instance Detection Network With Segmentation Guidance for Weakly Supervised Object Detection | [ICCV’ 19] |[pdf]
Meta-Learning to Detect Rare Objects | [ICCV’ 19] |[pdf]
[Cap2Det] Cap2Det: Learning to Amplify Weak Caption Supervision for Object Detection | [ICCV’ 19] |[pdf]
[Gaussian YOLOv3] Gaussian YOLOv3: An Accurate and Fast Object Detector using Localization Uncertainty for Autonomous Driving | [ICCV’ 19] |[pdf] [official code - c]
[FreeAnchor] FreeAnchor: Learning to Match Anchors for Visual Object Detection | [NeurIPS’ 19] |[pdf]
Memory-oriented Decoder for Light Field Salient Object Detection | [NeurIPS’ 19] |[pdf]
One-Shot Object Detection with Co-Attention and Co-Excitation | [NeurIPS’ 19] |[pdf]
[DetNAS] DetNAS: Backbone Search for Object Detection | [NeurIPS’ 19] |[pdf]
Consistency-based Semi-supervised Learning for Object detection | [NeurIPS’ 19] |[pdf]
[NATS] Efficient Neural Architecture Transformation Searchin Channel-Level for Object Detection | [NeurIPS’ 19] |[pdf]
[AA] Learning Data Augmentation Strategies for Object Detection | [arXiv’ 19] |[pdf]
[Spinenet] Spinenet: Learning scale-permuted backbone for recognition and localization | [arXiv’ 19] |[pdf]
Object Detection in 20 Years: A Survey | [arXiv’ 19] |[pdf]

2020

[Spiking-YOLO] Spiking-YOLO: Spiking Neural Network for Real-time Object Detection | [AAAI’ 20] |[pdf]
Tell Me What They’re Holding: Weakly-supervised Object Detection with Transferable Knowledge from Human-object Interaction | [AAAI’ 20] |[pdf]
[CBnet] Cbnet: A novel composite backbone network architecture for object detection | [AAAI’ 20] |[pdf]
[Distance-IoU Loss] Distance-IoU Loss: Faster and Better Learning for Bounding Box Regression | [AAAI’ 20] |[pdf]
Computation Reallocation for Object Detection | [ICLR’ 20] |[pdf]
[YOLOv4] YOLOv4: Optimal Speed and Accuracy of Object Detection | [arXiv’ 20] |[pdf]
Few-Shot Object Detection With Attention-RPN and Multi-Relation Detector | [CVPR’ 20] |[pdf]
Large-Scale Object Detection in the Wild From Imbalanced Multi-Labels | [CVPR’ 20] |[pdf]
Bridging the Gap Between Anchor-Based and Anchor-Free Detection via Adaptive Training Sample Selection | [CVPR’ 20] |[pdf]
Rethinking Classification and Localization for Object Detection | [CVPR’ 20] |[pdf]
Multiple Anchor Learning for Visual Object Detection | [CVPR’ 20] |[pdf]
[CentripetalNet] CentripetalNet: Pursuing High-Quality Keypoint Pairs for Object Detection | [CVPR’ 20] |[pdf]
Learning From Noisy Anchors for One-Stage Object Detection | [CVPR’ 20] |[pdf]
[EfficientDet] EfficientDet: Scalable and Efficient Object Detection | [CVPR’ 20] |[pdf]
Overcoming Classifier Imbalance for Long-Tail Object Detection With Balanced Group Softmax | [CVPR’ 20] |[pdf]
Dynamic Refinement Network for Oriented and Densely Packed Object Detection | [CVPR’ 20] |[pdf]
Noise-Aware Fully Webly Supervised Object Detection | [CVPR’ 20] |[pdf]
[Hit-Detector] Hit-Detector: Hierarchical Trinity Architecture Search for Object Detection | [CVPR’ 20] |[pdf]
[D2Det] D2Det: Towards High Quality Object Detection and Instance Segmentation | [CVPR’ 20] |[pdf]
Prime Sample Attention in Object Detection | [CVPR’ 20] |[pdf]
Don’t Even Look Once: Synthesizing Features for Zero-Shot Detection | [CVPR’ 20] |[pdf]
Exploring Categorical Regularization for Domain Adaptive Object Detection | [CVPR’ 20] |[pdf]
[SP-NAS] SP-NAS: Serial-to-Parallel Backbone Search for Object Detection | [CVPR’ 20] |[pdf]
[NAS-FCOS] NAS-FCOS: Fast Neural Architecture Search for Object Detection | [CVPR’ 20] |[pdf]
[DR Loss] DR Loss: Improving Object Detection by Distributional Ranking | [CVPR’ 20] |[pdf]
Detection in Crowded Scenes: One Proposal, Multiple Predictions | [CVPR’ 20] |[pdf]
[AugFPN] AugFPN: Improving Multi-Scale Feature Learning for Object Detection | [CVPR’ 20] |[pdf]
Robust Object Detection Under Occlusion With Context-Aware CompositionalNets | [CVPR’ 20] |[pdf]
Cross-Domain Document Object Detection: Benchmark Suite and Method | [CVPR’ 20] |[pdf]
Exploring Bottom-Up and Top-Down Cues With Attentive Learning for Webly Supervised Object Detection | [CVPR’ 20] |[pdf]
[SLV] SLV: Spatial Likelihood Voting for Weakly Supervised Object Detection | [CVPR’ 20] |[pdf]
[HAMBox] HAMBox: Delving Into Mining High-Quality Anchors on Face Detection | [CVPR’ 20] |[pdf]
[Context R-CNN] Context R-CNN: Long Term Temporal Context for Per-Camera Object Detection | [CVPR’ 20] |[pdf]
Mixture Dense Regression for Object Detection and Human Pose Estimation | [CVPR’ 20] |[pdf]
Offset Bin Classification Network for Accurate Object Detection | [CVPR’ 20] |[pdf]
[NETNet] NETNet: Neighbor Erasing and Transferring Network for Better Single Shot Object Detection | [CVPR’ 20] |[pdf]
Scale-Equalizing Pyramid Convolution for Object Detection | [CVPR’ 20] |[pdf]
Temporal-Context Enhanced Detection of Heavily Occluded Pedestrians | [CVPR’ 20] |[pdf]
[MnasFPN] MnasFPN: Learning Latency-Aware Pyramid Architecture for Object Detection on Mobile Devices | [CVPR’ 20] |[pdf]
Physically Realizable Adversarial Examples for LiDAR Object Detection | [CVPR’ 20] |[pdf]
Cross-domain Object Detection through Coarse-to-Fine Feature Adaptation | [CVPR’ 20] |[pdf]
Incremental Few-Shot Object Detection | [CVPR’ 20] |[pdf]
Where, What, Whether: Multi-Modal Learning Meets Pedestrian Detection | [CVPR’ 20] |[pdf]
Cylindrical Convolutional Networks for Joint Object Detection and Viewpoint Estimation | [CVPR’ 20] |[pdf]
Learning a Unified Sample Weighting Network for Object Detection | [CVPR’ 20] |[pdf]
Seeing without Looking: Contextual Rescoring of Object Detections for AP Maximization | [CVPR’ 20] |[pdf]
DetectoRS: Detecting Objects with Recursive Feature Pyramid and Switchable Atrous Convolution | [arXiv’ 20] |[pdf]
[DETR] End-to-End Object Detection with Transformers | [ECCV’ 20] |[pdf]
Suppress and Balance: A Simple Gated Network for Salient Object Detection | [ECCV’ 20] |[code]
[BorderDet] BorderDet: Border Feature for Dense Object Detection | [ECCV’ 20] |[pdf]
Corner Proposal Network for Anchor-free, Two-stage Object Detection | [ECCV’ 20] |[pdf]
A General Toolbox for Understanding Errors in Object Detection | [ECCV’ 20] |[pdf]
[Chained-Tracker] Chained-Tracker: Chaining Paired Attentive Regression Results for End-to-End Joint Multiple-Object Detection and Tracking | [ECCV’ 20] |[pdf]
Side-Aware Boundary Localization for More Precise Object Detection | [ECCV’ 20] |[pdf]
[PIoU] PIoU Loss: Towards Accurate Oriented Object Detection in Complex Environments | [ECCV’ 20] |[pdf]
[AABO] AABO: Adaptive Anchor Box Optimization for Object Detection via Bayesian Sub-sampling | [ECCV’ 20] |[pdf]
Highly Efficient Salient Object Detection with 100K Parameters | [ECCV’ 20] |[pdf]
[GeoGraph] GeoGraph: Learning graph-based multi-view object detection with geometric cues end-to-end | [ECCV’ 20] |[pdf]
Many-shot from Low-shot: Learning to Annotate using Mixed Supervision for Object Detection| [ECCV’ 20] |[pdf]
Cheaper Pre-training Lunch: An Efficient Paradigm for Object Detection | [ECCV’ 20] |[pdf]
Arbitrary-Oriented Object Detection with Circular Smooth Label | [ECCV’ 20] |[pdf]
Soft Anchor-Point Object Detection | [ECCV’ 20] |[pdf]
Object Detection with a Unified Label Space from Multiple Datasets | [ECCV’ 20] |[pdf]
[MimicDet] MimicDet: Bridging the Gap Between One-Stage and Two-Stage Object Detection | [ECCV’ 20] |[pdf]
Prior-based Domain Adaptive Object Detection for Hazy and Rainy Conditions | [ECCV’ 20] |[pdf]
[Dynamic R-CNN] Dynamic R-CNN: Towards High Quality Object Detection via Dynamic Training | [ECCV’ 20] |[pdf]
[OS2D] OS2D: One-Stage One-Shot Object Detection by Matching Anchor Features | [ECCV’ 20] |[pdf]
Multi-Scale Positive Sample Refinement for Few-Shot Object Detection | [ECCV’ 20] |[pdf]
Few-Shot Object Detection and Viewpoint Estimation for Objects in the Wild | [ECCV’ 20] |[pdf]
Collaborative Training between Region Proposal Localization and Classification for Domain Adaptive Object Detection | [ECCV’ 20] |[pdf]
Two-Stream Active Query Suggestion for Large-Scale Object Detection in Connectomics | [ECCV’ 20] |[pdf]
[FDTS] FDTS: Fast Diverse-Transformation Search for Object Detection and Beyond | [ECCV’ 20]
Dual refinement underwater object detection network | [ECCV’ 20] |[pdf]
[APRICOT] APRICOT: A Dataset of Physical Adversarial Attacks on Object Detection | [ECCV’ 20] |[pdf]
Large Batch Optimization for Object Detection: Training COCO in 12 Minutes | [ECCV’ 20] |[pdf]
Hierarchical Context Embedding for Region-based Object Detection | [ECCV’ 20] |[pdf]
Pillar-based Object Detection for Autonomous Driving | [ECCV’ 20] |[pdf]
Dive Deeper Into Box for Object Detection | [ECCV’ 20] |[pdf]
Domain Adaptive Object Detection via Asymmetric Tri-way Faster-RCNN | [ECCV’ 20] |[pdf]
Probabilistic Anchor Assignment with IoU Prediction for Object Detection | [ECCV’ 20] |[pdf]
[HoughNet] HoughNet: Integrating near and long-range evidence for bottom-up object detection | [ECCV’ 20] |[pdf]
[LabelEnc] LabelEnc: A New Intermediate Supervision Method for Object Detection | [ECCV’ 20] |[pdf]
Boosting Weakly Supervised Object Detection with Progressive Knowledge Transfer | [ECCV’ 20] |[pdf]
On the Importance of Data Augmentation for Object Detection | [ECCV’ 20] |[[pdf]]
Adaptive Object Detection with Dual Multi-Label Prediction | [ECCV’ 20] |[pdf]
Quantum-soft QUBO Suppression for Accurate Object Detection | [ECCV’ 20] |[pdf]
Improving Object Detection with Selective Self-supervised Self-training | [ECCV’ 20] |[pdf]

Dataset Papers

Statistics of commonly used object detection datasets. The Table came from this survey paper.

The papers related to datasets used mainly in Object Detection are as follows.

[PASCAL VOC] The PASCAL Visual Object Classes (VOC) Challenge | [IJCV’ 10] | [pdf]
[PASCAL VOC] The PASCAL Visual Object Classes Challenge: A Retrospective | [IJCV’ 15] | [pdf] | [link]
[ImageNet] ImageNet: A Large-Scale Hierarchical Image Database| [CVPR’ 09] | [pdf]
[ImageNet] ImageNet Large Scale Visual Recognition Challenge | [IJCV’ 15] | [pdf] | [link]
[COCO] Microsoft COCO: Common Objects in Context | [ECCV’ 14] | [pdf] | [link]
[Open Images] The Open Images Dataset V4: Unified image classification, object detection, and visual relationship detection at scale | [arXiv’ 18] | [pdf] | [link]
[DOTA] DOTA: A Large-scale Dataset for Object Detection in Aerial Images | [CVPR’ 18] | [pdf] | [link]
[Objects365] Objects365: A Large-Scale, High-Quality Dataset for Object Detection | [ICCV’ 19] | [link]

你可能感兴趣的:(神经网络,深度学习)

使用 MistralAI 平台进行开源模型托管与调用 VYSAHF python
MistralAI是一个提供开放源码模型托管的平台，致力于帮助开发者更轻松地使用和管理开源模型。通过该平台，你可以方便地调用强大的深度学习模型，并将其集成到你的应用中。本文将带你了解如何利用MistralAI提供的服务来进行模型的托管和调用。技术背景介绍MistralAI的服务包括了如聊天模型和嵌入模型等，这些模型适用于聊天机器人、文本嵌入等各种场景。使用这些模型需要注册并获取一个有效的API密钥
DeepLabv3+改进18:在主干网络中添加REP_BLOCK AICurator 深度学习 python 机器学习 deeplabv3+语义分割
【DeepLabv3+改进专栏！探索语义分割新高度】你是否在为图像分割的精度与效率发愁？本专栏重磅推出：✅独家改进策略：融合注意力机制、轻量化设计与多尺度优化✅即插即用模块：ASPP+升级、解码器PS:订阅专栏提供完整代码论文简介我们提出了一种通用的卷积神经网络（ConvNet）构建模块，可在不增加推理时间成本的情况下提升性能。该模块名为多样化分支块（DBB），通过结合不同尺度和复杂度的多样化分支
暗光增强技术研究进展与产品落地综合分析（2023-2025） AndrewHZ 深度学习新浪潮图像处理算法动态范围计算机视觉深度学习 transformer 暗光增强
一、引言暗光增强技术作为计算机视觉与移动影像领域的核心研究方向之一，近年来在算法创新、硬件适配及产品落地方面取得了显著进展。本文从技术研究与产业应用两个维度，系统梳理近三年（2023-2025）该领域的关键突破，并对比分析主流手机厂商的影像技术优劣势。二、暗光增强技术研究进展1.算法创新：从传统模型到深度学习（1）Retinex理论的深度结合清华与ETH联合提出的Retinexformer（202
Postman高级功能深度解析：Mock Server与自动化监控——构建高效API测试与监控体系测试渣测试工具 postman
引言：Postman在API开发中的核心价值在数字化时代，API（应用程序编程接口）已成为系统间交互的“神经网络”，其质量直接影响用户体验与业务连续性。然而，传统API测试面临两大挑战：开发阶段依赖：前端与后端团队需同步开发，导致进度延迟；测试环境复杂：生产数据敏感、测试场景覆盖不全、性能压力模拟困难。Postman作为全球领先的API开发与测试工具，通过其MockServer与自动化监控两大核心
金融风控算法透明度与可解释性优化智能计算研究中心其他
内容概要金融风控算法的透明化研究面临模型复杂性提升与监管合规要求的双重挑战。随着深度学习框架在特征提取环节的广泛应用，算法可解释性与预测精度之间的平衡成为核心议题。本文从联邦学习架构下的数据协作机制出发，结合特征工程优化与超参数调整技术，系统性分析逻辑回归、随机森林等传统算法在召回率、F1值等关键指标上的表现差异。研究同时探讨数据预处理流程对风控决策鲁棒性的影响，并提出基于注意力机制的特征权重可视
H800核心性能优化技术智能计算研究中心其他
内容概要作为新一代AI加速卡的核心创新载体，H800通过异构计算架构与动态能效管理技术的协同设计，实现了从硬件底层到应用层的系统性优化。其技术突破聚焦于张量核心重构带来的计算密度提升、混合精度运算对资源利用率的增强，以及智能散热方案在复杂负载场景下的稳定性保障。这些创新不仅显著提升了30%以上的能效比，更通过精细化任务调度机制，解决了深度学习训练中高并发数据处理与模型参数同步的效率瓶颈。值得关注的
TikTokenizer 项目常见问题解决方案齐飞锴Timothea
TikTokenizer项目常见问题解决方案tiktokenizerOnlineplaygroundforOpenAPItokenizers项目地址:https://gitcode.com/gh_mirrors/ti/tiktokenizer项目基础介绍TikTokenizer是一个开源项目，主要用于文本处理，特别是将文本转化为可用于深度学习的格式。该项目是基于TensorFlow和Keras开发
DeepSeek混合专家架构赋能智能创作智能计算研究中心其他
内容概要在人工智能技术加速迭代的当下，DeepSeek混合专家架构（MixtureofExperts）通过670亿参数的动态路由机制，实现了多模态处理的范式突破。该架构将视觉语言理解、多语言语义解析与深度学习算法深度融合，构建出覆盖文本生成、代码编写、学术研究等场景的立体化能力矩阵。其核心优势体现在三个维度：精准化内容生产——通过智能选题、文献综述自动生成等功能，将学术论文写作效率提升40%以上；
YOLO11改进-模块-引入频率谱动态聚合模块FSDA 去除噪声一勺汤 YOLOv11模型改进系列目标检测魔改模块 YOLO YOLOv11 YOLOv11改进改进
在图像去雾领域，深度学习在白天图像去雾方面成果显著，但夜间雾图研究较少。夜间雾图面临诸多挑战，其中包括雾、辉光和噪声因多个低强度有源彩色光源而具有复杂特性，以及模拟与真实数据的域差异导致的亮度问题。为解决这些，我们使用FSDA模块，处理频率不一致特性。FSDA先对频谱信息聚合，再计算通道权重并应用，最后映射回空间域，以此优化频谱信息，使模型更好处理复杂干扰。本文将其与YOLOv11相结合，增强YO
基于多头注意机制的多尺度特征融合的GCN的序列数据（功率预测、故障诊断）模型及代码详解清风AI 深度学习算法详解及代码复现人工智能神经网络深度学习 python conda pip pandas
GCN基础在深度学习领域中，图卷积网络(GCN)是一种强大的图数据处理工具。它将卷积操作扩展到图结构上，能够有效捕捉图中节点之间的关系信息。GCN的核心思想是通过聚合邻居节点的特征来更新目标节点的表示，这种局部聚合机制使得GCN能够学习到图的拓扑结构和节点属性。GCN的主要构成要素包括节点特征矩阵、邻接矩阵和卷积核。通过多次迭代，GCN可以逐步学习到图中节点的高阶表示，为后续的分类、预测等任务提供
YOLO魔改之频率分割模块（FDM）清风AI YOLO算法魔改系列 YOLO 人工智能计算机视觉目标检测 python 深度学习
目标检测原理目标检测是一种将目标分割和识别相结合的图像处理技术，旨在从图像中定位并识别特定目标。深度学习方法，如FasterR-CNN和YOLO系列，已成为主流解决方案。这些方法通常采用两阶段或单阶段策略，通过卷积神经网络(CNN)提取特征并进行分类和定位。在小目标检测中，为克服分辨率低和特征不明显的问题，模型设计中会特别注重特征融合和多尺度处理，以增强对小目标的感知能力。YOLOv8基础YOLO
PyTorch模型训练实战指南：掌握动态图特性与工业级部署技巧 lmtealily pytorch 人工智能 python
前言在深度学习领域，PyTorch凭借其动态计算图、高效的自动微分系统及高度Pythonic的设计哲学，已成为学术界与工业界的主流框架。其即时执行模式大幅简化了模型调试流程，而灵活的模块化设计则为复杂模型的构建提供了坚实基础。然而，从实验原型到工业级部署的全链路实践中，开发者仍需系统性掌握框架核心特性与工程化技巧。本文以实战为导向，深入剖析PyTorch动态图机制与自动微分原理，详解从数据预处理、
目标检测YOLO实战应用案例100讲-基于毫米波雷达与摄像头协同的道路目标检测与识别（续）林聪木目标检测 YOLO 人工智能
目录3.2实测数据采集与分析3.2.1回波数据处理3.2.2毫米波雷达数据采集实验3.3基于传统图像特征的目标识别算法3.3.1基于灰度共生矩阵的时频图特征提取3.3.2支持向量机分类器3.3.3实验及结果分析3.4基于卷积神经网络的目标识别算法3.4.1卷积神经网络的基本理论3.4.2卷积神经网络框架设计3.4.3实验及结果分析基于图像的目标检测算法4.1目标检测算法一般流程4.2典型目标检测算
PyTorch 深度学习实战（19）：离线强化学习与 Conservative Q-Learning (CQL) 算法进取星辰 PyTorch 深度学习实战深度学习 pytorch 算法
在上一篇文章中，我们探讨了分布式强化学习与IMPALA算法，展示了如何通过并行化训练提升强化学习的效率。本文将聚焦离线强化学习（OfflineRL）这一新兴方向，并实现ConservativeQ-Learning(CQL)算法，利用Minari提供的静态数据集训练安全的强化学习策略。一、离线强化学习与CQL原理1.离线强化学习的特点无需环境交互：直接从预收集的静态数据集学习数据效率高：复用历史经验
一切皆是映射：DQN训练加速技术：分布式训练与GPU并行 AI天才研究院计算 AI大模型企业级应用开发实战 ChatGPT 计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
1.背景介绍1.1深度强化学习的兴起近年来，深度强化学习（DeepReinforcementLearning，DRL）在游戏、机器人控制、自然语言处理等领域取得了令人瞩目的成就。作为一种结合深度学习和强化学习的强大技术，DRL能够使智能体在与环境交互的过程中学习最优策略，从而实现自主决策和控制。1.2DQN算法及其局限性深度Q网络（DeepQ-Network，DQN）是DRL的一种经典算法，它利用
大规模语言模型从理论到实践分布式训练的集群架构 AI智能涌现深度研究 DeepSeek R1 &大数据AI人工智能 Python入门实战计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
大规模语言模型从理论到实践分布式训练的集群架构作者：禅与计算机程序设计艺术/ZenandtheArtofComputerProgramming1.背景介绍1.1问题的由来随着深度学习技术的飞速发展，大规模语言模型（LargeLanguageModels,LLMs）在自然语言处理（NaturalLanguageProcessing,NLP）领域取得了突破性进展。LLMs，如BERT、GPT-3等，通
图生视频技术的发展与展望：从技术突破到未来图景 Liudef06 Stable Diffusion 音视频人工智能深度学习 stable diffusion
一、技术发展现状图生视频（Image-to-VideoGeneration）是生成式人工智能（AIGC）的重要分支，其核心是通过单张或多张静态图像生成动态视频序列。近年来，随着深度学习、多模态融合和计算硬件的进步，图生视频技术经历了从基础研究到商业落地的快速演进。早期探索与GAN的奠基早期图生视频技术主要基于生成对抗网络（GAN），通过对抗训练生成低分辨率的视频片段。例如，DeepMind的DVD
Moodle + Websoft9：创新教育的强大组合，助力教学与学习开源软件
Moodle+Websoft9：构建未来课堂的技术基石一、Moodle：开源生态的深度解析•模块化设计：支持超800个官方插件，如H5P交互内容创作、BigBlueButton虚拟课堂，满足个性化教学需求。•学习分析引擎：内置LearningAnalyticsAPI，可集成Python/R语言进行深度学习，预测学生学业风险。•移动优先战略：MoodleApp支持离线学习、扫码签到，2023年新增A
书籍-《动手学深度学习（英文版）》
书籍：DiveintoDeepLearning作者：AstonZhang，ZacharyC.Lipton，MuLi，AlexanderJ.Smola出版：CambridgeUniversityPress编辑：陈萍萍的公主@一点人工一点智能下载：书籍下载-《动手学深度学习（英文版）》01书籍介绍深度学习已经彻底改变了模式识别，为计算机视觉、自然语言处理和自动语音识别等领域提供了强大的工具。应用深度学
Matlab基于BP神经网络与NSGA-II的多目标工艺参数优化方法天天酷科研工艺参数优化 matlab 神经网络工艺参数优化
Matlab基于BP神经网络与NSGA-II的多目标工艺参数优化方法一、方法原理与框架BP神经网络的作用BP神经网络通过建立工艺参数与目标性能（如翘曲变形、收缩率、硬度等）之间的非线性映射关系，作为代理模型替代复杂的物理仿真或实验。其优势在于：能够处理多输入-多输出的复杂非线性关系，例如激光功率、扫描速度与熔覆层性能的关联。在注塑成型中，预测体积收缩率和翘曲变形的相对误差可控制在5%以内。通过正交
使用 TensorFlow 进行图像处理：深度解析卷积神经网络（CNN）一碗黄焖鸡三碗米饭人工智能前沿与实践 tensorflow 图像处理 cnn 人工智能机器学习 python ai
目录使用TensorFlow进行图像处理：深度解析卷积神经网络（CNN）1.什么是卷积神经网络（CNN）？CNN的基本结构为什么CNN适合图像处理？2.使用TensorFlow构建CNN2.1环境准备2.2加载并预处理MNIST数据集2.3构建CNN模型2.4编译和训练模型2.5评估模型3.CNN的优化与改进3.1使用数据增强3.2调整网络结构4.CNN在其他图像处理任务中的应用5.总结参考文献在
神经网络之参数初始化硬水果糖人工智能神经网络人工智能深度学习
引言：参数初始化是训练深度神经网络的一个关键步骤，目的是给网络中权重（weights）和偏置（biases）赋予初始值。合适的参数初始化方法有助于提高训练速度、避免梯度消失/爆炸问题，并且加速网络的收敛。一、参数初始化目的避免梯度消失和梯度爆炸：在深度神经网络中，参数初始化对梯度流动非常重要。如果初始权重值太大或太小，可能导致梯度爆炸或梯度消失，从而增加网络的训练难度。加速收敛：良好的初始化可以帮
神经网络基础之正则化硬水果糖人工智能神经网络人工智能机器学习
引言：正则化（Regularization）是机器学习中一种用于防止模型过拟合技术。核心思想是通过在模型损失函数中添加一个惩罚项（PenaltyTerm），对模型的复杂度进行约束，从而提升模型在新数据上的泛化能力。一、正则化目的防止过拟合：当模型过于复杂（例如神经网络层数过多、参数过多）时，容易在训练数据上“记忆”噪声或细节，导致在测试数据上表现差。简化模型：正则化通过限制模型参数的大小或数量，迫
《基于图神经网络的安卓应用检测系统设计与实现》开题报告大数据蟒行探索者毕业论文/研究报告神经网络 android 人工智能机器学习大数据深度学习 python
个人主页：@大数据蟒行探索者目录一、课题的研究目的和意义1.研究目的2.研究意义二、国内(外)研究现状及分析1.国内研究现状2.国外研究现状3.研究分析三、课题主要研究内容及可行性分析1.研究内容2.可行性分析四、研究方案和技术途径1.研究方案2.技术途径五、外部条件及解决办法1.开发环境2.解决办法六、主要参考文献一、课题的研究目的和意义1.研究目的随着智能手机的普及，安卓操作系统成为全球最为广
图像处理篇---图像预处理 Ronin-Lotus 图像处理篇深度学习篇程序代码篇图像处理人工智能 opencv python 深度学习计算机视觉
文章目录前言一、通用目的1.1数据标准化目的实现1.2噪声抑制目的实现高斯滤波中值滤波双边滤波1.3尺寸统一化目的实现1.4数据增强目的实现1.5特征增强目的实现：边缘检测直方图均衡化锐化二、分领域预处理2.1传统机器学习（如SVM、随机森林）2.1.1特点2.1.2预处理重点灰度化二值化形态学操作特征工程2.2深度学习（如CNN、Transformer）2.2.1特点2.2.2预处理重点通道顺序
目前市场上主流的机器视觉的框架有哪些？他们的特点及优劣 yuanpan 机器学习计算机视觉
目前市场上主流的机器视觉框架和工具可以分为商业软件、开源工具和深度学习框架三大类。以下是它们的总结及特点对比：1.商业软件(1)Halcon(MVTec)特点：专注于工业机器视觉，提供高精度、高效率的算法。支持复杂的工业应用，如缺陷检测、3D视觉、深度学习等。提供图形化开发工具HDevelop和多种编程接口。优势：算法优化好，适合实时工业应用。硬件兼容性强，支持多种工业相机和设备。劣势：商业软件，
1.1PaddleTS_环境配置：一个易用的深度时序建模的Python库 pythonQA python paddlepaddle
PaddleTS是一个易用的深度时序建模的Python库，它基于飞桨深度学习框架PaddlePaddle，专注业界领先的深度模型，旨在为领域专家和行业用户提供可扩展的时序建模能力和便捷易用的用户体验。PaddleTS的主要特性包括：设计统一数据结构，实现对多样化时序数据的表达，支持单目标与多目标变量，支持多类型协变量封装基础模型功能，如数据加载、回调设置、损失函数、训练过程控制等公共方法，帮助开发
【大模型科普】AIGC技术发展与应用实践（一文读懂AIGC）人工智能
【专栏介绍】⌈⌈⌈人工智能与大模型应用⌋⌋⌋人工智能（AI）通过算法模拟人类智能，利用机器学习、深度学习等技术驱动医疗、金融等领域的智能化。大模型是千亿参数的深度神经网络（如ChatGPT），经海量数据训练后能完成文本生成、图像创作等复杂任务，显著提升效率，但面临算力消耗、数据偏见等挑战。当前正加速与教育、科研融合，未来需平衡技术创新与伦理风险，推动可持续发展。文章目录一、AIGC概述（一）什么是
代码逐行解析 | 教你在C++中使用深度学习提取特征点 3Ｄ视觉工坊 3D视觉从入门到精通 c++深度学习开发语言人工智能
点击下方卡片，关注「3D视觉工坊」公众号选择星标，干货第一时间送达扫描下方二维码，加入3D视觉技术星球，星球内汇集了众多3D视觉实战问题，以及各个模块的学习资料：最新顶会论文、书籍、源码、视频（近20门系统课程[星球成员可免费学习]）等。想要入门3D视觉、做项目、搞科研，就加入我们吧。作者：泡椒味的口香糖|来源：3DCV添加微信：dddvision
深度学习-130-RAG技术之基于Anything LLM搭建本地私人知识库的应用策略问题总结(一) 皮皮冰燃深度学习深度学习人工智能 RAG
文章目录1AnythingLLM的本地知识库1.1本地知识库应用场景1.2效果对比及思考1.3本地体现在哪些方面1.3.1知识在本地1.3.2分割后的文档在本地1.3.3大模型部署运行在本地2问错问题带来的问题2.1常见的问题2.2原因分析3为什么LLM不使用我的文件？3.1LLM不是万能的【omnipotent】3.2LLM不会自省【introspect】3.3AnythingLLM是如何工作的
web前段跨域nginx代理配置刘正强 nginx cms Web
nginx代理配置可参考server部分 server { listen 80; server_name localhost;
spring学习笔记 caoyong spring
一、概述 a>、核心技术 : IOC与AOP b>、开发为什么需要面向接口而不是实现接口降低一个组件与整个系统的藕合程度，当该组件不满足系统需求时，可以很容易的将该组件从系统中替换掉，而不会对整个系统产生大的影响 c>、面向接口编口编程的难点在于如何对接口进行初始化,(使用工厂设计模式)
Eclipse打开workspace提示工作空间不可用 0624chenhong eclipse
做项目的时候，难免会用到整个团队的代码，或者上一任同事创建的workspace， 1.电脑切换账号后，Eclipse打开时，会提示Eclipse对应的目录锁定，无法访问，根据提示，找到对应目录，G:\eclipse\configuration\org.eclipse.osgi\.manager，其中文件.fileTableLock提示被锁定。解决办法，删掉.fileTableLock文件，重
Javascript 面向对面写法的必要性？一炮送你回车库 JavaScript
现在Javascript面向对象的方式来写页面很流行，什么纯javascript的mvc框架都出来了：ember 这是javascript层的mvc框架哦,不是j2ee的mvc框架我想说的是，javascript本来就不是一门面向对象的语言，用它写出来的面向对象的程序，本身就有些别扭，很多人提到js的面向对象首先提的是：复用性。那么我请问你写的js里有多少是可以复用的，用fu
js array对象的迭代方法换个号韩国红果果 array
1.forEach 该方法接受一个函数作为参数，对数组中的每个元素使用该函数 return 语句失效 function square(num) { print(num, num * num); } var nums = [1,2,3,4,5,6,7,8,9,10]; nums.forEach(square); 2.every 该方法接受一个返回值为布尔类型
对Hibernate缓存机制的理解归来朝歌 session 一级缓存对象持久化
在hibernate中session一级缓存机制中，有这么一种情况：问题描述：我需要new一个对象，对它的几个字段赋值，但是有一些属性并没有进行赋值，然后调用 session.save()方法，在提交事务后，会出现这样的情况： 1：在数据库中有默认属性的字段的值为空 2：既然是持久化对象，为什么在最后对象拿不到默认属性的值？通过调试后解决方案如下：对于问题一，如你在数据库里设置了
WebService调用错误合集 darkranger webservice
Java.Lang.NoClassDefFoundError: Org/Apache/Commons/Discovery/Tools/DiscoverSingleton 调用接口出错，一个简单的WebService import org.apache.axis.client.Call;import org.apache.axis.client.Service; 首先必不可
JSP和Servlet的中文乱码处理 aijuans Java Web
JSP和Servlet的中文乱码处理前几天学习了JSP和Servlet中有关中文乱码的一些问题，写成了博客，今天进行更新一下。应该是可以解决日常的乱码问题了。现在作以下总结希望对需要的人有所帮助。我也是刚学，所以有不足之处希望谅解。一、表单提交时出现乱码：在进行表单提交的时候，经常提交一些中文，自然就避免不了出现中文乱码的情况，对于表单来说有两种提交方式：get和post提交方式。所以
面试经典六问 atongyeye 工作面试
题记：因为我不善沟通，所以在面试中经常碰壁，看了网上太多面试宝典，基本上不太靠谱。只好自己总结，并试着根据最近工作情况完成个人答案。以备不时之需。以下是人事了解应聘者情况的最典型的六个问题： 1 简单自我介绍关于这个问题，主要为了弄清两件事，一是了解应聘者的背景，二是应聘者将这些背景信息组织成合适语言的能力。我的回答：(针对技术面试回答，如果是人事面试，可以就掌
contentResolver.query()参数详解百合不是茶 android query()详解
收藏csdn的博客,介绍的比较详细,新手值得一看 1.获取联系人姓名一个简单的例子，这个函数获取设备上所有的联系人ID和联系人NAME。 [java] view plain copy public void fetchAllContacts() {
ora-00054:resource busy and acquire with nowait specified解决方法 bijian1013 oracle 数据库 kill nowait
当某个数据库用户在数据库中插入、更新、删除一个表的数据，或者增加一个表的主键时或者表的索引时，常常会出现ora-00054:resource busy and acquire with nowait specified这样的错误。主要是因为有事务正在执行（或者事务已经被锁），所有导致执行不成功。 1.下面的语句
web 开发乱码征客丶 spring Web
以下前端都是 utf-8 字符集编码一、后台接收 1.1、 get 请求乱码 get 请求中，请求参数在请求头中；乱码解决方法： a、通过在web 服务器中配置编码格式：tomcat 中，在 Connector 中添加URIEncoding="UTF-8"； 1.2、post 请求乱码 post 请求中，请求参数分两部份， 1.2.1、url？参数，
【Spark十六】： Spark SQL第二部分数据源和注册表的几种方式 bit1129 spark
Spark SQL数据源和表的Schema case class apply schema parquet json JSON数据源准备源数据 {"name":"Jack", "age": 12, "addr":{"city":"beijing&
JVM学习之:调优总结 -Xms -Xmx -Xmn -Xss BlueSkator -Xss -Xmn -Xms -Xmx
堆大小设置JVM 中最大堆大小有三方面限制：相关操作系统的数据模型（32-bt还是64-bit）限制；系统的可用虚拟内存限制；系统的可用物理内存限制。32位系统下，一般限制在1.5G~2G；64为操作系统对内存无限制。我在Windows Server 2003 系统，3.5G物理内存，JDK5.0下测试，最大可设置为1478m。典型设置： java -Xmx355
jqGrid 各种参数详解(转帖) BreakingBad jqGrid
jqGrid 各种参数详解分类：源代码分享个人随笔请勿参考解决开发问题 2012-05-09 20:29 84282人阅读评论(22) 收藏举报 jquery 服务器 parameters function ajax string
读《研磨设计模式》-代码笔记-代理模式-Proxy bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ import java.lang.reflect.InvocationHandler; import java.lang.reflect.Method; import java.lang.reflect.Proxy; /* * 下面
应用升级iOS8中遇到的一些问题 chenhbc ios8 升级iOS8
1、很奇怪的问题，登录界面，有一个判断，如果不存在某个值，则跳转到设置界面，ios8之前的系统都可以正常跳转，iOS8中代码已经执行到下一个界面了，但界面并没有跳转过去，而且这个值如果设置过的话，也是可以正常跳转过去的，这个问题纠结了两天多，之前的判断我是在 -(void)viewWillAppear:(BOOL)animated 中写的，最终的解决办法是把判断写在 -(void
工作流与自组织的关系？ comsci 设计模式工作
目前的工作流系统中的节点及其相互之间的连接是事先根据管理的实际需要而绘制好的，这种固定的模式在实际的运用中会受到很多限制，特别是节点之间的依存关系是固定的，节点的处理不考虑到流程整体的运行情况，细节和整体间的关系是脱节的，那么我们提出一个新的观点，一个流程是否可以通过节点的自组织运动来自动生成呢？这种流程有什么实际意义呢？这里有篇论文，摘要是：“针对网格中的服务
Oracle11.2新特性之INSERT提示IGNORE_ROW_ON_DUPKEY_INDEX daizj oracle
insert提示IGNORE_ROW_ON_DUPKEY_INDEX 转自：http://space.itpub.net/18922393/viewspace-752123 在 insert into tablea ...select * from tableb中，如果存在唯一约束，会导致整个insert操作失败。使用IGNORE_ROW_ON_DUPKEY_INDEX提示，会忽略唯一
二叉树:堆 dieslrae 二叉树
这里说的堆其实是一个完全二叉树,每个节点都不小于自己的子节点,不要跟jvm的堆搞混了.由于是完全二叉树,可以用数组来构建.用数组构建树的规则很简单: 一个节点的父节点下标为: (当前下标 - 1)/2 一个节点的左节点下标为: 当前下标 * 2 + 1 &
C语言学习八结构体 dcj3sjt126com c
为什么需要结构体，看代码 # include <stdio.h> struct Student //定义一个学生类型，里面有age, score, sex, 然后可以定义这个类型的变量 { int age; float score; char sex; } int main(void) { struct Student st = {80, 66.6,
centos安装golang dcj3sjt126com centos
#在国内镜像下载二进制包 wget -c http://www.golangtc.com/static/go/go1.4.1.linux-amd64.tar.gz tar -C /usr/local -xzf go1.4.1.linux-amd64.tar.gz #把golang的bin目录加入全局环境变量 cat >>/etc/profile<
10.性能优化-监控-MySQL慢查询 frank1234 性能优化 MySQL慢查询
1.记录慢查询配置 show variables where variable_name like 'slow%' ; --查看默认日志路径查询结果：--不用的机器可能不同 slow_query_log_file=/var/lib/mysql/centos-slow.log 修改mysqld配置文件：/usr /my.cnf[一般在/etc/my.cnf，本机在/user/my.cn
Java父类取得子类类名 happyqing java this 父类子类类名
在继承关系中，不管父类还是子类，这些类里面的this都代表了最终new出来的那个类的实例对象，所以在父类中你可以用this获取到子类的信息！ package com.urthinker.module.test; import org.junit.Test; abstract class BaseDao<T> { public void
Spring3.2新注解@ControllerAdvice jinnianshilongnian @Controller
@ControllerAdvice，是spring3.2提供的新注解，从名字上可以看出大体意思是控制器增强。让我们先看看@ControllerAdvice的实现： @Target(ElementType.TYPE) @Retention(RetentionPolicy.RUNTIME) @Documented @Component public @interface Co
Java spring mvc多数据源配置 liuxihope spring
转自：http://www.itpub.net/thread-1906608-1-1.html 1、首先配置两个数据库 <bean id="dataSourceA" class="org.apache.commons.dbcp.BasicDataSource" destroy-method="close&quo
第12章 Ajax（下） onestopweb Ajax
index.html <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/
BW / Universe Mappings blueoxygen BO
BW Element OLAP Universe Element Cube Dimension Class Charateristic A class with dimension and detail objects (Detail objects for key and desription) Hi
Java开发熟手该当心的11个错误 tomcat_oracle java 多线程工作单元测试
#1、不在属性文件或XML文件中外化配置属性。比如，没有把批处理使用的线程数设置成可在属性文件中配置。你的批处理程序无论在DEV环境中，还是UAT（用户验收测试）环境中，都可以顺畅无阻地运行，但是一旦部署在PROD 上，把它作为多线程程序处理更大的数据集时，就会抛出IOException，原因可能是JDBC驱动版本不同，也可能是#2中讨论的问题。如果线程数目可以在属性文件中配置，那么使它成为
推行国产操作系统的优劣 yananay windows linux 国产操作系统
最近刮起了一股风，就是去“国外货”。从应用程序开始，到基础的系统，数据库，现在已经刮到操作系统了。原因就是“棱镜计划”，使我们终于认识到了国外货的危害，开始重视起了信息安全。操作系统是计算机的灵魂。既然是灵魂，为了信息安全，那我们就自然要使用和推行国货。可是，一味地推行，是否就一定正确呢？先说说信息安全。其实从很早以来大家就在讨论信息安全。很多年以前，就据传某世界级的网络设备制造商生产的交