← All conferences

ICCV 2017 Accepted Papers

The full list of 621 papers accepted at ICCV 2017 (IEEE/CVF International Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Poster: 520Spotlight: 56Oral: 45
  1. Mask R-CNNOral43,311 citations
  2. Focal Loss for Dense Object DetectionOral38,703 citations
  3. Unpaired Image-To-Image Translation Using Cycle-Consistent Adversarial NetworksSpotlight27,623 citations
  4. Grad-CAM: Visual Explanations From Deep Networks via Gradient-Based LocalizationPoster24,144 citations
  5. Deformable Convolutional NetworksOral7,573 citations
  6. Least Squares Generative Adversarial NetworksPoster6,527 citations
  7. Arbitrary Style Transfer in Real-Time With Adaptive Instance NormalizationOral5,672 citations
  8. StackGAN: Text to Photo-Realistic Image Synthesis With Stacked Generative Adversarial NetworksOral3,996 citations
  9. Revisiting Unreasonable Effectiveness of Data in Deep Learning EraSpotlight3,433 citations
  10. Learning Efficient Convolutional Networks Through Network SlimmingPoster3,354 citations
  11. Channel Pruning for Accelerating Very Deep Neural NetworksPoster3,345 citations
  12. DualGAN: Unsupervised Dual Learning for Image-To-Image TranslationPoster2,770 citations
  13. Soft-NMS -- Improving Object Detection With One Line of CodePoster2,622 citations
  14. Unlabeled Samples Generated by GAN Improve the Person Re-Identification Baseline in VitroSpotlight2,486 citations
  15. AOD-Net: All-In-One Dehazing NetworkPoster2,408 citations
  16. RMPE: Regional Multi-Person Pose EstimationPoster2,405 citations
  17. ThiNet: A Filter Level Pruning Method for Deep Neural Network CompressionPoster2,395 citations
  18. Learning Spatio-Temporal Representation With Pseudo-3D Residual NetworksPoster2,294 citations
  19. MemNet: A Persistent Memory Network for Image RestorationSpotlight2,081 citations
  20. Interpretable Explanations of Black Boxes by Meaningful PerturbationPoster2,028 citations
  21. How Far Are We From Solving the 2D & 3D Face Alignment Problem? (And a Dataset of 230,000 3D Facial Landmarks)Poster1,952 citations
  22. Structure-Measure: A New Way to Evaluate Foreground MapsSpotlight1,925 citations
  23. A Simple yet Effective Baseline for 3D Human Pose EstimationPoster1,880 citations
  24. The "Something Something" Video Database for Learning and Evaluating Visual Common SensePoster1,878 citations
  25. Deeper, Broader and Artier Domain GeneralizationPoster1,827 citations
  26. The Mapillary Vistas Dataset for Semantic Understanding of Street ScenesPoster1,677 citations
  27. End-To-End Learning of Geometry and Context for Deep Stereo RegressionSpotlight1,619 citations
  28. Image Super-Resolution Using Dense Skip ConnectionsPoster1,619 citations
  29. Dense-Captioning Events in VideosPoster1,605 citations
  30. Learning Background-Aware Correlation Filters for Visual TrackingPoster1,441 citations
  31. SSD-6D: Making RGB-Based 3D Detection and 6D Pose Estimation Great AgainOral1,284 citations
  32. Escape From Cells: Deep Kd-Networks for the Recognition of 3D Point Cloud ModelsSpotlight1,268 citations
  33. EnhanceNet: Single Image Super-Resolution Through Automated Texture SynthesisOral1,263 citations
  34. Adversarial Examples for Semantic Segmentation and Object DetectionPoster1,248 citations
  35. Genetic CNNPoster1,186 citations
  36. Sampling Matters in Deep Embedding LearningPoster1,169 citations
  37. Photographic Image Synthesis With Cascaded Refinement NetworksOral1,168 citations
  38. Learning Multi-Attention Convolutional Neural Network for Fine-Grained Image RecognitionOral1,166 citations
  39. Localizing Moments in Video With Natural LanguagePoster1,155 citations
  40. Look, Listen and LearnPoster1,154 citations
  41. Temporal Action Detection With Structured Segment NetworksPoster1,154 citations
  42. Unified Deep Supervised Domain Adaptation and GeneralizationPoster1,065 citations
  43. Learning Dynamic Siamese Network for Visual Object TrackingPoster1,046 citations
  44. BB8: A Scalable, Accurate, Robust to Partial Occlusion Method for Predicting the 3D Poses of Challenging Objects Without Using DepthPoster1,036 citations
  45. Amulet: Aggregating Multi-Level Convolutional Features for Salient Object DetectionPoster1,024 citations
  46. Large-Scale Image Retrieval With Attentive Deep Local FeaturesPoster1,017 citations
  47. Pose-Driven Deep Convolutional Model for Person Re-IdentificationPoster999 citations
  48. TALL: Temporal Activity Localization via Language QuerySpotlight984 citations
  49. Low-Shot Visual Recognition by Shrinking and Hallucinating FeaturesSpotlight982 citations
  50. A Revisit of Sparse Coding Based Anomaly Detection in Stacked RNN FrameworkPoster979 citations
  51. SVDNet for Pedestrian RetrievalSpotlight974 citations
  52. R-C3D: Region Convolutional 3D Network for Temporal Activity DetectionPoster960 citations
  53. Deeply-Learned Part-Aligned Representations for Person Re-IdentificationPoster951 citations
  54. Learning to Estimate 3D Hand Pose From Single RGB ImagesPoster939 citations
  55. Video Frame Synthesis Using Deep Voxel FlowOral937 citations
  56. Octree Generating Networks: Efficient Convolutional Architectures for High-Resolution 3D OutputsPoster925 citations
  57. RGB-Infrared Cross-Modality Person Re-IdentificationPoster896 citations
  58. S3FD: Single Shot Scale-Invariant Face DetectorPoster887 citations
  59. Multi-Modal Factorized Bilinear Pooling With Co-Attention Learning for Visual Question AnsweringPoster885 citations
  60. HashNet: Deep Learning to Hash by ContinuationPoster876 citations
  61. Hide-And-Seek: Forcing a Network to Be Meticulous for Weakly-Supervised Object and Action LocalizationPoster876 citations
  62. Video Frame Interpolation via Adaptive Separable ConvolutionPoster876 citations
  63. Flow-Guided Feature Aggregation for Video Object DetectionPoster867 citations
  64. Boosting Image Captioning With AttributesPoster865 citations
  65. Beyond Face Rotation: Global and Local Perception GAN for Photorealistic and Identity Preserving Frontal View SynthesisPoster849 citations
  66. Cut, Paste and Learn: Surprisingly Easy Synthesis for Instance DetectionPoster831 citations
  67. Multi-Task Self-Supervised Visual LearningPoster829 citations
  68. No Fuss Distance Metric Learning Using ProxiesPoster827 citations
  69. MUTAN: Multimodal Tucker Fusion for Visual Question AnsweringPoster824 citations
  70. DeepFuse: A Deep Unsupervised Approach for Exposure Fusion With Extreme Exposure Image PairsPoster823 citations
  71. DSOD: Learning Deeply Supervised Object Detectors From ScratchPoster820 citations
  72. Generating High-Quality Crowd Density Maps Using Contextual Pyramid CNNsPoster818 citations
  73. Towards Diverse and Natural Image Descriptions via a Conditional GANOral804 citations
  74. PanNet: A Deep Network Architecture for Pan-SharpeningPoster800 citations
  75. CVAE-GAN: Fine-Grained Image Generation Through Asymmetric TrainingPoster766 citations
  76. Detect to Track and Track to DetectSpotlight751 citations
  77. Temporal Generative Adversarial Nets With Singular Value ClippingPoster749 citations
  78. Towards 3D Human Pose Estimation in the Wild: A Weakly-Supervised ApproachPoster749 citations
  79. Open Set Domain AdaptationOral744 citations
  80. Learning to Reason: End-To-End Module Networks for Visual Question AnsweringSpotlight742 citations
  81. Tracking the Untrackable: Learning to Track Multiple Cues With Long-Term DependenciesPoster721 citations
  82. Learning From Noisy Labels With DistillationPoster718 citations
  83. Deep Clustering via Joint Convolutional Autoencoder Embedding and Relative Entropy MinimizationPoster713 citations
  84. DSLR-Quality Photos on Mobile Devices With Deep Convolutional NetworksPoster693 citations
  85. MoFA: Model-Based Deep Convolutional Face Autoencoder for Unsupervised Monocular ReconstructionOral688 citations
  86. Deep Adaptive Image ClusteringOral686 citations
  87. Incremental Learning of Object Detectors Without Catastrophic ForgettingPoster685 citations
  88. Unsupervised Representation Learning by Sorting SequencesPoster685 citations
  89. Deep Metric Learning With Angular LossPoster684 citations
  90. View Adaptive Recurrent Neural Networks for High Performance Human Action Recognition From Skeleton DataPoster683 citations
  91. Inferring and Executing Programs for Visual ReasoningOral677 citations
  92. HydraPlus-Net: Attentive Deep Features for Pedestrian AnalysisPoster674 citations
  93. Compositional Human Pose RegressionPoster660 citations
  94. Image-Based Localization Using LSTMs for Structured Feature CorrelationPoster658 citations
  95. CREST: Convolutional Residual Learning for Visual TrackingPoster652 citations
  96. Learning Feature Pyramids for Human Pose EstimationPoster645 citations
  97. Detail-Revealing Deep Video Super-ResolutionOral640 citations
  98. Scene Graph Generation From Objects, Phrases and Region CaptionsPoster633 citations
  99. Focusing Attention: Towards Accurate Text Recognition in Natural ImagesPoster626 citations
  100. SSH: Single Stage Headless Face DetectorPoster620 citations
  101. 3D Graph Neural Networks for RGBD Semantic SegmentationOral605 citations
  102. Curriculum Domain Adaptation for Semantic Segmentation of Urban ScenesPoster598 citations
  103. Playing for BenchmarksSpotlight594 citations
  104. RankIQA: Learning From Rankings for No-Reference Image Quality AssessmentPoster591 citations
  105. Semi Supervised Semantic Segmentation Using Generative Adversarial NetworkPoster589 citations
  106. DeepRoadMapper: Extracting Road Topology From Aerial ImagesPoster579 citations
  107. Large Pose 3D Face Reconstruction From a Single Image via Direct Volumetric CNN RegressionPoster579 citations
  108. Improved Image Captioning via Policy Gradient Optimization of SPIDErSpotlight577 citations
  109. Fast Face-Swap Using Convolutional Neural NetworksPoster573 citations
  110. Need for Speed: A Benchmark for Higher Frame Rate Object TrackingPoster570 citations
  111. TURN TAP: Temporal Unit Regression Network for Temporal Action ProposalsPoster567 citations
  112. VPGNet: Vanishing Point Guided Network for Lane and Road Marking Detection and RecognitionPoster556 citations
  113. SegFlow: Joint Learning for Video Object Segmentation and Optical FlowPoster554 citations
  114. Learning Uncertain Convolutional Features for Accurate Saliency DetectionPoster549 citations
  115. SafetyNet: Detecting and Rejecting Adversarial Examples RobustlyPoster549 citations
  116. Wavelet-SRNet: A Wavelet-Based CNN for Multi-Scale Face Super ResolutionPoster540 citations
  117. Drone-Based Object Counting by Spatially Regularized Regional Proposal NetworkPoster535 citations
  118. A Stagewise Refinement Model for Detecting Salient Objects in ImagesPoster521 citations
  119. Adversarial Examples Detection in Deep Networks With Convolutional Filter StatisticsPoster512 citations
  120. Range Loss for Deep Face Recognition With Long-Tailed Training DataPoster512 citations
  121. Ensemble Deep Learning for Skeleton-Based Action Recognition Using Temporal Sliding LSTM NetworksPoster506 citations
  122. SurfaceNet: An End-To-End 3D Neural Network for Multiview StereopsisPoster496 citations
  123. Learning Cooperative Visual Dialog Agents With Deep Reinforcement LearningOral493 citations
  124. Online Multi-Object Tracking Using CNN-Based Single Object Tracker With Spatial-Temporal Attention MechanismPoster486 citations
  125. Interpretable Learning for Self-Driving Cars by Visualizing Causal AttentionPoster478 citations
  126. Stereo DSO: Large-Scale Direct Sparse Visual Odometry With Stereo CamerasPoster473 citations
  127. Attention-Based Multimodal Fusion for Video DescriptionPoster469 citations
  128. Dual Motion GAN for Future-Flow Embedded Video PredictionPoster464 citations
  129. Deep Direct Regression for Multi-Oriented Scene Text DetectionPoster462 citations
  130. Adversarial PoseNet: A Structure-Aware Convolutional Network for Human Pose EstimationPoster461 citations
  131. Orientation Invariant Feature Embedding and Spatial Temporal Regularization for Vehicle Re-IdentificationPoster458 citations
  132. Tube Convolutional Neural Network (T-CNN) for Action Detection in VideosPoster456 citations
  133. Learning Proximal Operators: Using Denoising Networks for Regularizing Inverse Imaging ProblemsPoster443 citations
  134. Fast Image Processing With Fully-Convolutional NetworksPoster441 citations
  135. The Pose Knows: Video Forecasting by Generating Pose FuturesPoster439 citations
  136. Action Tubelet Detector for Spatio-Temporal Action LocalizationPoster437 citations
  137. Encoder Based Lifelong LearningPoster437 citations
  138. Representation Learning by Learning to CountOral430 citations
  139. Towards Large-Pose Face Frontalization in the WildPoster430 citations
  140. Colored Point Cloud Registration RevisitedPoster428 citations
  141. SubUNets: End-To-End Hand Shape and Continuous Sign Language RecognitionSpotlight420 citations
  142. Interleaved Group ConvolutionsPoster417 citations
  143. Jointly Attentive Spatial-Temporal Pooling Networks for Video-Based Person Re-IdentificationPoster411 citations
  144. No More Discrimination: Cross City Adaptation of Road Scene SegmentersPoster410 citations
  145. One Network to Solve Them All -- Solving Linear Inverse Problems Using Deep Projection ModelsOral410 citations
  146. Real-Time Hand Tracking Under Occlusion From an Egocentric RGB-D SensorPoster409 citations
  147. Smart Mining for Deep Metric LearningPoster409 citations
  148. AutoDIAL: Automatic DomaIn Alignment LayersPoster398 citations
  149. Unmasking the Abnormal Events in VideoPoster398 citations
  150. Cross-View Asymmetric Metric Learning for Unsupervised Person Re-IdentificationPoster397 citations
  151. Single Shot Text Detector With Regional AttentionSpotlight397 citations
  152. Visual Relationship Detection With Internal and External Linguistic Knowledge DistillationPoster397 citations
  153. Learning Video Object Segmentation With Visual MemoryOral395 citations
  154. Multi-Label Image Recognition by Recurrently Discovering Attentional RegionsPoster394 citations
  155. RDFNet: RGB-D Multi-Level Residual Feature Fusion for Indoor Semantic SegmentationPoster389 citations
  156. Learning Deep Neural Networks for Vehicle Re-ID With Visual-Spatio-Temporal Path ProposalsPoster384 citations
  157. Online Real-Time Multiple Spatiotemporal Action Localisation and PredictionPoster384 citations
  158. Universal Adversarial Perturbations Against Semantic Image SegmentationPoster380 citations
  159. A Generic Deep Architecture for Single Image Reflection Removal and Image SmoothingPoster379 citations
  160. Multi-Scale Deep Learning Architectures for Person Re-IdentificationPoster376 citations
  161. Understanding Low- and High-Level Contributions to Fixation PredictionPoster374 citations
  162. Joint Bi-Layer Optimization for Single-Image Rain Streak RemovalPoster373 citations
  163. High-Resolution Shape Completion Using Deep Neural Networks for Global Structure and Local Geometry InferenceSpotlight367 citations
  164. SceneNet RGB-D: Can 5M Synthetic Images Beat Generic ImageNet Pre-Training on Indoor Segmentation?Poster362 citations
  165. Hard-Aware Deeply Cascaded EmbeddingSpotlight360 citations
  166. Multi-Channel Weighted Nuclear Norm Minimization for Real Color Image DenoisingPoster359 citations
  167. Is Second-Order Information Helpful for Large-Scale Visual Recognition?Poster353 citations
  168. CoupleNet: Coupling Global Structure With Local Parts for Object DetectionPoster352 citations
  169. Parallel Tracking and Verifying: A Framework for Real-Time and High Accuracy Visual TrackingPoster352 citations
  170. Be Your Own Prada: Fashion Synthesis With Structural CoherencePoster346 citations
  171. Deep Functional Maps: Structured Prediction for Dense Shape CorrespondencePoster345 citations
  172. A Two Stream Siamese Convolutional Neural Network for Person Re-IdentificationPoster344 citations
  173. SGN: Sequential Grouping Networks for Instance SegmentationPoster344 citations
  174. Coherent Online Video Style TransferPoster338 citations
  175. Illuminating Pedestrians via Simultaneous Detection & SegmentationPoster331 citations
  176. Semantic Image Synthesis via Adversarial LearningPoster331 citations
  177. Extreme Clicking for Efficient Object AnnotationPoster330 citations
  178. Learning to Fuse 2D and 3D Image Cues for Monocular Body Pose EstimationPoster327 citations
  179. Pixel Recursive Super ResolutionPoster326 citations
  180. A Joint Intrinsic-Extrinsic Prior Model for RetinexPoster325 citations
  181. Rotation Equivariant Vector Field NetworksPoster323 citations
  182. PolyFit: Polygonal Surface Reconstruction From Point CloudsPoster322 citations
  183. Deep Spatial-Semantic Attention for Fine-Grained Sketch-Based Image RetrievalPoster318 citations
  184. Temporal Context Network for Activity Localization in VideosPoster318 citations
  185. Infinite Latent Feature Selection: A Probabilistic Latent Graph-Based Ranking ApproachPoster317 citations
  186. Identity-Aware Textual-Visual Matching With Latent Co-AttentionPoster315 citations
  187. Unrestricted Facial Geometry Reconstruction Using Image-To-Image TranslationPoster315 citations
  188. Associative Domain AdaptationPoster313 citations
  189. Raster-To-Vector: Revisiting Floorplan TransformationPoster313 citations
  190. Speaking the Same Language: Matching Machine to Human Captions by Adversarial TrainingPoster311 citations
  191. Automatic Spatially-Aware Fashion Concept DiscoveryPoster310 citations
  192. Deep TextSpotter: An End-To-End Trainable Scene Text Localization and Recognition FrameworkPoster309 citations
  193. An Analysis of Visual Question Answering AlgorithmsPoster297 citations
  194. Learning to Synthesize a 4D RGBD Light Field From a Single ImageSpotlight297 citations
  195. BIER - Boosting Independent Embeddings RobustlyOral296 citations
  196. Recurrent Multimodal Interaction for Referring Image SegmentationPoster296 citations
  197. Joint Detection and Recounting of Abnormal Events by Learning Deep Generic KnowledgePoster295 citations
  198. A Two-Streamed Network for Estimating Fine-Scaled Depth Maps From Single RGB ImagesPoster294 citations
  199. Robust Video Super-Resolution With Learned Temporal DynamicsPoster289 citations
  200. A Generative Model of People in ClothingSpotlight288 citations
  201. Exploiting Spatial Structure for Localizing Manipulated Image RegionsPoster288 citations
  202. Learning Policies for Adaptive Tracking With Deep Feature CascadesSpotlight282 citations
  203. Semantic Video CNNs Through Representation WarpingOral280 citations
  204. Binarized Convolutional Landmark Localizers for Human Pose Estimation and Face Alignment With Limited ResourcesOral279 citations
  205. Learning to Super-Resolve Blurry Face and Text ImagesPoster279 citations
  206. Predicting Deeper Into the Future of Semantic SegmentationPoster278 citations
  207. Chained Multi-Stream Networks Exploiting Pose, Motion, and Appearance for Action Classification and DetectionPoster277 citations
  208. FCN-rLSTM: Deep Spatio-Temporal Neural Networks for Vehicle Counting in City CamerasPoster272 citations
  209. Towards End-To-End Text Spotting With Convolutional Recurrent Neural NetworksSpotlight270 citations
  210. Areas of Attention for Image CaptioningPoster267 citations
  211. 3D-PRNN: Generating Shape Primitives With Recurrent Neural NetworksPoster265 citations
  212. Class Rectification Hard Mining for Imbalanced Deep LearningPoster265 citations
  213. BlitzNet: A Real-Time Deep Network for Scene UnderstandingPoster264 citations
  214. Recurrent Topic-Transition GAN for Visual Paragraph GenerationPoster264 citations
  215. Joint Convolutional Analysis and Synthesis Sparse Representation for Single Image Layer SeparationPoster258 citations
  216. Spatiotemporal Modeling for Crowd Counting in VideosPoster258 citations
  217. Deep Generative Adversarial Compression Artifact RemovalPoster257 citations
  218. Learning Compact Geometric FeaturesPoster252 citations
  219. Weakly-Supervised Learning of Visual RelationsOral250 citations
  220. WordSup: Exploiting Word Annotations for Character Based Text DetectionPoster250 citations
  221. Factorized Bilinear Models for Image RecognitionPoster248 citations
  222. Shadow Detection With Conditional Generative Adversarial NetworksOral245 citations
  223. Higher-Order Integration of Hierarchical Convolutional Activations for Fine-Grained Visual CategorizationPoster240 citations
  224. Long Short-Term Memory Kalman Filters: Recurrent Neural Estimators for Pose RegularizationPoster237 citations
  225. Learning in an Uncertain World: Representing Ambiguity Through Multiple HypothesesPoster235 citations
  226. Fashion Forward: Forecasting Visual Style in FashionPoster234 citations
  227. A Coarse-Fine Network for Keypoint LocalizationSpotlight232 citations
  228. Lattice Long Short-Term Memory for Human Action RecognitionPoster232 citations
  229. Phrase Localization and Visual Relationship Detection With Comprehensive Image-Language CuesPoster230 citations
  230. RPAN: An End-To-End Recurrent Pose-Attention Network for Action Recognition in VideosOral229 citations
  231. 2D-Driven 3D Object Detection in RGB-D ImagesPoster226 citations
  232. Attention-Aware Deep Reinforcement Learning for Video Face RecognitionPoster226 citations
  233. Efficient Low Rank Tensor Ring CompletionPoster226 citations
  234. Neural Person Search MachinesPoster226 citations
  235. Dynamic Label Graph Matching for Unsupervised Video Re-IdentificationPoster224 citations
  236. Pixel-Level Matching for Video Object Segmentation Using Convolutional Neural NetworksPoster219 citations
  237. Predicting Visual Exemplars of Unseen Classes for Zero-Shot LearningPoster219 citations
  238. Scale-Adaptive Convolutions for Scene ParsingPoster218 citations
  239. TorontoCity: Seeing the World With a Million EyesSpotlight217 citations
  240. Transitive Invariance for Self-Supervised Visual Representation LearningPoster216 citations
  241. RoomNet: End-To-End Room Layout EstimationPoster215 citations
  242. Scaling the Scattering Transform: Deep Hybrid NetworksPoster214 citations
  243. Shape Inpainting Using 3D Generative Adversarial Network and Recurrent Convolutional NetworksPoster214 citations
  244. Encouraging LSTMs to Anticipate Actions Very EarlyPoster212 citations
  245. Towards More Accurate Iris Recognition Using Deeply Learned Spatially Corresponding FeaturesSpotlight212 citations
  246. Benchmarking and Error Diagnosis in Multi-Instance Pose EstimationPoster211 citations
  247. Stepwise Metric Promotion for Unsupervised Video Person Re-IdentificationPoster210 citations
  248. Learning Robust Visual-Semantic EmbeddingsPoster209 citations
  249. Benchmarking Single-Image Reflection Removal AlgorithmsPoster208 citations
  250. Spatial Memory for Context Reasoning in Object DetectionPoster204 citations
  251. BodyFusion: Real-Time Capture of Human Motion and Surface Geometry Using a Single Depth CameraPoster200 citations
  252. Towards Context-Aware Interaction Recognition for Visual Relationship DetectionPoster199 citations
  253. Fine-Grained Recognition in the Wild: A Multi-Task Domain Adaptation ApproachPoster197 citations
  254. Online Video Deblurring via Dynamic Temporal Blending NetworkPoster197 citations
  255. Efficient Global 2D-3D Matching for Camera Localization in a Large-Scale 3D MapPoster195 citations
  256. Hierarchical Multimodal LSTM for Dense Visual-Semantic EmbeddingPoster195 citations
  257. Towards a Visual Privacy Advisor: Understanding and Predicting Privacy Risks in ImagesPoster194 citations
  258. Turning Corners Into Cameras: Principles and MethodsSpotlight194 citations
  259. BAM! The Behance Artistic Media Dataset for Recognition Beyond PhotographyPoster191 citations
  260. Bounding Boxes, Segmentations and Object Coordinates: How Important Is Recognition for 3D Scene Flow Estimation in Autonomous Driving Scenarios?Poster189 citations
  261. Reconstruction-Based Disentanglement for Pose-Invariant Face RecognitionPoster189 citations
  262. Coordinating Filters for Faster Deep Neural NetworksPoster188 citations
  263. Segmentation-Aware Convolutional Networks Using Local Attention MasksPoster188 citations
  264. Regional Interactive Image Segmentation NetworksPoster187 citations
  265. Learning Visual Attention to Identify People With Autism Spectrum DisorderPoster186 citations
  266. Supervision by Fusion: Towards Unsupervised Learning of Deep Salient Object DetectorPoster186 citations
  267. Learning a Recurrent Residual Fusion Network for Multimodal MatchingPoster184 citations
  268. Adversarial Image Perturbation for Privacy Protection -- A Game Theory PerspectivePoster183 citations
  269. Show, Adapt and Tell: Adversarial Training of Cross-Domain Image CaptionerPoster183 citations
  270. Two-Phase Learning for Weakly Supervised Object LocalizationPoster183 citations
  271. Attribute Recognition by Joint Recurrent Learning of Context and CorrelationPoster181 citations
  272. Learning Blind Motion DeblurringPoster181 citations
  273. Soft Proposal Networks for Weakly Supervised Object LocalizationPoster181 citations
  274. Unsupervised Learning of Object Landmarks by Factorized Spatial EmbeddingsOral181 citations
  275. Situation Recognition With Graph Neural NetworksPoster180 citations
  276. Blur-Invariant Deep Learning for Blind-DeblurringPoster179 citations
  277. An Empirical Study of Language CNN for Image CaptioningPoster178 citations
  278. Online Video Object Detection Using Association LSTMPoster178 citations
  279. Visual Semantic Planning Using Deep Successor RepresentationsPoster178 citations
  280. PPR-FCN: Weakly Supervised Visual Relation Detection via Parallel Pairwise R-FCNPoster177 citations
  281. Submodular Trajectory Optimization for Aerial 3D ScanningPoster177 citations
  282. Cascaded Feature Network for Semantic Segmentation of RGB-D ImagesPoster175 citations
  283. Monocular Free-Head 3D Gaze Tracking With Deep Learning and Geometry ConstraintsPoster175 citations
  284. Personalized Image AestheticsPoster175 citations
  285. Convolutional Dictionary Learning via Local ProcessingSpotlight174 citations
  286. SCNet: Learning Semantic CorrespondencePoster174 citations
  287. Semantic Jitter: Dense Supervision for Visual Comparisons via Synthetic ImagesPoster174 citations
  288. Transformed Low-Rank Model for Line Pattern Noise RemovalPoster174 citations
  289. Learning Spread-Out Local Feature DescriptorsSpotlight173 citations
  290. Unsupervised Learning of Stereo MatchingPoster172 citations
  291. VegFru: A Domain-Specific Dataset for Fine-Grained Visual CategorizationPoster172 citations
  292. Adversarial Inverse Graphics Networks: Learning 2D-To-3D Lifting and Image-To-Image Translation From Unpaired SupervisionPoster170 citations
  293. First-Person Activity Forecasting With Online Inverse Reinforcement LearningOral169 citations
  294. Learning Visual N-Grams From Web DataPoster167 citations
  295. Exploiting Multi-Grain Ranking Constraints for Precisely Searching Visually-Similar VehiclesPoster166 citations
  296. What Actions Are Needed for Understanding Human Actions in Videos?Poster165 citations
  297. 3DCNN-DQN-RNN: A Deep Reinforcement Learning Framework for Semantic Parsing of Large-Scale 3D Point CloudsPoster162 citations
  298. Should We Encode Rain Streaks in Video as Deterministic or Stochastic?Poster162 citations
  299. Revisiting IM2GPS in the Deep Learning EraPoster161 citations
  300. Monocular 3D Human Pose Estimation by Predicting Depth on JointsPoster158 citations
  301. Characterizing and Improving Stability in Neural Style TransferPoster157 citations
  302. Referring Expression Generation and Comprehension via AttributesPoster156 citations
  303. Video Scene Parsing With Predictive Feature LearningPoster156 citations
  304. DeNet: Scalable Real-Time Object Detection With Directed Sparse SamplingPoster154 citations
  305. Learned Multi-Patch SimilarityPoster152 citations
  306. Faster Than Real-Time Facial Alignment: A 3D Spatial Transformer Network Approach in Unconstrained PosesPoster149 citations
  307. A 3D Morphable Model of Craniofacial Shape and Texture VariationPoster148 citations
  308. GANs for Biological Image SynthesisSpotlight147 citations
  309. Unsupervised Domain Adaptation for Face Recognition in Unlabeled VideosPoster147 citations
  310. Real-Time Monocular Pose Estimation of 3D Objects Using Temporally Consistent Local Color HistogramsPoster145 citations
  311. VQS: Linking Segmentations to Questions and Answers for Supervised Attention in VQA and Question-Focused Semantic SegmentationPoster145 citations
  312. Reconfiguring the Imaging Pipeline for Computer VisionPoster143 citations
  313. Pose-Invariant Face Alignment With a Single CNNPoster142 citations
  314. Query-Guided Regression Network With Context Policy for Phrase GroundingSpotlight142 citations
  315. Learning Action Recognition Model From Depth and Skeleton VideosPoster141 citations
  316. Adaptive RNN Tree for Large-Scale Human Action RecognitionPoster140 citations
  317. Multi-Label Learning of Part Detectors for Heavily Occluded Pedestrian DetectionPoster140 citations
  318. Tracking as Online Decision-Making: Learning a Policy From Streaming Videos With Reinforcement LearningPoster140 citations
  319. Deep Cropping via Attention Box Prediction and Aesthetics AssessmentPoster138 citations
  320. Real Time Eye Gaze Tracking With 3D Deformable Eye-Face ModelPoster138 citations
  321. Nonparametric Variational Auto-Encoders for Hierarchical Representation LearningPoster137 citations
  322. Performance Guaranteed Network Acceleration via High-Order Residual QuantizationPoster137 citations
  323. Intrinsic3D: High-Quality 3D Reconstruction by Joint Appearance and Geometry Optimization With Spatially-Varying LightingPoster136 citations
  324. Generative Adversarial Networks Conditioned by Brain SignalsPoster134 citations
  325. Open Vocabulary Scene ParsingPoster133 citations
  326. SBGAR: Semantics Based Group Activity RecognitionPoster133 citations
  327. A Read-Write Memory Network for Movie Story UnderstandingPoster132 citations
  328. Structured Attentions for Visual Question AnsweringPoster132 citations
  329. Curriculum DropoutPoster130 citations
  330. Non-Uniform Blind Deblurring by ReblurringPoster129 citations
  331. Learning Discriminative Latent Attributes for Zero-Shot ClassificationPoster128 citations
  332. Deep Occlusion Reasoning for Multi-Camera Multi-Target DetectionPoster127 citations
  333. Learning to Push the Limits of Efficient FFT-Based Image DeconvolutionSpotlight127 citations
  334. Unsupervised Adaptation for Deep StereoPoster126 citations
  335. From RGB to Spectrum for Natural Scenes via Manifold-Based MappingPoster125 citations
  336. Weakly Supervised Summarization of Web VideosPoster124 citations
  337. ChromaTag: A Colored Marker and Fast Detection AlgorithmPoster123 citations
  338. Predicting Human Activities Using Stochastic GrammarPoster123 citations
  339. Temporal Non-Volume Preserving Approach to Facial Age-Progression and Age-Invariant Face RecognitionOral123 citations
  340. Egocentric Gesture Recognition Using Recurrent 3D Convolutional Neural Networks With Spatiotemporal Transformer ModulesSpotlight122 citations
  341. Learning High Dynamic Range From Outdoor PanoramasOral121 citations
  342. MarioQA: Answering Questions by Watching Gameplay VideosPoster121 citations
  343. Non-Linear Convolution Filters for CNN-Based LearningPoster121 citations
  344. Rethinking Reprojection: Closing the Loop for Pose-Aware Shape Reconstruction From a Single ImageSpotlight121 citations
  345. MIHash: Online Hashing With Mutual InformationPoster119 citations
  346. Video Deblurring via Semantic Segmentation and Pixel-Wise Non-Linear KernelPoster117 citations
  347. Realistic Dynamic Facial Textures From a Single Image Using GANsPoster116 citations
  348. Deep Dual Learning for Semantic Image SegmentationPoster115 citations
  349. Following Gaze in VideoPoster115 citations
  350. Neural EPI-Volume Networks for Shape From Light FieldSpotlight115 citations
  351. Single Image Action Recognition Using Semantic Body Part ActionsPoster115 citations
  352. Ensemble Diffusion for RetrievalOral114 citations
  353. Learning the Latent "Look": Unsupervised Discovery of a Style-Coherent Embedding From Fashion ImagesPoster114 citations
  354. Interpretable Transformations With Encoder-Decoder NetworksPoster113 citations
  355. Blind Image Deblurring With Outlier HandlingPoster112 citations
  356. MirrorFlow: Exploiting Symmetries in Joint Optical Flow and Occlusion EstimationPoster110 citations
  357. Distributed Very Large Scale Bundle Adjustment by Global Camera ConsensusOral109 citations
  358. Joint Prediction of Activity Labels and Starting Times in Untrimmed VideosPoster109 citations
  359. Recurrent Scale Approximation for Object Detection in CNNPoster109 citations
  360. Spatial-Aware Object Embeddings for Zero-Shot Localization and Classification of ActionsOral109 citations
  361. Temporal Dynamic Graph LSTM for Action-Driven Video Object DetectionPoster108 citations
  362. Am I a Baller? Basketball Performance Assessment From First-Person VideosPoster106 citations
  363. Dense and Low-Rank Gaussian CRFs Using Deep EmbeddingsPoster106 citations
  364. Joint Discovery of Object States and Manipulation ActionsPoster106 citations
  365. Weakly- and Self-Supervised Learning for Content-Aware Deep Image RetargetingSpotlight106 citations
  366. Detecting Faces Using Inside Cascaded Contextual CNNPoster105 citations
  367. Material Editing Using a Physically Based Rendering NetworkSpotlight105 citations
  368. DualNet: Learn Complementary Features for Image RecognitionPoster103 citations
  369. Self-Organized Text Detection With Minimal Post-Processing via Border LearningPoster103 citations
  370. WeText: Scene Text Detection Under Weak SupervisionPoster103 citations
  371. What Will Happen Next? Forecasting Player Moves in Sports VideosPoster103 citations
  372. SUBIC: A Supervised, Structured Binary Code for Image SearchSpotlight102 citations
  373. Attribute-Enhanced Face Recognition With Neural Tensor Fusion NetworksSpotlight100 citations
  374. Dual-Glance Model for Deciphering Social RelationshipsPoster100 citations
  375. On-Demand Learning for Deep Image RestorationPoster100 citations
  376. Non-Markovian Globally Consistent Multi-Object TrackingPoster99 citations
  377. Paying Attention to Descriptions Generated by Image Captioning ModelsPoster99 citations
  378. Efficient Online Local Metric Adaptation via Negative Samples for Person Re-IdentificationPoster98 citations
  379. Active Learning for Human Pose EstimationPoster96 citations
  380. Learning Bag-Of-Features Pooling for Deep Convolutional Neural NetworksPoster93 citations
  381. Quantitative Evaluation of Confidence Measures in a Machine Learning WorldSpotlight93 citations
  382. Learning-Based Cloth Material Recovery From VideoPoster92 citations
  383. Pose Guided RGBD Feature Learning for 3D Object Pose EstimationPoster91 citations
  384. When Unsupervised Domain Adaptation Meets Tensor RepresentationsPoster89 citations
  385. Centered Weight Normalization in Accelerating Training of Deep Neural NetworksPoster88 citations
  386. Weakly Supervised Object Localization Using Things and Stuff TransferPoster87 citations
  387. Learning 3D Object Categories by Looking Around ThemOral86 citations
  388. Privacy-Preserving Visual Learning Using Doubly Permuted Homomorphic EncryptionPoster86 citations
  389. Attentive Semantic Video Generation Using CaptionsPoster85 citations
  390. Learning Long-Term Dependencies for Action Recognition With a Biologically-Inspired Deep NetworkPoster85 citations
  391. Attributes2Classname: A Discriminative Model for Attribute-Based Unsupervised Zero-Shot LearningPoster84 citations
  392. PathTrack: Fast Trajectory Annotation With Path SupervisionPoster83 citations
  393. Robust Hand Pose Estimation During the Interaction With an Unknown ObjectPoster83 citations
  394. Rolling-Shutter-Aware Differential SfM and Image RectificationPoster83 citations
  395. Rotational Subgroup Voting and Pose Clustering for Robust 3D Object RecognitionPoster83 citations
  396. Unsupervised Action Discovery and Localization in VideosPoster83 citations
  397. DeepContext: Context-Encoding Neural Pathways for 3D Holistic Scene UnderstandingPoster82 citations
  398. Human Pose Estimation Using Global and Local NormalizationPoster82 citations
  399. Scale Recovery for Monocular Visual Odometry Using Depth Estimated With Deep Convolutional Neural FieldsPoster81 citations
  400. AMTnet: Action-Micro-Tube Regression by End-To-End Trainable Deep ArchitecturePoster80 citations
  401. Aesthetic Critiques Generation for PhotosPoster80 citations
  402. Domain-Adaptive Deep Network CompressionPoster80 citations
  403. Learning Dense Facial Correspondences in Unconstrained ImagesPoster80 citations
  404. Chained Cascade Network for Object DetectionPoster79 citations
  405. Deltille Grids for Geometric Camera CalibrationPoster79 citations
  406. Multi-View Dynamic Shape Refinement Using Local Temporal IntegrationPoster78 citations
  407. Joint Learning of Object and Action DetectorsPoster77 citations
  408. Sketching With Style: Visual Search With Sketches and Aesthetic ContextPoster77 citations
  409. TORNADO: A Spatio-Temporal Convolutional Regression Network for Video Action ProposalPoster77 citations
  410. Robust Object Tracking Based on Temporal and Spatial Deep NetworksPoster76 citations
  411. Visual Forecasting by Imitating Dynamics in Natural SequencesSpotlight76 citations
  412. DeepCoder: Semi-Parametric Variational Autoencoders for Automatic Facial Action CodingPoster75 citations
  413. Locally-Transferred Fisher Vectors for Texture ClassificationPoster75 citations
  414. Multi-Stage Multi-Recursive-Input Fully Convolutional Networks for Neuronal Boundary DetectionPoster75 citations
  415. Monocular Dense 3D Reconstruction of a Complex Dynamic Scene From Two Perspective FramesPoster74 citations
  416. Globally-Optimal Inlier Set Maximisation for Simultaneous Camera Pose and Feature CorrespondenceOral73 citations
  417. Practical and Efficient Multi-View MatchingSpotlight73 citations
  418. Reflectance Capture Using Univariate Sampling of BRDFsPoster73 citations
  419. See the Glass Half Full: Reasoning About Liquid Containers, Their Volume and ContentPoster73 citations
  420. Semantic Line Detection and Its ApplicationsPoster73 citations
  421. Anchored Regression Networks Applied to Age Estimation and Super ResolutionPoster72 citations
  422. Making Minimal Solvers for Absolute Pose Estimation Compact and RobustPoster72 citations
  423. Recurrent Color ConstancyPoster72 citations
  424. Decoder Network Over Lightweight Reconstructed Feature for Fast Semantic Style TransferPoster71 citations
  425. ProbFlow: Joint Optical Flow and Uncertainty EstimationPoster71 citations
  426. Spatio-Temporal Person Retrieval via Natural Language QueriesPoster71 citations
  427. Scene Parsing With Global Context EmbeddingPoster70 citations
  428. Look, Perceive and Segment: Finding the Salient Objects in Images via Two-Stream Fixation-Semantic CNNsPoster69 citations
  429. Delving Into Salient Object Subitizing and DetectionPoster68 citations
  430. Introspective Neural Networks for Generative ModelingPoster68 citations
  431. A Unified Model for Near and Remote SensingPoster67 citations
  432. Estimating Defocus Blur via Rank of Local PatchesPoster67 citations
  433. SORT: Second-Order Response Transform for Visual RecognitionPoster67 citations
  434. Deep Scene Image Classification With the MFAFVNetPoster66 citations
  435. Group Re-Identification via Unsupervised Transfer of Sparse Features EncodingPoster66 citations
  436. FoveaNet: Perspective-Aware Urban Scene ParsingOral65 citations
  437. Unsupervised Learning From Video to Detect Foreground Objects in Single ImagesPoster65 citations
  438. Fast Multi-Image Matching via Density-Based ClusteringPoster64 citations
  439. Recurrent 3D-2D Dual Learning for Large-Pose Facial Landmark DetectionPoster64 citations
  440. From Point Clouds to Mesh Using RegressionPoster63 citations
  441. Learning Discriminative Aggregation Network for Video-Based Face RecognitionSpotlight63 citations
  442. A Self-Balanced Min-Cut Algorithm for Image ClusteringPoster62 citations
  443. Recognition of Action Units in the Wild With Deep Nets and a New Global-Local LossPoster62 citations
  444. Deep Binaries: Encoding Semantic-Rich Cues for Efficient Textual-Visual Cross RetrievalPoster61 citations
  445. Directionally Convolutional Networks for 3D Shape SegmentationPoster61 citations
  446. Filter Selection for Hyperspectral EstimationPoster61 citations
  447. Joint Estimation of Camera Pose, Depth, Deblurring, and Super-Resolution From a Blurred Image SequencePoster61 citations
  448. Low-Dimensionality Calibration Through Local Anisotropic Scaling for Robust Hand Model PersonalizationPoster61 citations
  449. Semi-Global Weighted Least Squares in Image FilteringPoster61 citations
  450. Unsupervised Creation of Parameterized AvatarsOral61 citations
  451. Super-Trajectory for Video SegmentationPoster60 citations
  452. Recursive Spatial Transformer (ReST) for Alignment-Free Face RecognitionSpotlight59 citations
  453. Cross-Modal Deep Variational HashingPoster58 citations
  454. What Is Around the Camera?Poster58 citations
  455. A Lightweight Approach for On-The-Fly Reflectance EstimationOral57 citations
  456. Learning Gaze Transitions From Depth to Improve Video Saliency EstimationPoster57 citations
  457. End-To-End Face Detection and Cast Grouping in Movies Using Erdos-Renyi ClusteringSpotlight56 citations
  458. Increasing CNN Robustness to Occlusions by Reducing Filter SupportPoster56 citations
  459. Joint Adaptive Sparsity and Low-Rankness on the Fly: An Online Tensor Reconstruction Scheme for Video DenoisingPoster56 citations
  460. ScaleNet: Guiding Object Proposal Generation in Supermarkets and BeyondPoster56 citations
  461. Complex Event Detection by Identifying Reliable Shots From Untrimmed VideosPoster55 citations
  462. Depth and Image Restoration From Light Field in a Scattering MediumPoster55 citations
  463. Learned Watershed: End-To-End Learning of Seeded SegmentationPoster55 citations
  464. Learning From Video and Text via Large-Scale Discriminative ClusteringSpotlight54 citations
  465. Weakly Supervised Learning of Deep Metrics for Stereo ReconstructionPoster54 citations
  466. Active Decision Boundary Annotation With Deep Generative ModelsSpotlight53 citations
  467. DCTM: Discrete-Continuous Transformation Matching for Semantic FlowOral53 citations
  468. DeepSetNet: Predicting Sets With Deep Neural NetworksSpotlight53 citations
  469. Jointly Recognizing Object Fluents and Tasks in Egocentric VideosPoster53 citations
  470. Neural Ctrl-F: Segmentation-Free Query-By-String Word Spotting in Handwritten Manuscript CollectionsPoster53 citations
  471. Surface Normals in the WildPoster53 citations
  472. Generalized Orderless Pooling Performs Implicit Salient MatchingPoster52 citations
  473. PUnDA: Probabilistic Unsupervised Domain Adaptation for Knowledge Transfer Across Visual CategoriesPoster51 citations
  474. Rolling Shutter Correction in Manhattan WorldPoster51 citations
  475. A Novel Space-Time Representation on the Positive Semidefinite Cone for Facial Expression RecognitionPoster50 citations
  476. Consensus Convolutional Sparse CodingPoster50 citations
  477. Point Set Registration With Global-Local Correspondence and Transformation EstimationPoster50 citations
  478. DeepCD: Learning Deep Complementary Descriptors for Patch RepresentationsPoster49 citations
  479. Learning Hand Articulations by Hallucinating Heat DistributionPoster49 citations
  480. Temporal Tessellation: A Unified Approach for Video AnalysisSpotlight49 citations
  481. Polynomial Solvers for Saturated IdealsPoster48 citations
  482. Beyond Planar Symmetry: Modeling Human Perception of Reflection and Rotation Symmetries in the WildOral47 citations
  483. Bringing Background Into the Foreground: Making All Classes Equal in Weakly-Supervised Video Semantic SegmentationPoster47 citations
  484. Progressive Large Scale-Invariant Image Matching in Scale SpacePoster47 citations
  485. Understanding and Mapping Natural BeautyPoster47 citations
  486. Video Reflection Removal Through Spatio-Temporal OptimizationPoster46 citations
  487. FLaME: Fast Lightweight Mesh Estimation Using Variational Smoothing on Delaunay GraphsPoster45 citations
  488. Synergy Between Face Alignment and Tracking via Discriminative Global Consensus OptimizationSpotlight45 citations
  489. Depth Estimation Using Structured Light Flow -- Analysis of Projected Pattern Flow on an Object's SurfacePoster44 citations
  490. Generative Modeling of Audible Shapes for Object PerceptionPoster44 citations
  491. Probabilistic Structure From Motion With Objects (PSfMO)Poster44 citations
  492. Convergence Analysis of MAP Based Blur Kernel EstimationPoster43 citations
  493. Unsupervised Object Segmentation in Video by Efficient Selection of Highly Probable Positive FeaturesPoster43 citations
  494. AMAT: Medial Axis Transform for Natural ImagesPoster41 citations
  495. Deep Growing LearningPoster41 citations
  496. Mutual Enhancement for Detection of Multiple Logos in Sports VideosPoster40 citations
  497. A Spatiotemporal Oriented Energy Network for Dynamic Texture RecognitionSpotlight39 citations
  498. Face Sketch Matching via Coupled Deep Transform LearningPoster39 citations
  499. Self-Paced Kernel Estimation for Robust Blind Image DeblurringPoster39 citations
  500. Composite Focus Measure for High Quality Depth MapsPoster38 citations
  501. Learning Discriminative Data Fitting Functions for Blind Image DeblurringPoster38 citations
  502. Adaptive Feeding: Achieving Fast and Accurate Detections by Adaptively Combining Object DetectorsPoster37 citations
  503. Robust Pseudo Random Fields for Light-Field Stereo MatchingOral37 citations
  504. Semantically Informed Multiview Surface RefinementPoster37 citations
  505. Visual Transformation Aided Contrastive Learning for Video-Based Kinship VerificationPoster37 citations
  506. Deep Facial Action Unit Recognition From Partially Labeled DataPoster36 citations
  507. Higher-Order Minimum Cost Lifted Multicuts for Motion SegmentationPoster36 citations
  508. Linear Differential Constraints for Photo-Polarimetric Height EstimationSpotlight36 citations
  509. SHaPE: A Novel Graph Theoretic Algorithm for Making Consensus-Based Decisions in Person Re-Identification SystemsPoster36 citations
  510. Scene Categorization With Spectral FeaturesPoster36 citations
  511. Trespassing the Boundaries: Labeling Temporal Bounds for Object Interactions in Egocentric VideoPoster36 citations
  512. Zero-Order Reverse FilteringPoster36 citations
  513. Offline Handwritten Signature Modeling and Verification Based on Archetypal AnalysisPoster35 citations
  514. Recurrent Models for Situation RecognitionPoster35 citations
  515. Visual Odometry for Pixel Processor ArraysSpotlight35 citations
  516. Refractive Structure-From-Motion Through a Flat Refractive InterfacePoster34 citations
  517. Revisiting Cross-Channel Information Transfer for Chromatic Aberration CorrectionPoster34 citations
  518. Corner-Based Geometric Calibration of Multi-Focus Plenoptic CamerasPoster33 citations
  519. Deep Determinantal Point Process for Large-Scale Multi-Label ClassificationPoster33 citations
  520. Embedding 3D Geometric Features for Rigid Object Part SegmentationPoster33 citations
  521. High Order Tensor Formulation for Convolutional Sparse CodingPoster33 citations
  522. Unsupervised Learning of Important Objects From First-Person VideosPoster33 citations
  523. Anticipating Daily Intention Using On-Wrist Motion Triggered SensingSpotlight32 citations
  524. Self-Supervised Learning of Pose Embeddings From Spatiotemporal Relations in VideosPoster32 citations
  525. Learning to Disambiguate by Asking Discriminative QuestionsPoster31 citations
  526. Misalignment-Robust Joint Filter for Cross-Modal Image PairsPoster31 citations
  527. Low Compute and Fully Parallel Computer Vision With HashMatchPoster30 citations
  528. Primary Video Object Segmentation via Complementary CNNs and Neighborhood Reversible FlowPoster30 citations
  529. GPLAC: Generalizing Vision-Based Robotic Skills Using Weakly Labeled ImagesPoster29 citations
  530. Modelling the Scene Dependent Imaging in Cameras With a Deep Neural NetworkPoster29 citations
  531. A Microfacet-Based Reflectance Model for Photometric Stereo With Highly Specular SurfacesPoster28 citations
  532. A Multimodal Deep Regression Bayesian Network for Affective Video Content AnalysesPoster28 citations
  533. From Square Pieces to Brick Walls: The Next Challenge in Solving Jigsaw PuzzlesPoster28 citations
  534. Infant Footprint RecognitionPoster28 citations
  535. Joint Layout Estimation and Global Multi-View Registration for Indoor ReconstructionPoster28 citations
  536. Learning View-Invariant Features for Person Identification in Temporally Synchronized Videos Taken by Wearable CamerasPoster28 citations
  537. Makeup-Go: Blind Reversion of Portrait EditOral28 citations
  538. Moving Object Detection in Time-Lapse or Motion Trigger Image Sequences Using Low-Rank and Invariant Sparse DecompositionPoster28 citations
  539. Ray Space Features for Plenoptic Structure-From-MotionPoster27 citations
  540. Beyond Standard Benchmarks: Parameterizing Performance Evaluation in Visual Object TrackingPoster26 citations
  541. Non-Rigid Object Tracking via Deformable Patches Using Shape-Preserved KCF and Level SetsPoster26 citations
  542. Aligned Image-Word Representations Improve Inductive Transfer Across Vision-Language TasksPoster25 citations
  543. Sublabel-Accurate Discretization of Nonconvex Free-Discontinuity ProblemsPoster25 citations
  544. Taking the Scenic Route to 3D: Optimising Reconstruction From Moving CamerasPoster25 citations
  545. Dense Non-Rigid Structure-From-Motion and Shading With Unknown AlbedosPoster24 citations
  546. Non-Convex Rank/Sparsity Regularization and Local MinimaPoster24 citations
  547. A Multilayer-Based Framework for Online Background Subtraction With Freely Moving CamerasPoster23 citations
  548. Tensor RPCA by Bayesian CP Factorization With Complex NoisePoster23 citations
  549. Unsupervised Video Understanding by Reconciliation of Posture SimilaritiesPoster23 citations
  550. A Lightweight Single-Camera Polarization Compass With Covariance EstimationPoster22 citations
  551. CAD Priors for Accurate and Flexible Instance ReconstructionPoster22 citations
  552. Object-Level ProposalsPoster22 citations
  553. Practical Projective Structure From Motion (P2SfM)Oral22 citations
  554. Modeling Urban Scenes From PointcloudsPoster21 citations
  555. Monocular Video-Based Trailer Coupler Detection Using Multiplexer Convolutional Neural NetworkPoster21 citations
  556. "Maximizing Rigidity" Revisited: A Convex Programming Approach for Generic 3D Shape Reconstruction From Multiple Perspective ViewsPoster20 citations
  557. Click Here: Human-Localized Keypoints as Guidance for Viewpoint EstimationPoster20 citations
  558. Parameter-Free Lens Distortion Calibration of Central CamerasPoster20 citations
  559. Personalized Cinemagraphs Using Semantic Understanding and Collaborative LearningPoster19 citations
  560. Efficient Algorithms for Moral Lineage TracingPoster18 citations
  561. Efficient Global Illumination for Morphable ModelsPoster18 citations
  562. Focal Track: Depth and Accommodation With Oscillating Lens DeformationPoster18 citations
  563. Learning for Active 3D MappingOral18 citations
  564. Robust Kronecker-Decomposable Component Analysis for Low-Rank ModelingPoster18 citations
  565. Blob Reconstruction Using Unilateral Second Order Gaussian Kernels With Application to High-ISO Long-Exposure Image DenoisingPoster17 citations
  566. Compressive Quantization for Fast Object Instance Search in VideosPoster17 citations
  567. Detailed Surface Geometry and Albedo Recovery From RGB-D Video Under Natural IlluminationPoster17 citations
  568. Towards a Unified Compositional Model for Visual Pattern ModelingPoster17 citations
  569. Weakly Supervised Manifold Learning for Dense Semantic Object CorrespondencePoster17 citations
  570. Leveraging Weak Semantic Relevance for Complex Video Event ClassificationPoster16 citations
  571. Online Robust Image Alignment via Subspace Learning From Gradient OrientationsPoster16 citations
  572. Reasoning About Fine-Grained Attribute Phrases Using Reference GamesPoster16 citations
  573. Volumetric Flow Estimation for Incompressible Fluids Using the Stationary Stokes EquationsPoster16 citations
  574. CDTS: Collaborative Detection, Tracking, and Segmentation for Online Multiple Object Segmentation in VideosPoster15 citations
  575. High-Quality Correspondence and Segmentation Estimation for Dual-Lens Smart-Phone PortraitsPoster15 citations
  576. Local-To-Global Point Cloud Registration Using a Dictionary of Viewpoint DescriptorsPoster15 citations
  577. Video Fill in the Blank Using LR/RL LSTMs With Spatial-Temporal AttentionsPoster15 citations
  578. Transferring Objects: Joint Inference of Container and Human PosePoster14 citations
  579. Catadioptric HyperSpectral Light Field ImagingPoster13 citations
  580. Going Unconstrained With Rolling Shutter DeblurringPoster13 citations
  581. Saliency Pattern Detection by Ranking Structured TreesPoster13 citations
  582. Using Sparse Elimination for Solving Minimal Problems in Computer VisionSpotlight13 citations
  583. Deep Free-Form Deformation Network for Object-Mask RegistrationPoster12 citations
  584. Image2song: Song Retrieval via Bridging Image Content and Lyric WordsPoster12 citations
  585. Intrinsic 3D Dynamic Surface Tracking Based on Dynamic Ricci Flow and Teichmuller MapPoster12 citations
  586. Side Information in Robust Principal Component Analysis: Algorithms and ApplicationsPoster12 citations
  587. Temporal Superpixels Based on Proximity-Weighted Patch MatchingPoster12 citations
  588. Common Action Discovery and Localization in Unconstrained VideosPoster11 citations
  589. Multimodal Gaussian Process Latent Variable Models With HarmonizationPoster11 citations
  590. Surface Registration via FoliationPoster11 citations
  591. 3D Surface Detail Enhancement From a Single Normal MapPoster10 citations
  592. Constrained Convolutional Sparse Coding for Parametric Based Reconstruction of Line DrawingsPoster10 citations
  593. Flip-Invariant Motion RepresentationPoster10 citations
  594. Low-Rank Tensor Completion: A Pseudo-Bayesian Learning ApproachPoster10 citations
  595. Region-Based Correspondence Between 3D Shapes via Spatially Smooth BiclusteringPoster10 citations
  596. Editable Parametric Dense Foliage From 3D CapturePoster9 citations
  597. Simultaneous Detection and Removal of High Altitude Clouds From an ImagePoster9 citations
  598. A Geometric Framework for Statistical Analysis of Trajectories With Distinct Temporal SpansPoster8 citations
  599. Deep Globally Constrained MRFs for Human Pose EstimationPoster8 citations
  600. Summarization and Classification of Wearable Camera Streams by Learning the Distributions Over Deep Features of Out-Of-Sample Image SequencesPoster8 citations
  601. An Optimal Transportation Based Univariate Neuroimaging IndexPoster7 citations
  602. AnnArbor: Approximate Nearest Neighbors Using Arborescence CodingPoster6 citations
  603. Learning Discriminative ab-Divergences for Positive Definite MatricesPoster6 citations
  604. Predictor Combination at Test TimePoster6 citations
  605. Supplementary Meta-Learning: Towards a Dynamic Model for Deep Neural NetworksPoster6 citations
  606. Toward Perceptually-Consistent Stereo: A Scanline StudyPoster6 citations
  607. Sparse Exact PGA on Riemannian ManifoldsPoster5 citations
  608. Temporal Shape Super-Resolution by Intra-Frame Motion Encoding Using High-Fps Structured LightSpotlight5 citations
  609. Training Deep Networks to Be Spatially SensitivePoster5 citations
  610. Guided Perturbations: Self-Corrective Behavior in Convolutional Neural NetworksPoster4 citations
  611. Quasiconvex Plane Sweep for Triangulation With OutliersPoster4 citations
  612. Space-Time Localization and MappingPoster4 citations
  613. Unrolled Memory Inner-Products: An Abstract GPU Operator for Efficient Vision-Related ComputationsSpotlight4 citations
  614. Truncating Wide Networks Using Binary Tree ArchitecturesPoster3 citations
  615. Approximate Grassmannian Intersections: Subspace-Valued Subspace LearningPoster2 citations
  616. Camera Calibration by Global Constraints on the Motion of SilhouettesPoster2 citations
  617. Multi-View Non-Rigid Refinement and Normal Selection for High Quality 3D ReconstructionPoster2 citations
  618. A Discriminative View of MRF Pre-Processing AlgorithmsPoster1 citations
  619. Automatic Content-Aware Projection for 360deg VideosPoster1 citations
  620. Dynamics Enhanced Multi-Camera Motion Segmentation From Unsynchronized VideosPoster1 citations
  621. Optimal Transformation Estimation With Semantic CuesPoster1 citations

Looking for submission deadlines instead? See the conference deadline calendar.