Survey of Computerized Adaptive Testing: A Machine Learning Perspective
Dual-CBA: Improving Online Continual Learning via Dual Continual Bias Adaptors From a Bi-level Optimization Perspective
Adaptive Aggregation of Monte Carlo Augmented Decomposed Filters for Efficient Group-Equivariant Convolutional Neural Network
Efficient Training of Large Vision Models via Advanced Automated Progressive Learning
Hyper-Compression: Model Compression via Hyperfunction
ChatTracker: Enhancing Visual Tracking via LLM-Driven Iterative Description Refinement
Toward Ultrafast Depth Sensing via Active Event-Based Stereo Vision
From Channel Bias to Feature Redundancy: Uncovering the “Less is More” Principle in Few-Shot Learning
Beyond Support Samples: Incorporating Unlabeled Queries for Few-Shot Semantic Segmentation
Confidence-Aware Pseudo-Label Self-Correction for Weakly Supervised Visual Grounding
Understanding Adversarial Imitation Learning in Small Sample Regime: A Stage-Coupled Analysis
Variational Bayesian Personalized Ranking
DGPDL: Domain-Guided Prompt Distribution Learning for Generalizable Face Anti-Spoofing
Concept Drift and Long-Tailed Distribution in Fine-Grained Visual Categorization: Benchmark and Method
Bridging Datasets and Hyperparameters: GCN-Based Link Prediction for Recommendation
HIMO: Cross-Arbitrary-Modality Image Invariant Feature Transform With Hierarchical Intrinsic Major Orientation
Interacted Planes Reveal 3D Line Mapping
Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
Distilling Object Detectors via Monte Carlo Dropout
Multi-View Clustering via Bilaterally Constrained Anchor Graph
Understanding the Effects of Projectors in Knowledge Distillation
Discrete Tokenization for Multimodal LLMs: A Comprehensive Survey
Principled Multimodal Representation Learning
Out-of-Sight Embodied Agents: Multimodal Tracking, Sensor Fusion, and Trajectory Forecasting
Mirror Descent Safe Policy Optimization for Reinforcement Learning Agents
One-Step Diffusion and Flow Distillation Through Implicit Generator Matching
Collaborative Multi-Modal Coding for High-Quality 3D Generation
Harnessing Meta-Learning for Controllable Full-Frame Video Stabilization
Stability and Generalization for Distributed SGDA
OmniParser V2: Structured-Points-of-Thought for Unified Visual Text Parsing and Its Generality to Multimodal Large Language Models
Revisiting Face Forgery Detection: From Facial Representation to Forgery Detection
Fast and Scalable Hashing-Based Universal Graph Coarsening
Track-On2: Enhancing Online Point Tracking With Memory
Pragmatic Communication in Multi-Agent Collaborative Perception
Sparse Variational Information Bottleneck Gaussian Processes for Uncertainty Estimation
SCGT: Toward Scalable and Comprehensive Graph Transformer
SHADOW: Secure Hidden Authenticating Digital Objects in the Wild
Match Stereo Videos via Bidirectional Alignment
A Pose-Only Geometric Constraint for Multi-Camera Pose Adjustment
Robust Adaptation of Foundation Models With Black-Box Visual Prompting
Deep Information-Balanced Multimodal Learning
Learning Three-Domain Implicit Image Function for Arbitrary-Scale Light Field Super-Resolution
Learning Continuous Spatiotemporal Implicit Neural Fields for Unsupervised Video Denoising
Dual Geometry Margin Optimization for Coupled-Noisy Robust Ensemble Learning
DrawMotion: Generating 3D Human Motions by Freehand Drawing
Cross-Frequency Implicit Neural Representation With Self-Evolving Parameters
Text4Seg++: Advancing Image Segmentation via Generative Language Modeling
DreamFuse: Toward Realistic and Seamless Image Fusion Across Diverse Scenarios
Motion2VecSets: Non-Rigid Shape Reconstruction and Tracking With 4D Latent Set Diffusion
MAN++: Scaling Momentum Auxiliary Network for Supervised Local Learning in Vision Tasks