Contextual Graph Matching with Correlated Gaussian Features
Information-theoretic analysis of contextual graph matching with correlated Gaussian features deriving recovery thresholds.
Information-theoretic analysis of contextual graph matching with correlated Gaussian features deriving recovery thresholds.
ARGENT: vision-language model using hyperbolic geometry to capture hierarchical structure of visual and linguistic concepts.
Supervised contrastive metric learning for point cloud segmentation in particle detectors using density-based clustering.
VTAM: video-tactile-action model for embodied AI combining visual and tactile signals for contact-rich physical interaction.
VISOR: efficiency method for vision-language models using sparse dynamically selected interactions instead of visual token reduction.
ML model for virtual screening in drug discovery handling out-of-distribution regions with extrapolatory pseudo-label matching.
Minimal Frame Averaging: framework for constructing provably minimal frames achieving exact equivariance in ML systems efficiently.
Continuous action representation for 3D floorplanning addressing scalability bottlenecks from discrete canvas coordinates.
Convergence analysis of linear temporal difference learning in reinforcement learning without requiring linearly independent features.
HFLDD: hybrid federated learning framework using dataset distillation to address non-IID data heterogeneity and label distribution skew.
DART-Eval: benchmark for evaluating DNA language models on regulatory DNA prediction, interpretation and design tasks.
MSA-CNN: lightweight multi-scale CNN with attention mechanism for automatic sleep stage classification from signal data.
BalanceKV: streaming algorithm for approximating attention computations in LLMs using geometric process to reduce memory requirements for long-context generation.
Federated learning approach for designing data-driven feedforward control in vehicle lateral dynamics using distributed data across multiple systems.
Expectation Reflection: multiplicative parameter update paradigm for ML optimization using observation-prediction ratios instead of additive gradient descent.
Analysis of geometric properties and flatness in neural architecture search spaces.
Information-theoretic framework for characterizing and measuring information leakage in concept-based models.
Federated LoRA fine-tuning method for large language models with communication-efficient sparsified updates.
Meta-optimization approach for generating generalizable heuristics using LLMs for combinatorial optimization.
Multi-experiment equation learning method for deriving analytical models from agent-based simulation data.
State representation learning from trajectories using minimum action distance metric for MDPs.
Foundation model adapter for time series forecasting with heterogeneous covariates and multimodal data.
Red teaming framework for systematically discovering diverse vulnerabilities in large language models.
Privacy-preserving graph structure learning using differential privacy at data publishing stage.
Spiking neural network framework with hyperparameter optimization for fraud detection.
Testing framework for deep learning systems using topographical feature discrimination.
Federated learning framework for training deep models on resource-constrained edge devices.
Novel sampling algorithm for masked diffusion models improving generation quality and efficiency.
Optimizes on-device semantic selection with cross-encoder rerankers for retrieval, agent memory, and recommendations via monolithic forwarding.
Scalable framework for automated desktop UI exploration to generate training data for LLM-based GUI understanding and automation.
Parameter-free clustering framework using self-supervised consensus maximization without requiring hyperparameter tuning.
Pathlet dictionary learning approach for robust and interpretable trajectory generation in privacy-preserving urban mobility applications.
Studies model inversion attacks on latent diffusion models, showing non-uniform memorization patterns in latent space.
Proposes differentially private federated learning optimization using regularized Fisher information matrix for faster convergence under privacy constraints.
Introduces homomorphism error metric to measure representational inconsistencies and predict compositional generalization failures in transformers.
Analyzes forecast uncertainty in ML model explainability, arguing uncertainty at decision boundaries explains LIME/SHAP instability.
Brain-inspired routing method with temporal-ensemble experts for general continual learning from non-stationary data streams.
Proposes one-to-one channel-head binding method for imputing missing values in multivariate time series data.
Studies robustness of PPO reinforcement learning under sensor drift using temporal sequence models to handle partial observability.
arXiv paper MJ1: multimodal judge trained with RL enforcing visual grounding through structured verification chains and counterfactual consistency rewards.
arXiv paper proposing key deletion approach for machine unlearning designed at model development stage rather than post-hoc, addressing privacy regulations and data errors.
arXiv paper PRISM: empirical study of mid-training design choices across 7 LLM base models showing consistent +15 to +40 point gains from 27B token sequences.
arXiv paper systematically analyzing Elastic Weight Consolidation for continual learning, revealing suboptimal importance estimation and proposing improvements.
arXiv paper presenting MemReward, graph-based experience memory framework reducing human labeling needs for LLM reward prediction in RL post-training.
arXiv paper analyzing fixed-point iterations for nuclear norm optimization in private machine learning, proved with Gemini 3 collaboration.
arXiv paper presenting FIPO reinforcement learning algorithm for improving reasoning in LLMs through fine-grained credit assignment beyond outcome-based rewards.
arXiv paper proposing Memory-Keyed Attention (MKA) to reduce KV cache memory costs in long-context LLM inference without sacrificing representation quality.
Algorithm for optimal multi-task dataset mixture selection in LLM supervised fine-tuning. Addresses heterogeneous learning dynamics and overfitting.
Uncertainty quantification methods for distribution-to-distribution generative models in scientific imaging. Ensures trustworthy cell and medical image generation.
Reinforcement learning post-training for virtual cell models to enforce biological constraints. Improves generative model reliability for drug discovery.