AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

25572 stories from 30+ sources, refreshed continuously.

arXiv cs.AIResearch

Flexformer: Flexible Linear Transformer with Learnable Attention Kernel

arXiv cs.AIResearch

Drop-Then-Recovery: How Redundant Are Vision-Language-Action Models?

arXiv cs.AIResearch

RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance

arXiv cs.AIResearch

Improving Adversarial Robustness via Activation Amplification and Attenuation

arXiv cs.AIResearch

Optimizing Teacher-Student Partitioning for Scalable Knowledge Distillation on HPC Systems

arXiv cs.AIResearch

Parameter-Efficient Quantum-Inspired Fast Weight Programmers for Traffic-Matrix Forecasting

arXiv cs.AIResearch

WattLayer: Get Layers Right to Estimate Inference Energy of Neural Networks

arXiv cs.CVResearch

Two-Stage Cross-Domain Cervical Abnormality Screening with Cytopathological Image Synthesis and Knowledge Distillation

arXiv cs.CVResearch

Joint Transcription and Decryption of Images of Encrypted Handwritten Documents: A Comparison with the Traditional Pipeline

arXiv cs.CVResearch

ZooClaw-FashionSigLIP2: Distilled Fine-tuning for Robust Fashion Retrieval

arXiv cs.CVResearch

Learning 1-Bit LiDAR-based Localization with Auxiliary Objective

arXiv cs.CVResearch

SIFT: Self-Imagination Fine-Tuning for Physically Plausible Motion in Video Diffusion Models

arXiv cs.CVResearch

Panoramic Scene Analysis: A Survey from Distortion-Aware Engineering to Sphere-Native Foundation Modeling

arXiv cs.CVResearch

PixelU: A U-Shaped Transformer for Efficient End-to-End Pixel Diffusion

arXiv cs.CVResearch

MindFlow: Harmonizing Cognitive Semantics and Acoustic Dynamics for Facial Animation Generation in Dyadic Conversations

arXiv cs.CVResearch

Video-MME-Logical: A Controlled Diagnostic Benchmark for Video Temporal-Logical Reasoning

arXiv cs.CVResearch

CSD: Content-aware Speculative Decoding for Efficient Image Generation

arXiv cs.CVResearch

ScaLe-INR: Scale and Learn Implicit Neural Representations

arXiv cs.CVResearch

A Unified Framework for Vision Transformers Equivariant to Discrete Subgroups of $\mathrm{O}(2)$

arXiv cs.CVResearch

Long-Term Prediction of Local and Global Human Motion with Occlusion Recovery

arXiv cs.CVResearch

There and Back Again: A Flexible-Frame Transformer for Multi-Exposure Fusion

arXiv cs.CVResearch

Controllable Histopathology Image Synthesis with Training-free Structural Initialization and Textural Modulation

arXiv cs.CVResearch

Understanding How MLLMs Describe Artworks Using Token Activation Maps

arXiv cs.CVResearch

Latent Visual Diffusion Reasoning with Monte Carlo Tree Search

arXiv cs.CVResearch

HumanMoveVQA: Can Video MLLMs reason about human movement in videos?

arXiv cs.CVResearch

Curriculum-guided Change Detection Training: Toward Accurate Serac Fall Monitoring

arXiv cs.CVResearch

TempAct: Advancing Temporal Plausibility in Autoregressive Video Generation via Planner-Executor RL

arXiv cs.LGResearch

Reduction of Probabilistic Chemical Reaction Networks

arXiv cs.LGResearch

The Weakest Link Tells It All: Outcome-Supervised Process Reward Modeling via Learnable Credit Assignment

arXiv cs.LGResearch

PerturbCellRL: Verifier-Guided Reinforcement Learning for Single-Cell Perturbation Prediction

arXiv cs.LGResearch

Layerwise Progressive Freezing: A Training Scaffold for Depth-Scalable Binary Networks

arXiv cs.LGResearch

Difference of Convex Programming in the Wasserstein Space with Applications to MMD Optimization

arXiv cs.LGResearch

Accelerating Hierarchical Sparse Predictive Coding with Hybrid Amortized Inference

arXiv cs.LGResearch

A Comparison of Fusion Techniques for Multi-Modal Human Activity Recognition on the HARMES Dataset

arXiv cs.LGResearch

RECAST: Model Reconstruction via Counterfactual-Aware Wasserstein Geometry under Limited Data

arXiv cs.LGResearch

Benchmarking on Tasks That Matter: Dataset Selection for Preserving Model Rankings

arXiv cs.LGResearch

Fair Classification with Efficient and Post-hoc Controllable Fairness-Accuracy Trade-off

arXiv cs.LGResearch

When One Adapter Speaks for Many: Discovering Low-Rank Redundancy in Continual Fine-Tuning

arXiv cs.LGResearch

Autoencoder Architectures for Athlete Performance Scoring from Wearable Telemetry

arXiv cs.LGResearch

Recovering Sharp Conductivity Features in the Finite-Data Calder\'on Problem with Physics-Informed Neural Networks