AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

25635 stories from 30+ sources, refreshed continuously.

arXiv cs.CL (NLP)Research

LoHoSearch: Benchmarking Long-Horizon Search Agents Beyond the Human Difficulty Ceiling

arXiv cs.CL (NLP)Research

EvoArena: Tracking Memory Evolution for Robust LLM Agents in Dynamic Environments

arXiv cs.CL (NLP)Research

MORTAR: Multi-turn Metamorphic Testing for LLM-based Dialogue Systems

arXiv cs.CL (NLP)Research

Depth-Width tradeoffs in Algorithmic Reasoning of Graph Tasks with Transformers

arXiv cs.AIResearch

NAVI-Orbital: First In-Orbit Demonstration of a Zero-Shot Vision-Language Model for Autonomous Earth Observation

arXiv cs.AIResearch

CaVe-VLM-CoT: An Interpretable Vision-Language Model Framework

arXiv cs.AIResearch

Searching for Synergy in Shared Workspace Human-AI Collaboration

arXiv cs.AIResearch

DeFAb: A Verifiable Benchmark for Defeasible Abduction in Foundation Models

arXiv cs.AIResearch

What Must Generalist Agents Remember?

arXiv cs.AIResearch

R2D-RL: A RoboCup 2D Soccer Environment for Multi-Agent Reinforcement Learning

arXiv cs.AIResearch

ProfiLLM: Utility-Aligned Agentic User Profiling for Industrial Ride-Hailing Dispatch

arXiv cs.AIResearch

WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents

arXiv cs.AIResearch

Externalizing Research Synthesis and Validation in AI Scientists through a Research Harness

arXiv cs.AIResearch

Generative-Model Predictive Planning for Navigation in Partially Observable Environments

arXiv cs.AIResearch

Skill-Guided Continuation Distillation for GUI Agents

arXiv cs.AIResearch

SciRisk-Bench: A Risk-Dimension-Aware Benchmark for AI4Science Safety

arXiv cs.AIResearch

RTSGameBench: An RTS Benchmark for Strategic Reasoning by Vision-Language Models

arXiv cs.AIResearch

RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents

arXiv cs.AIResearch

ARIADNE: Agnostic Routing for Inference-time Adapter DyNamic sElection

arXiv cs.AIResearch

Towards an Agent-First Web: Redesigning the Web for AI Agents

arXiv cs.AIResearch

Analysing drivers and interdependencies in European electricity markets using XAI

arXiv cs.AIResearch

Beyond Safe Data: Pretraining-Stage Alignment with Regular Safety Reflection

arXiv cs.AIResearch

TxBench-PP: Analyzing AI Agent Performance on Small-Molecule Preclinical Pharmacology

arXiv cs.AIResearch

X+Slides: Benchmarking Audience-Conditioned Slide Generation

arXiv cs.CVResearch

Hybrid Transformer-Mamba for Weakly Supervised Volumetric Medical Segmentation

arXiv cs.CVResearch

MUFASA: A Multi-Layer Framework for Slot Attention

arXiv cs.CVResearch

How far have we gone in Generative Image Restoration? A study on its capability, limitations and evaluation practices

arXiv cs.CVResearch

Zero-Shot Cross-City Generalization in End-to-End Autonomous Driving: Self-Supervised versus Supervised Representations

arXiv cs.CVResearch

HACMatch Semi-Supervised Rotation Regression with Hardness-Aware Curriculum Pseudo Labeling

arXiv cs.CVResearch

CAMEO: A Conditional and Quality-Aware Multi-Agent Image Editing Orchestrator

arXiv cs.CVResearch

Cross-Lingual Learning within Arabic Script for Low-Resource HTR

arXiv cs.CVResearch

Improving Visual Token Reduction via Rectifying Distortions for Efficient Multimodal LLM Inference

arXiv cs.CVResearch

Would you still call this Dax? Novel Visual References in VLMs and Humans

arXiv cs.CVResearch

Geometry-Aware Dataset Condensation for Diffusion Model Training

arXiv cs.CVResearch

Physics in 2-Steps: Locking Motion Priors Before Visual Refinement Erases Them

arXiv cs.CVResearch

SegmentAnyTreeV2: Scaling Transformer-Based Tree Instance Segmentation Across Sensors, Platforms, and Forests

arXiv cs.CVResearch

Adv-TGD: Adversarial Text-Guided Diffusion for Face Recognition Impersonation Attacks

arXiv cs.CVResearch

Benchmarking Physics-Informed Time-Series Models for Operational Global Station Weather Forecasting

arXiv cs.CVResearch

Efficient Image-to-Image Schr\"odinger Bridge for CT Field of View Extension

arXiv cs.CVResearch

SPARX: Secure and Privacy-Aware Approximate CNN Acceleration with Edge RISC-V SoC