AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

9482 stories from 30+ sources, refreshed continuously.

arXiv cs.CL (NLP)Research

RefineEvo: Planning-Guided Heuristic Evolution with Bidirectional Experience

arXiv cs.CL (NLP)Research

Beyond Sally-Anne: Evaluating Theory of Mind in LLMs using Epistemic Schelling Points

arXiv cs.CL (NLP)Research

Agentic Routing: The Harness-Native Data Flywheel

arXiv cs.CL (NLP)Research

Cross-Architecture LLM Ensembles, Feature-Based Reranking and Retrieval-Augmented Prompting for Legal Information Processing

arXiv cs.CL (NLP)Research

Confidently Wrong: Detecting Hallucinations in Financial Question Answering from LLM Internal States

arXiv cs.CL (NLP)Research

ToFu: A White-Box, Token-Efficient Agent Harness for Researchers

arXiv cs.CL (NLP)Research

Relational Positioning as a Measurable Risk Object: History-Carried Lock-in and Self-Confabulation in Multi-Turn Human-AI Dialogue

arXiv cs.CL (NLP)Research

UMoE:Unlocking Every Expert in Domain-Specific Training

arXiv cs.CL (NLP)Research

Are LLMs ready for HardChoices?

arXiv cs.CL (NLP)Research

LightMem-Ego: Your AI Memory for Everyday Life

arXiv cs.CL (NLP)Research

GEIS: A Generation-Evaluation-Improvement Loop of Agent Skills for Long-Form Article Generation

arXiv cs.CL (NLP)Research

PaperRouter-Agent: A Content-Grounded LLM Agent for Personalized Hierarchical Paper Routing

arXiv cs.CL (NLP)Research

Extending LLM Context via Associative Recurrent Memory

arXiv cs.CL (NLP)Research

RAGU: A Multi-Step GraphRAG Engine with a Compact Domain-Adapted LLM

arXiv cs.AIResearch

Incremental Transformer for Surrogate-Based Inverse Design of Geopolymer Mixtures

arXiv cs.AIResearch

QwenPaw-Data: Bridging Facts, Methodology, and Execution for Autonomous Enterprise Data Analytics

arXiv cs.AIResearch

AdvNav: Behavior-Guided Black-Box Adversarial Attacks on Vision-Language Navigation

arXiv cs.AIResearch

NVAITC AI Scientist: A Governed End-to-End Research System -- A Hypertension GWAS Case Study

arXiv cs.AIResearch

OS-Pruner: Pruning Chains-of-Thought of Reasoning Models via Optimal Stopping

arXiv cs.AIResearch

A Formal Hierarchical Architecture for Agentic Orchestration with Stack-Based Execution and Lazy Discovery

arXiv cs.AIResearch

NextFund: A Unified Performance Tracking Platform for Agentic Portfolio Management

arXiv cs.AIResearch

The Hidden Footprint: Making Storage a First-Class Metric for LLM Agent Evaluation

arXiv cs.AIResearch

STAMP: Provenance-Guided Credit Assignment for Deep Search Agents

arXiv cs.AIResearch

The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy

arXiv cs.AIResearch

SCALECUA: Scaling Computer Use Agents with Verifiable Task Synthesis and Efficient Online RL

arXiv cs.AIResearch

What We Talk About When We Talk About LLM Planning: Evidence for Two Distinct Planning Abilities

arXiv cs.AIResearch

Heterogeneous Agent Cohorts for Safe Open-Ended Exploration with Runtime Constraint Memory

arXiv cs.AIResearch

Valid $\ne$ Necessary: Diagnosing Latent Inefficiency in Chain-of-Thought

arXiv cs.AIResearch

Efficient Test-Time Optimization for Multi-Agent Proof Autoformalization

arXiv cs.AIResearch

Verifier-Guided Twelve-Tone Composition: A Generate-Verify-Repair Harness for Symbolic Music Generation

arXiv cs.AIResearch

Compile, Then Page: Executable SOP Programs and a Capability-Gated Runtime for Procedural LLM Agents

arXiv cs.AIResearch

From Neural Network Decisions to Training Cases: An Exact Account via Case-Based Decision Theory

arXiv cs.AIResearch

OpsMem: Dual-Memory Reasoning with Cross-Memory Resonance for Failure Diagnosis

arXiv cs.AIResearch

StructAgent: Harness Long-horizon Digital Agents with Unified Causal Structure

arXiv cs.CVResearch

Slot-RAE: Streamlining Object-Centric Learning via Direct Representation Auto-Encoders

arXiv cs.CVResearch

DynEval: Holistic Evaluations of T2I Generative Models in the Wild

arXiv cs.CVResearch

A Novel Method to Evaluate Models on Unreliable, Noisy and Inconsistent Labels: Adaptive Resolution Label Aggregation (ARLA)

arXiv cs.CVResearch

Structure-Detail Decoupled Autoregressive Generation for Fast and High-Fidelity Virtual Try-On

arXiv cs.CVResearch

LaGuadia: Language-Guided Adaptive Distillation from Pathology Foundation Models

arXiv cs.CVResearch

The Devil Is in the Leakage: A Disentangled Dual-Purification Framework for High-Fidelity Hairstyle Transfer