AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

24984 stories from 30+ sources, refreshed continuously.

arXiv cs.LGResearch

Do LLMs Truly Generalize in the Molecular Domain? A Perturbation-Based Analysis

arXiv cs.LGResearch

Many Voices, One Reward: Multi-Role Rubric Generation for LLM Judging and Reward Modeling

arXiv cs.LGResearch

Zeus: Towards Tuning-Free Foundation Model for Time Series Analysis

arXiv cs.LGResearch

Hybrid quantum-classical neural network for sentiment analysis

arXiv cs.LGResearch

A More Accurate Algorithm Comparison through A/B Testing using Offline Evaluation Methods

arXiv cs.LGResearch

Probabilistic Low-Voltage Peak Load Forecasting with Time Series Foundation Models Evaluated on Application-Oriented Metrics

arXiv cs.LGResearch

Liquid Latent State Dynamics for Interpretable Turbofan Degradation Modeling

arXiv cs.LGResearch

Fast and Accurate Anomaly Detection in Time Series

arXiv cs.LGResearch

A Memory Efficient Unified Algorithm for Online Learning of Linear Dynamical Systems

arXiv cs.LGResearch

Fourier Neural Operators for Rayleigh-B\'enard Convection

arXiv cs.LGResearch

Ask the Right Comparison:Bias-Aware Bayesian Active Top-$k$ Ranking with LLM Judges

arXiv cs.LGResearch

Probing Chemical Language Models: Effects of Pre-training and Fine-tuning

arXiv cs.LGResearch

Bayesian Sparse Low-Rank Adaptation for Large Language Model Uncertainty Estimation

arXiv cs.LGResearch

Privacy-Preserving and Verifiable Approximate Distributed Coded Computing

arXiv cs.LGResearch

An Optimisation Framework for the Well-Conditioned Training of Physics-Informed Neural Networks

arXiv cs.LGResearch

Self-explainable Operator Learning for Discovering Spatial Patterns in Functional Data

arXiv cs.CL (NLP)Research

Black-Box Inference of LLM Architectural Properties with Restrictive API Access

arXiv cs.CL (NLP)Research

Reasoning LLM Improves Speaker Recognition in Long-form TV Dramas

arXiv cs.CL (NLP)Research

LACUNA: A Testbed for Evaluating Localization Precision for LLM Unlearning

arXiv cs.CL (NLP)Research

ExPerT: Personalizing LLM Responses to Users' Domain Expertise via Query-Wise Semantic and Keystroke Behavioral Cues

arXiv cs.CL (NLP)Research

Structuring the Space of Sociotechnical Alignment

arXiv cs.CL (NLP)Research

Multi-Head Recurrent Memory Agents

arXiv cs.CL (NLP)Research

ADVENT: LLM-Driven Automatic Predicate Invention for ILP

arXiv cs.CL (NLP)Research

AgenticDataBench: A Comprehensive Benchmark for Data Agents

arXiv cs.CL (NLP)Research

Evaluating Chunking Strategies for Retrieval-Augmented Generation on Academic Texts

arXiv cs.CL (NLP)Research

PhysMani: Physics-principled 3D World Model for Dynamic Object Manipulation

arXiv cs.CL (NLP)Research

Multimodal Knowledge Edit-Scoped Generalization for Online Recursive MLLM Editing

arXiv cs.CL (NLP)Research

PACE: A Proxy for Agentic Capability Evaluation

arXiv cs.CL (NLP)Research

ESC: Emotional Self-Correction for Reliable Vision-Language Models

arXiv cs.CL (NLP)Research

AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents

arXiv cs.CL (NLP)Research

HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures

arXiv cs.CL (NLP)Research

SkillFuzz: Fuzzing Skill Composition for Implicit Intents Discovery in Open Skill Marketplaces

arXiv cs.CL (NLP)Research

Automated grading of Linux/bash examinations using large language models: a four-level cognitive taxonomy approach

arXiv cs.CL (NLP)Research

EvoPolicyGym: Evaluating Autonomous Policy Evolution in Interactive Environments

arXiv cs.CL (NLP)Research

Towards Robustness against Typographic Attack with Training-free Concept Localization

arXiv cs.CL (NLP)Research

What LLM Agents Say When No One Is Watching: Social Structure and Latent Objective Emergence in Multi-Agent Debates

arXiv cs.AIResearch

ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair

arXiv cs.AIResearch

ElephantAgent: Contextual State Continuity in Agentic Systems

arXiv cs.AIResearch

A-TMA: Decoupling State-Aware Memory Failures in Long-Term Agent Memory

arXiv cs.AIResearch

Atomic Task Graph: A Unified Framework for Agentic Planning and Execution