AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

9571 stories from 30+ sources, refreshed continuously.

arXiv cs.LGResearch

What Do Language Priors Contribute to Darcy-Flow Inversion? A Mechanistic Audit

arXiv cs.LGResearch

Training Dynamics of Neural Software Defect Predictors under Coupled Data-Quality Issues

arXiv cs.LGResearch

Frequency Domain Reservoir Computing

arXiv cs.LGResearch

Don't Go Breaking My LLM: The Impact of Pruning Attention Layers on Explanation Faithfulness and Confidence Calibration

arXiv cs.LGResearch

Quantifying Explainable AI-introduced signal noise on ECG data with Spectral Entropy

arXiv cs.LGResearch

Auto-Configured Explainable Graph Neural Networks for Multi-Site Pollution Prediction

arXiv cs.LGResearch

Closed-Loop Graph Algorithm Execution with Small Language Models: Step Accuracy and Rollout Reliability

arXiv cs.LGResearch

A Single Stepsize Suffices for Unprojected Linear TD(0): Simultaneous Robust and Fast Rates via Polyak--Ruppert Averaging

arXiv cs.LGResearch

Latent Block-Diffusion Temporal Point Processes: A Semi-Autoregressive Framework for Asynchronous Event Sequence Generation

arXiv cs.LGResearch

Retrieval-Augmented Personalization with Foundation Models for Wearable Stress Detection

arXiv cs.CL (NLP)Research

Small edits, large models: How Wikipedia advocacy shapes LLM values

arXiv cs.CL (NLP)Research

AgentOdyssey: Open-Ended Long-Horizon Text Game Generation for Test-Time Continual Learning Agents

arXiv cs.CL (NLP)Research

Error-Aware TF-IDF Retrieval-Augmented Generation for ASR Error Correction

arXiv cs.CL (NLP)Research

Dustin: Draft-Augmented Sparse Verification for Efficient Long-Context Generation with Speculative Decoding

arXiv cs.CL (NLP)Research

LLM Performance on a Real, Double-Marked GCSE Benchmark

arXiv cs.CL (NLP)Research

LLM-Based Scientific Peer Review: Methods, Benchmarks, and Reliability Challenges

arXiv cs.CL (NLP)Research

Dream at SemEval-2026 Task 13: SALSA for Single-Pass Machine-Generated Code Detection

arXiv cs.CL (NLP)Research

Hitting a Moving Target: Test-Time Adaptation for AI Text Detection under Continual Distribution Shift

arXiv cs.CL (NLP)Research

What Intermediate Layers Know: Detecting Jailbreaks from Entropy Dynamics

arXiv cs.CL (NLP)Research

Automatic Generation of Highlights for Academic Paper Via Prompt-based Learning

arXiv cs.CL (NLP)Research

Improved Large Language Diffusion Models

arXiv cs.CL (NLP)Research

Hybrid-IR: Dual-Path Hybrid Retrieval with Iterative Reasoning for Complex Medical Question Answering

arXiv cs.CL (NLP)Research

Memory Makes the Difference: Evaluating How Different Memory Roles Shape Conversational Agents

arXiv cs.CL (NLP)Research

Neural Machine Translation for Low-Resource Tangkhul--English

arXiv cs.CL (NLP)Research

A Survey of Toxicity Detection and Mitigation Strategies for Multilingual Language Models

arXiv cs.CL (NLP)Research

Beyond Next-Observation Prediction: Agent-Authored World Modeling for Sequential Decision Making

arXiv cs.CL (NLP)Research

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models

arXiv cs.CL (NLP)Research

Optimizing Abstractive Summarization With Fine-Tuned PEGASUS

arXiv cs.CL (NLP)Research

A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation

arXiv cs.CL (NLP)Research

How Reliable Is Your Jailbreak Judge? Calibration and Adversarial Robustness of Automated ASR Scoring

arXiv cs.AIResearch

WinDOM: Self-Family Distillation for Small-Model GUI Grounding

arXiv cs.AIResearch

InvestPhilBench: A Multi-Layer Dynamic Benchmark for Evaluating Large Language Model Procedural Reasoning in Expert Investment Philosophy

arXiv cs.AIResearch

Autodata: An agentic data scientist to create high quality synthetic data

arXiv cs.AIResearch

The Unfireable Safety Kernel: Execution-Time AI Alignment for AI Agents and Other Escapable AI Systems

arXiv cs.AIResearch

ReviewGuard: Aligning LLM-Assisted Peer Review with Long-Term Scientific Impact

arXiv cs.AIResearch

RWGBench: Evaluating Scholarly Positioning in Related Work Generation

arXiv cs.AIResearch

Failure Modes of Large Language Models on Research-Level Mathematics: A Taxonomy and an Empirical Characterisation

arXiv cs.AIResearch

Recursive QLSTM with Dynamic Variational Quantum Circuit Adaptation

arXiv cs.AIResearch

Self-Modulating Quantum Fast-Weight Programmers for Efficient Adaptive Sequential Learning

arXiv cs.AIResearch

Stable-Shift: Biologically Structured Prediction of Transcriptional Responses to Unseen Gene Perturbations