AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

9482 stories from 30+ sources, refreshed continuously.

arXiv cs.LGResearch

Emyx: Fast and efficient all-atom protein generation

arXiv cs.LGResearch

A Hybrid GNN-FEM Framework for Phase-Field Fracture Simulation. Physics-Preserving Hybridization for Generalizable Surrogate Modeling

arXiv cs.LGResearch

How Linear Is a Transformer Feed-Forward Block? Per-Block Linear Recoverability Is Learned, Not Architectural

arXiv cs.LGResearch

VERITAS: Verifier-Guided Proof Search for Zero-Shot Formal Theorem Proving

arXiv cs.LGResearch

Thermodynamic Signatures of Reasoning: Free-Energy and Spectral-Form-Factor Diagnostics for Hallucination Detection in Large Language Models

arXiv cs.LGResearch

Spectral DPPs via NEPv: A Scalable Continuous Relaxation of Determinantal MAP for Diversity-Aware Data Selection

arXiv cs.LGResearch

Spectral Retrieval-Augmented Time-Series Forecasting

arXiv cs.LGResearch

MortarBench: Evaluating Mortgage Loan Origination Agents

arXiv cs.LGResearch

Can In-Context Learning Support Intrinsic Curiosity?

arXiv cs.LGResearch

Insulin4RL: Real-Time Insulin Management in the Intensive Care Unit for Offline Reinforcement Learning

arXiv cs.LGResearch

Algebraic Dead Directions in LayerNorm Transformers: A Forward-Pass-Only Diagnostic at LLM Scale

arXiv cs.LGResearch

Calibrating Generative Models to Feature Distributions with MMD Finetuning

arXiv cs.CL (NLP)Research

Exposing the Unsaid: Visualizing Hidden LLM Bias through Stochastic Path Aggregation

arXiv cs.CL (NLP)Research

Ensembles of Large Language Models for Identifying EQ-5D Studies in PubMed Based on Their Abstracts

arXiv cs.CL (NLP)Research

Disentangling Linguistic Relatedness from Task Alignment in Cross-Lingual Transfer

arXiv cs.CL (NLP)Research

How LLMs Fail and Generalize in RTL Coding for Hardware Design?

arXiv cs.CL (NLP)Research

Where to Place the Query? Unveiling and Mitigating Positional Bias in In-Context Learning for Diffusion LLMs via Decoding Dynamics

arXiv cs.CL (NLP)Research

Pruning via Causal Attribution Preserves Reasoning Performance in Large Language Models

arXiv cs.CL (NLP)Research

Detecting Hallucinations for Large Language Model-based Knowledge Graph Reasoning

arXiv cs.CL (NLP)Research

Quantifying Aleatoric Uncertainty of In-Context Learning for Robust Measure of LLM Prediction Confidence

arXiv cs.CL (NLP)Research

Granularity-Regulated Adaptive Computational Efficiency for Optimal Verification in Test-Time Scaling

arXiv cs.CL (NLP)Research

Trustworthy Multi-Agent Systems: Mitigating Semantic Drift with the Argent Signaling Protocol

arXiv cs.CL (NLP)Research

Characterizing Narrative Content in Web-scale LLM Pretraining Data

arXiv cs.CL (NLP)Research

Reliability without Validity: A Systematic, Large-Scale Evaluation of LLM-as-a-Judge Models Across Agreement, Consistency, and Bias

arXiv cs.CL (NLP)Research

Where Does Social Reasoning Come From? Capability Provenance in Language Models

arXiv cs.CL (NLP)Research

Before the Labels: How Dataset Construction Shapes Suicidality Detection in Clinical Text

arXiv cs.CL (NLP)Research

MiqraBERT: Regression-Based Sentence-BERT Finetuning for Biblical Hebrew Parallel Detection

arXiv cs.CL (NLP)Research

Creating Multilingual Mental Health Dialogue Datasets: Limits of Persona-Based Localization via Nationality and Language

arXiv cs.CL (NLP)Research

From 50K to 8.2 Million in 24 Hours: Vozinha's Algorithmic Consecration and the Multilingual Making of World Cup Visibility

arXiv cs.CL (NLP)Research

SAGE-OPD: Selective Agent-Guided Intervention for Multi-Turn On-Policy Distillation

arXiv cs.CL (NLP)Research

CacheWeaver: Cache-Aware Evidence Ordering for Efficient Grounded RAG Inference

arXiv cs.CL (NLP)Research

Code-Switching Reveals Language Anchoring in Multilingual LLMs

arXiv cs.AIResearch

Grounded Inference: Principles for Deterministically Encapsulated Generative Models

arXiv cs.AIResearch

Beyond Entropy: Learning from Token-Level Distributional Deviations for LLM Reasoning

arXiv cs.AIResearch

AgentFinVQA: A Deployable Multi-Agent Pipeline for Auditable Financial Chart QA

arXiv cs.AIResearch

ORAgentBench: Can LLM Agents Solve Challenging Operations Research Tasks End to End?

arXiv cs.AIResearch

CombEval: A Framework for Evaluating Combinatorial Counting in Large Language Models

arXiv cs.AIResearch

Human-on-the-Loop Orchestration for AI-Assisted Legal Discovery

arXiv cs.AIResearch

TelcoAgent: A Scalable 5G Multi-KPM Forecasting With 3GPP-Grounded Explainability

arXiv cs.AIResearch

A Systematic Evaluation of Black-Box Uncertainty Estimation Methods for Large Language Models