AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

25159 stories from 30+ sources, refreshed continuously.

arXiv cs.LGResearch

EvoClawBench: Can Agents Learn Reusable Skills from Their Own Runs?

arXiv cs.LGResearch

Gauge dependence and structured-output corruption in sign-branched repetition penalties: measurements across models, inference stacks, and alternative repetition controls

arXiv cs.LGResearch

Metadata-Free Meta-Reweighted Direct Preference Optimization under Noisy Preference Labels

arXiv cs.LGResearch

The Silent Freeze: Predicting When Low-Precision Training Stops Learning

arXiv cs.LGResearch

Quota Marketplace: Dynamic Pricing for Efficient Allocation of ML Training Resources

arXiv cs.LGResearch

Spectral Origins of the Self-Correction Blind Spot in Autoregressive Generation

arXiv cs.LGResearch

From Direction to Magnitude: How Multimodal Instruction-Tuning Reorganizes the Geometric Encoding of Identity-Specifying Prompts in Transformer Hidden States

arXiv cs.LGResearch

Serving the Long Tail: Training-Free LLM Candidate Generation for Vacation Rental Marketplaces

arXiv cs.LGResearch

Vilya-1: An all-atom foundation model for macrocycle structure prediction and design

arXiv cs.LGResearch

MLPs are Hebbians: Constructing Efficient Fact-Storing MLPs for Transformers

arXiv cs.LGResearch

FlashTrie: A GPU-Accelerated Constrained Beam Search for Generative Retrieval

arXiv cs.LGResearch

Conservation Laws for Diffusion Models

arXiv cs.CL (NLP)Research

Index SLM Technical Report

arXiv cs.CL (NLP)Research

RouteRec: Strict Evaluation of Recommender-Agent Selection and Aggregation

arXiv cs.CL (NLP)Research

Faithful by Design: Evaluating and Improving LLM-Generated Clinical Trial Summaries for Multi-Stakeholder Audiences

arXiv cs.CL (NLP)Research

Workload-Driven Optimization for On-Device Real-Time Subtitle Translation

arXiv cs.CL (NLP)Research

Silent Failures in Quantized LLM Reasoning: A Taxonomy-Based Analysis of Hollow Convergence and Failure Mode Shifts

arXiv cs.CL (NLP)Research

Efficiently Adapting Spoken Language Models for the Singaporean Context

arXiv cs.CL (NLP)Research

Cost of Reasoning in non-English Languages: A Case Study on Japanese

arXiv cs.CL (NLP)Research

Equal Accuracy, Unequal Evidence: Search APIs as Decision Surfaces for Tool-Using Agents

arXiv cs.CL (NLP)Research

Consensus vs. Dissent: Dynamic LLM Modeling of Subjective Preferences in Group Recommenders

arXiv cs.CL (NLP)Research

PTEI: Integrating Personality Traits to Enhance Emotional Intelligence in Large Language Models

arXiv cs.CL (NLP)Research

PolyInterview: An LLM-based Platform for Immersive Mock Interview Practice with Comprehensive Multimodal Assessment

arXiv cs.CL (NLP)Research

Neutralizing Structural Inequality in the Nigerian FinTech Sector

arXiv cs.CL (NLP)Research

CAFE: A Compound-AI Factorial Evaluation Framework

arXiv cs.CL (NLP)Research

Structured Thoughts For Improved Reasoning And Context Pruning

arXiv cs.CL (NLP)Research

A Stepwise Questioning Expert-Editor Multi-Agent Framework for Long-Document Summarization

arXiv cs.CL (NLP)Research

Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging

arXiv cs.CL (NLP)Research

Hallucination Detection in Large Language Models Using Diversion Decoding

arXiv cs.CL (NLP)Research

When Reasoning Hurts Legal Drafting: The Verbalization Bottleneck in Patent Claim Generation

arXiv cs.CL (NLP)Research

Articulate Intuition or Genuine Analysis? Benchmarking Epistemic Reliability in LLM-as-a-Judge Peer Reviews

arXiv cs.CL (NLP)Research

UNIBROWSE: A Data-to-Agent Framework for Multimodal BrowseComp

arXiv cs.AIResearch

Semantic Drift and the Stability of Operator Control in Reasoning-Class Decision Support Systems

arXiv cs.AIResearch

Agentic Context Learning with Self-Discovered Specification

arXiv cs.AIResearch

Exploring Agentic Workflows for Generating High Quality Math Visual Aids

arXiv cs.AIResearch

Who&When Pro: Can LLMs Really Attribute Failures in AI Agents?

arXiv cs.AIResearch

A Symbolic Neural CPU for Quantization-Simulated Writeback and Interpretable Program Execution

arXiv cs.AIResearch

AgentAbstain: Do LLM Agents Know When Not to Act?

arXiv cs.AIResearch

MAG: A Web-Agent Benchmark and Harness for Multimodal Action and Guide Generation