AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

24923 stories from 30+ sources, refreshed continuously.

arXiv cs.CL (NLP)Research

Safeguarding LLM Agents from Misalignment through Provenance Analysis

arXiv cs.CL (NLP)Research

Kara: Efficient Reasoning LLM Serving via Sliding-Window KV Cache Compression

arXiv cs.CL (NLP)Research

Breaking Safety at the Token Boundary: How BPE Tokenization Creates Exploitable Gaps in LLM Alignment

arXiv cs.CL (NLP)Research

Prompt Framing Distorts Count-Based Evaluation of LLM Error Detection: Evidence from Numeric Anchoring

arXiv cs.CL (NLP)Research

Mapping Text to Multiplex Graph: Prompt Compression as L\'evy Walk-Guided Graph Pruning

arXiv cs.CL (NLP)Research

Office Comprehension Benchmark

arXiv cs.CL (NLP)Research

RuleChef: Grounding LLM Task Knowledge in Human-Editable Rules

arXiv cs.CL (NLP)Research

Multi-Objective Exploration and Preference Optimization via Mutual Information

arXiv cs.CL (NLP)Research

MultAttnAttrib: Training-Free Multimodal Attribution in Long Document Question Answering

arXiv cs.CL (NLP)Research

IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning versus Knowledge Retrieval in LLMs

arXiv cs.CL (NLP)Research

FaithMed: Training LLMs For Faithful Evidence-Based Medical Reasoning

arXiv cs.CL (NLP)Research

Grounded Optimization: A Layered Engineering Framework for Reducing LLM Hallucination in Automated Personal Document Rewriting

arXiv cs.CL (NLP)Research

Comparing Architectures for Supervised Political Scaling

arXiv cs.CL (NLP)Research

Parameter Golf: What Really Works?

arXiv cs.CL (NLP)Research

DiPS: Dialogue Policy Selection for High-Stakes Persuasion Agents

arXiv cs.CL (NLP)Research

Beyond Skepticism: Evaluating LLMs Pedagogical Intent Reasoning with the Adaptive Pedagogical Vigilance Framework

arXiv cs.CL (NLP)Research

ProWAFT: A ROMA-LPD Instance for Workload-Aware and Dynamic Fault Tolerance in FPGA-Based CNN Accelerators

arXiv cs.CL (NLP)Research

Rethinking Speech-LLM Integration for ASR: Effective Joint Speech-Text Training by Interleaving

arXiv cs.CL (NLP)Research

PARTREP: Learning What to Repeat for Decoder-only LLMs

arXiv cs.AIResearch

PACE: A Neuro-Symbolic Framework for Plausible and Actionable Counterfactual Explanations

arXiv cs.AIResearch

Auto-FL-Research: Agentic Search for Federated Learning Algorithms

arXiv cs.AIResearch

The Wiola Architecture for Efficient Small Language Models

arXiv cs.AIResearch

Agent4cs: A Multi-agent System for Code Summarization in Large Hierarchical Codebases

arXiv cs.AIResearch

When Should Service Agents Reconsider? Difficulty-Routed Control in Customer-Service Operations

arXiv cs.AIResearch

CreativityNeuro: Steering Language Model Weights to Improve Divergent Thinking and Reduce Mode Collapse

arXiv cs.AIResearch

Discrete Diffusion Language Models for Interactive Radiology Report Drafting

arXiv cs.AIResearch

Beyond Next-Token Prediction: An RLVR Proof of Concept for Tool-Use Agents on Atlassian Workflows

arXiv cs.AIResearch

World Feedback for Clinical Agents: Diagnosing RL in FHIR Environments

arXiv cs.AIResearch

The Agentic Garden of Forking Paths

arXiv cs.AIResearch

Janus: a Playground for User-Involved Agentic Permission Management

arXiv cs.AIResearch

Revisiting Chain-of-Thought Reasoning under Limited Supervision: Semi-supervised Chain-of-Thought Learning

arXiv cs.AIResearch

OPINE-World: Programmatic World Modeling with Ontology-error-Prioritized Interactive Exploration

arXiv cs.AIResearch

EO-Agents: A Three-Agent LLM Pipeline for Earth Observation Hypothesis Generation

arXiv cs.AIResearch

Hawk: Harnessing Hardware-Aware Knowledge for High-Performance NPU Kernel Generation

arXiv cs.AIResearch

Safe and Adaptive Cloud Healing: Verifying LLM-Generated Recovery Plans with a Neural-Symbolic World Model

arXiv cs.AIResearch

SemHash-LLM: A Multi-Granularity Semantic Hashing Framework for Document Deduplication

arXiv cs.AIResearch

Profit-Based Counterfactual Explanations for Product Improvement: A Case Study of Manga Sales in Japan

arXiv cs.AIResearch

Scaling with Confidence: Calibrating Confidence of LLMs for Adaptive Test Time Scaling

arXiv cs.AIResearch

Autonomous discovery of traffic laws with AI traffic scientists

arXiv cs.CVResearch

LeVLJEPA: End-to-End Vision-Language Pretraining Without Negatives