AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

9484 stories from 30+ sources, refreshed continuously.

arXiv cs.CL (NLP)Research

Per-Entity Bias Mapping for AI Visibility: Why Brand Mentions Require Entity-Specific Calibration

arXiv cs.CL (NLP)Research

LLM and Human Modes of Representation

arXiv cs.CL (NLP)Research

CulMind: Benchmarking Multimodal Understanding and Reasoning in Chinese Cultural Heritage

arXiv cs.CL (NLP)Research

Evaluating Document-Tuned Transformer Representations for Person-level Mental Health Assessment

arXiv cs.CL (NLP)Research

CuratorKIT : Data Curation and Synthetic Data Generation for LLM Post-Training

arXiv cs.CL (NLP)Research

Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models

arXiv cs.LGResearch

Robustness Cannot be Reduced to Regularization: Studying Adversarial Training Beyond the Linear Case

arXiv cs.LGResearch

LIG: Layer-wise Integrated Gradients for Within-Layer Flow Analysis in Transformers

arXiv cs.LGResearch

The Cost Geometry of Belief: finite-resource inference under noisy observation

arXiv cs.LGResearch

Geometric and Information Compression of Representations in Deep Learning

arXiv cs.LGResearch

Learning to Place Guards by Reinforcement: A Geo-Free Neural Policy for the Vertex-Guard Art Gallery Problem

arXiv cs.LGResearch

HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval

arXiv cs.LGResearch

A new classification method based on Minimum Spanning Trees

arXiv cs.LGResearch

Expressivity Saturation: Reduced Affine Region Usage Under Increasing Task Complexity

arXiv cs.CL (NLP)Research

EvoEmbedding: Evolvable Representations for Long-Context Retrieval and Agentic Memory

arXiv cs.CL (NLP)Research

TACO: Task-Aware Column Description Generation Using LLMs

arXiv cs.CL (NLP)Research

Clinical Term Extraction using Open-Source Small Language Models

arXiv cs.CL (NLP)Research

When Compression Helps and When It Hurts: Condition-Aware Analysis of Chain-of-Thought Distillation

arXiv cs.CL (NLP)Research

PrivacyAlign: Contextual Privacy Alignment for LLM Agents

arXiv cs.CL (NLP)Research

Denoising Iterative Self-Correction: Structured Verification Loops for Reliable LLM Reasoning

arXiv cs.CL (NLP)Research

CalVerT: Augmenting Agents with Calibrated Verifier Telemetry Improves Action and Learning in Knowledge-Intensive Tasks

arXiv cs.CL (NLP)Research

When to Plan, When to Polish: Noise Level as a Granularity Axis for Diffusion Language Models

arXiv cs.CL (NLP)Research

Test-Time Training with Next-Token Prediction

arXiv cs.CL (NLP)Research

Inverse Turing Bench: Evaluating Language Models as Judges of Human vs. AI Dialogue

arXiv cs.CL (NLP)Research

Keyless Attention: Value-Space Routing and Value-Only Caching for Efficient Transformers

arXiv cs.CL (NLP)Research

The Language-Energy Divide: Measuring Energy Costs of Multilingual LLM Inference

arXiv cs.CL (NLP)Research

Scaling Performance and Low-Resource Annotation with Many-Shot In-Context Learning for Named Entity Recognition

arXiv cs.CL (NLP)Research

Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding

arXiv cs.CL (NLP)Research

Pre-Generation Hallucination Detection in Large Language Models via Soft-Target Attention Probing

arXiv cs.CL (NLP)Research

Beyond Value Benchmarks: Measuring Value-Structure Alignment in Large Language Models via Symmetric Q-Sorts

arXiv cs.CL (NLP)Research

OpenBioRQ: Unsolved Biomedical Research Questions for Agents

arXiv cs.CL (NLP)Research

Can LLMs Control Readability? A Multi-Dimensional Evaluation Framework for CEFR-Controlled Arabic Generation

arXiv cs.CL (NLP)Research

Adding Robust Code-Switching Capabilities to High Performance Multilingual ASR

arXiv cs.CL (NLP)Research

Benchmarking Large Language Models for Grapheme-to-Phoneme Conversion: A Japanese Case Study

arXiv cs.AIResearch

The AI Evaluability Gap: The Missing Layer for Managing Risk and Sustaining Value

arXiv cs.AIResearch

Mind the Noise: Sensitivity of Transformer-based Interaction-Aware Trajectory Prediction Models to Noisy Data

arXiv cs.AIResearch

Calibration Is Not Control: Why LLM-Agent Oversight Needs Intervention

arXiv cs.AIResearch

Don't Blindly Trust It: How Unreliable Feedback Breaks Tool-Using LLM Agents

arXiv cs.AIResearch

AutoRAS: Learning Robust Agentic Systems with Primitive Representations

arXiv cs.AIResearch

Towards Transparent Mental Health Insights: An Explainable AI Model for Career-Related Depression and Anxiety Among University Students Using Structured Data