AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

25928 stories from 30+ sources, refreshed continuously.

arXiv cs.CL (NLP)Research

Evaluation of Small Language Models for Arabic Language Processing

arXiv cs.CL (NLP)Research

Towards Pedagogically Aligned LLM Tutors for Math Mistake Remediation

arXiv cs.CL (NLP)Research

Dissecting Agentic RAG: A Component Ablation for Multi-Hop QA with a Local 7B Model

arXiv cs.CL (NLP)Research

Rubric-as-Experts: Case-Specific MQM Rubrics for Translation Quality Evaluation

arXiv cs.CL (NLP)Research

Per-Entity Bias Mapping for AI Visibility: Why Brand Mentions Require Entity-Specific Calibration

arXiv cs.CL (NLP)Research

LLM and Human Modes of Representation

arXiv cs.CL (NLP)Research

CulMind: Benchmarking Multimodal Understanding and Reasoning in Chinese Cultural Heritage

arXiv cs.CL (NLP)Research

Evaluating Document-Tuned Transformer Representations for Person-level Mental Health Assessment

arXiv cs.CL (NLP)Research

CuratorKIT : Data Curation and Synthetic Data Generation for LLM Post-Training

arXiv cs.CL (NLP)Research

Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models

arXiv cs.LGResearch

Robustness Cannot be Reduced to Regularization: Studying Adversarial Training Beyond the Linear Case

arXiv cs.LGResearch

LIG: Layer-wise Integrated Gradients for Within-Layer Flow Analysis in Transformers

arXiv cs.LGResearch

The Cost Geometry of Belief: finite-resource inference under noisy observation

arXiv cs.LGResearch

Geometric and Information Compression of Representations in Deep Learning

arXiv cs.LGResearch

Learning to Place Guards by Reinforcement: A Geo-Free Neural Policy for the Vertex-Guard Art Gallery Problem

arXiv cs.LGResearch

HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval

arXiv cs.LGResearch

A new classification method based on Minimum Spanning Trees

arXiv cs.LGResearch

Expressivity Saturation: Reduced Affine Region Usage Under Increasing Task Complexity

arXiv cs.CL (NLP)Research

EvoEmbedding: Evolvable Representations for Long-Context Retrieval and Agentic Memory

arXiv cs.CL (NLP)Research

TACO: Task-Aware Column Description Generation Using LLMs

arXiv cs.CL (NLP)Research

Clinical Term Extraction using Open-Source Small Language Models

arXiv cs.CL (NLP)Research

When Compression Helps and When It Hurts: Condition-Aware Analysis of Chain-of-Thought Distillation

arXiv cs.CL (NLP)Research

PrivacyAlign: Contextual Privacy Alignment for LLM Agents

arXiv cs.CL (NLP)Research

Denoising Iterative Self-Correction: Structured Verification Loops for Reliable LLM Reasoning

arXiv cs.CL (NLP)Research

CalVerT: Augmenting Agents with Calibrated Verifier Telemetry Improves Action and Learning in Knowledge-Intensive Tasks

arXiv cs.CL (NLP)Research

When to Plan, When to Polish: Noise Level as a Granularity Axis for Diffusion Language Models

arXiv cs.CL (NLP)Research

Test-Time Training with Next-Token Prediction

arXiv cs.CL (NLP)Research

Inverse Turing Bench: Evaluating Language Models as Judges of Human vs. AI Dialogue

arXiv cs.CL (NLP)Research

Keyless Attention: Value-Space Routing and Value-Only Caching for Efficient Transformers

arXiv cs.CL (NLP)Research

The Language-Energy Divide: Measuring Energy Costs of Multilingual LLM Inference

arXiv cs.CL (NLP)Research

Scaling Performance and Low-Resource Annotation with Many-Shot In-Context Learning for Named Entity Recognition

arXiv cs.CL (NLP)Research

Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding

arXiv cs.CL (NLP)Research

Pre-Generation Hallucination Detection in Large Language Models via Soft-Target Attention Probing

arXiv cs.CL (NLP)Research

Beyond Value Benchmarks: Measuring Value-Structure Alignment in Large Language Models via Symmetric Q-Sorts

arXiv cs.CL (NLP)Research

OpenBioRQ: Unsolved Biomedical Research Questions for Agents

arXiv cs.CL (NLP)Research

Can LLMs Control Readability? A Multi-Dimensional Evaluation Framework for CEFR-Controlled Arabic Generation

arXiv cs.CL (NLP)Research

Adding Robust Code-Switching Capabilities to High Performance Multilingual ASR

arXiv cs.CL (NLP)Research

Benchmarking Large Language Models for Grapheme-to-Phoneme Conversion: A Japanese Case Study

arXiv cs.AIResearch

The AI Evaluability Gap: The Missing Layer for Managing Risk and Sustaining Value

arXiv cs.AIResearch

Mind the Noise: Sensitivity of Transformer-based Interaction-Aware Trajectory Prediction Models to Noisy Data