AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

24958 stories from 30+ sources, refreshed continuously.

arXiv cs.CL (NLP)Research

EduArt: An educational-level benchmark for evaluating art history knowledge in large language models

arXiv cs.CL (NLP)Research

OpenSafeIntent: Evaluating Intent-Calibrated Safe Completion Across Dual-Use Prompt Sets

arXiv cs.CL (NLP)Research

SPLIT: Cross-Lingual Empathy and Cultural Grounding in English and Ukrainian LLM Responses

arXiv cs.CL (NLP)Research

HaloGuard 1.0: An Open Weights Constitutional Classifier for Multilingual AI Safety

arXiv cs.CL (NLP)Research

Unlocking Speech-Text Compositional Powers: Instruction-Following Speech Language Models without Instruction Tuning

arXiv cs.CL (NLP)Research

Challenges and Recommendations for LLMs-as-a-Judge in Multilingual Settings and Low-Resource Languages

arXiv cs.CL (NLP)Research

World Wide Models: Literary Tools for Cultural AI

arXiv cs.CL (NLP)Research

HULAT2 at MER-TRANS 2026: Governed Multi-Agent Simplification for Spanish Easy-to-Read Generation

arXiv cs.CL (NLP)Research

Know Your Source: A Public Knowledge Store for Media Background Checks

arXiv cs.CL (NLP)Research

The Future of NLP may not be at NLP Conferences: Scholarly Migration Patterns in Natural Language Processing

arXiv cs.CL (NLP)Research

Language Models as Measurement Apparatus for Culture

arXiv cs.CL (NLP)Research

Will Scaling Improve Social Simulation with LLMs?

arXiv cs.AIResearch

Diverse Evidence, Better Forecasts: Multi-Agent Deliberation Under Information Asymmetry

arXiv cs.AIResearch

Separating Expert Retention from Autonomous Source Inference in Raw-ECG-Replay-Free Continual ECG Deployment

arXiv cs.AIResearch

COMFYCLAW: Self-Evolving Skill Harnesses for Image Generation Workflows

arXiv cs.AIResearch

Distributionally Robust Listwise Preference Optimization

arXiv cs.AIResearch

DRL-CLBA: A Clean Label Backdoor Attack for Speech Classification via DDPG Reinforcement Learning

arXiv cs.AIResearch

Meta-Benchmarks for Financial-Services LLM Evaluation

arXiv cs.AIResearch

Path-level Hindsight Instructions for Semantic Exploration in Vision-Language Navigation

arXiv cs.AIResearch

Mastermind: Strategy-grounded Learning for Repository-Scale Vulnerability Reproduction

arXiv cs.AIResearch

SimWorlds: A Multi-Agent System for Dynamic 3D Scene Creation

arXiv cs.AIResearch

Repair the Amplifier, Not the Symptom: Stable World-Model Correction for Agent Rollouts

arXiv cs.AIResearch

Subliminal Clocks: Latent Time Modelling in Diffusion Language Models

arXiv cs.AIResearch

Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification

arXiv cs.AIResearch

MMIR-TCM: Memory-Integrated Multimodal Inference and Retrieval for TCM Clinical Decision Support

arXiv cs.AIResearch

Pre-Flight: A Benchmark for Evaluating Large Language Models on Aviation Operational Knowledge

arXiv cs.AIResearch

CLAP: Closed-Loop Training, Evaluation, and Release Control for Domain Agent Post-training

arXiv cs.AIResearch

Safety Targeted Embedding Exploit via Refinement

arXiv cs.AIResearch

CamoNAS: Neural Architecture Search for Enhanced Camouflaged Object Detection

arXiv cs.AIResearch

SkillCoach: Self-Evolving Rubrics for Evaluating and Enhancing Agentic Skill-Use

arXiv cs.AIResearch

Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters

arXiv cs.AIResearch

Rethinking Complexity Metrics for LLM-Integrated Applications: Beyond Source Code

arXiv cs.CVResearch

NOVA: Next-step Open-Vocabulary Autoregression for 3D Multi-Object Tracking in Autonomous Driving

arXiv cs.CVResearch

Spectral and Trajectory Regularization for Diffusion Transformer Super-Resolution

arXiv cs.CVResearch

Active View Selection with Perturbed Gaussian Ensemble for Tomographic Reconstruction

arXiv cs.CVResearch

OSCAR: Occupancy-based Shape Completion via Acoustic Neural Implicit Representations

arXiv cs.CVResearch

SkipGS: Post-Densification Backward Skipping for Efficient 3DGS Training

arXiv cs.CVResearch

On the Reliability of Cue Conflict and Beyond

arXiv cs.CVResearch

Geo-ID: Test-Time Geometric Consensus for Cross-View Consistent Intrinsics

arXiv cs.CVResearch

Next-Frame Decoding for Ultra-Low-Bitrate Image Compression with Video Diffusion Priors