AiAnyTool - Best AI Tools Directory and Artificial Intelligence Software Hub Logo
Loading theme toggle

Real-Time Coverage

AI News Today

Live

24923 stories from 30+ sources, refreshed continuously.

arXiv cs.CL (NLP)Research

AIriskEval-edu: New Dataset for Risk Assessment in AI-mediated K-12 Educational Explanations

arXiv cs.CL (NLP)Research

NAVER LABS Europe Submission to the Instruction-following 2026 Short Track

arXiv cs.CL (NLP)Research

Beyond Supervised Clarification: Input Rewriting with LLMs for Dialogue Discourse Parsing

arXiv cs.CL (NLP)Research

Towards a Phonology-Informed Evaluation of Multilingual TTS

arXiv cs.CL (NLP)Research

Object Aligner: A Configurable JSON Schema Similarity Score for Graphs, Applied to LLM Prompt Optimization

arXiv cs.CL (NLP)Research

EduArt: An educational-level benchmark for evaluating art history knowledge in large language models

arXiv cs.CL (NLP)Research

OpenSafeIntent: Evaluating Intent-Calibrated Safe Completion Across Dual-Use Prompt Sets

arXiv cs.CL (NLP)Research

SPLIT: Cross-Lingual Empathy and Cultural Grounding in English and Ukrainian LLM Responses

arXiv cs.CL (NLP)Research

HaloGuard 1.0: An Open Weights Constitutional Classifier for Multilingual AI Safety

arXiv cs.CL (NLP)Research

Unlocking Speech-Text Compositional Powers: Instruction-Following Speech Language Models without Instruction Tuning

arXiv cs.CL (NLP)Research

Challenges and Recommendations for LLMs-as-a-Judge in Multilingual Settings and Low-Resource Languages

arXiv cs.CL (NLP)Research

World Wide Models: Literary Tools for Cultural AI

arXiv cs.CL (NLP)Research

HULAT2 at MER-TRANS 2026: Governed Multi-Agent Simplification for Spanish Easy-to-Read Generation

arXiv cs.CL (NLP)Research

Know Your Source: A Public Knowledge Store for Media Background Checks

arXiv cs.CL (NLP)Research

The Future of NLP may not be at NLP Conferences: Scholarly Migration Patterns in Natural Language Processing

arXiv cs.CL (NLP)Research

Language Models as Measurement Apparatus for Culture

arXiv cs.CL (NLP)Research

Will Scaling Improve Social Simulation with LLMs?

arXiv cs.AIResearch

Diverse Evidence, Better Forecasts: Multi-Agent Deliberation Under Information Asymmetry

arXiv cs.AIResearch

Separating Expert Retention from Autonomous Source Inference in Raw-ECG-Replay-Free Continual ECG Deployment

arXiv cs.AIResearch

COMFYCLAW: Self-Evolving Skill Harnesses for Image Generation Workflows

arXiv cs.AIResearch

Distributionally Robust Listwise Preference Optimization

arXiv cs.AIResearch

DRL-CLBA: A Clean Label Backdoor Attack for Speech Classification via DDPG Reinforcement Learning

arXiv cs.AIResearch

Meta-Benchmarks for Financial-Services LLM Evaluation

arXiv cs.AIResearch

Path-level Hindsight Instructions for Semantic Exploration in Vision-Language Navigation

arXiv cs.AIResearch

Mastermind: Strategy-grounded Learning for Repository-Scale Vulnerability Reproduction

arXiv cs.AIResearch

SimWorlds: A Multi-Agent System for Dynamic 3D Scene Creation

arXiv cs.AIResearch

Repair the Amplifier, Not the Symptom: Stable World-Model Correction for Agent Rollouts

arXiv cs.AIResearch

Subliminal Clocks: Latent Time Modelling in Diffusion Language Models

arXiv cs.AIResearch

Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification

arXiv cs.AIResearch

MMIR-TCM: Memory-Integrated Multimodal Inference and Retrieval for TCM Clinical Decision Support

arXiv cs.AIResearch

Pre-Flight: A Benchmark for Evaluating Large Language Models on Aviation Operational Knowledge

arXiv cs.AIResearch

CLAP: Closed-Loop Training, Evaluation, and Release Control for Domain Agent Post-training

arXiv cs.AIResearch

Safety Targeted Embedding Exploit via Refinement

arXiv cs.AIResearch

CamoNAS: Neural Architecture Search for Enhanced Camouflaged Object Detection

arXiv cs.AIResearch

SkillCoach: Self-Evolving Rubrics for Evaluating and Enhancing Agentic Skill-Use

arXiv cs.AIResearch

Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters

arXiv cs.AIResearch

Rethinking Complexity Metrics for LLM-Integrated Applications: Beyond Source Code

arXiv cs.CVResearch

NOVA: Next-step Open-Vocabulary Autoregression for 3D Multi-Object Tracking in Autonomous Driving

arXiv cs.CVResearch

Spectral and Trajectory Regularization for Diffusion Transformer Super-Resolution

arXiv cs.CVResearch

Active View Selection with Perturbed Gaussian Ensemble for Tomographic Reconstruction