OpenAI fought dirty on career-making math problem
OpenAI accusé de tactiques déloyales sur un problème de…
Ce dont le monde de l'IA parle en ce moment, tiré directement des sources — du plus récent au plus ancien.
OpenAI accusé de tactiques déloyales sur un problème de…
Détails des capacités de l'agent IA Muse de Meta.
Les arguments de fonction n'imposent pas de contraintes de…
Les pubs de l'app Nudify sur Meta utilisent de vraies…
ChatGPT Images 2.5 annoncé avec des améliorations.
Décrit une méthode pour générer le motif de pavage P3.
Vols annulés dans les aéroports britanniques en raison d'un…
Explique les rôles et opérations de Visa et Mastercard…
ReCite améliore la précision des citations via agents.
Graphes procéduraux font évoluer des structures pour guider…
Le comportement collectif des agents IA dans un wiki…
ERPO applique le RL au test à la génération de code via…
Correction experte on-policy améliore les modèles faibles…
ExecCritic entraîne des agents à générer des tests et…
La décodabilité canonique des couleurs révèle des infos…
La stabilité d'optimisation invariante d'échelle est régie…
MeClear utilise la théorie des jeux pour effacer des…
SAEScientist-Bench évalue la SAE autonome des agents IA…
SPINE mesure la flagornerie des LLM sur plusieurs tours…
Les puits d'attention et les activations massives…
GoDeep élève les descriptions linguistiques en 3D pour…
Des optima de couverture de domaine existent en…
ActReview utilise des réfutations pour entraîner des…
ToolLoop synthétise des données d'utilisation d'outils via…
L'IA clinique Doctorina surpasse les médecins et de pointe…
PlayTrain génère des jeux JavaScript pour un RL efficace…
Discussion sur le problème du prix du millénaire de…
Le framework Narratives modélise des données temporelles…
Introduit des vecteurs de tâche sans entraînement pour le…
La construction d'audit affecte les résultats de biais des…
OUI-1 est le premier modèle pour l'UI générative.
Les représentations de raisonnement n'aident pas toujours à…
Show HN : Outil pour visualiser l'attention des LLM.
Suit les distributions de réponses des LLM pour révéler le…
Le DOJ a bloqué l'accusation de tir d'un agent ICE malgré…
Explore la propriété et la responsabilité dans le code…
La diffusion continue nécessite une autocorrection pour les…
Connecter des machines dans un contexte réseau.
Propose la métrique de graphe de connaissances S3KG pour…
Deposon ajoute une couche de diffusion vérifiable au…
L'apprentissage profond informé par la physique réduit les…
Y Combinator lance un réseau d'accès anticipé.
Les transformers agissent comme échantillonneurs en…
Gander unifie la perception omni, l'interaction en temps…
Les meilleurs checkpoints de pré-entraînement ne sont pas…
PlannerForge utilise des agents LLM pour les tests ADS…
Allégations de vol de recherche à partir de discussions…
SQLMorph mute les requêtes et fournit des métriques fines…
Les téléviseurs LG espionneraient même éteints ou en veille.
Benchmark ONECYL pour la modélisation de substitution basée…
SkillAdam optimise les compétences des agents avec une…
Les LLM s'appuient sur les connaissances paramétriques…
AuK est un modèle open source pour la génération de parole…
Les indices attribués à la source peuvent amener les LLM à…
Le langage C* fusionne programmation et vérification…
Explore les normes C de facto depuis 2016.
Les agents auto-évolutifs alternent état rapide et…
La police craint que les lunettes Meta permettent un…
Les artefacts BatchNorm perturbent l'évaluation de l'oubli…