OpenAI fought dirty on career-making math problem
OpenAI dituduh taktik tidak adil pada soal matematika.
Apa yang sedang dibicarakan dunia pembuat AI saat ini, langsung dari sumbernya — yang terbaru di urutan teratas.
OpenAI dituduh taktik tidak adil pada soal matematika.
Detail kemampuan agen AI Muse dari Meta.
Argumen fungsi tidak memberlakukan batasan warna.
Iklan aplikasi Nudify di Meta pakai foto asli anak di bawah…
ChatGPT Images 2.5 diumumkan dengan perbaikan.
Menjelaskan metode untuk menghasilkan pola ubin P3.
Penerbangan di bandara Inggris dibatalkan karena masalah…
Menjelaskan peran dan operasi Visa dan Mastercard…
ReCite gunakan penalaran agen untuk akurasi kutipan.
Graf prosedural berevolusi struktur untuk pandu LLM.
Perilaku kolektif agen AI di wiki dijelaskan oleh…
ERPO terapkan RL saat uji ke generasi kode via…
Koreksi ahli on-policy tingkatkan model lemah dengan…
ExecCritic latih agen buat tes dan perbaiki kode.
Kemampuan dekode warna kanonik ungkap info konseptual di…
Stabilitas optimasi skala-invarian diatur oleh…
MeClear gunakan teori permainan untuk hapus memori…
SAEScientist-Bench mengevaluasi SAE otonom agen AI…
SPINE mengukur sikap menjilat LLM dalam multi-putaran…
Sink perhatian dan aktivasi masif berasal dari…
GoDeep mengangkat deskripsi bahasa ke 3D untuk…
Optima cakupan domain ada di pelatihan tengah, tetapi…
ActReview menggunakan sanggahan untuk melatih model agar…
ToolLoop mensintesis data penggunaan alat melalui loop…
AI klinis Doctorina mengungguli dokter dan mutakhir…
PlayTrain menghasilkan game JavaScript untuk RL efisien…
Diskusi tentang masalah Hadiah Milenium Navier-Stokes.
Kerangka Narratives memodelkan data berubah waktu sebagai…
Memperkenalkan vektor tugas tanpa pelatihan untuk perilaku…
Konstruksi audit memengaruhi temuan bias LLM lebih dari…
OUI-1 adalah model pertama untuk UI generatif.
Representasi penalaran tidak selalu membantu evaluasi.
Show HN: Alat untuk memvisualisasikan perhatian LLM.
Melacak distribusi jawaban LLM untuk mengungkap penalaran.
DOJ memblokir tuntutan penembakan agen ICE meski jaksa.
Mengeksplorasi kepemilikan dan tanggung jawab dalam kode…
Difusi kontinu memerlukan koreksi diri untuk kendala.
Menghubungkan mesin dalam konteks jaringan.
Mengusulkan metrik graf pengetahuan S3KG untuk mengevaluasi…
Deposon menambahkan lapisan hamburan yang dapat diaudit ke…
Pembelajaran mendalam berbasis fisika mengurangi alarm…
Y Combinator meluncurkan jaringan akses awal.
Transformer dapat bertindak sebagai sampler in-context…
Gander menyatukan persepsi omni, interaksi real-time, dan…
Checkpoint pra-pelatihan terbaik mungkin bukan terbaik…
PlannerForge menggunakan agen LLM untuk pengujian ADS…
Tuduhan pencurian penelitian dari obrolan pribadi.
SQLMorph memutasikan kueri dan menyediakan metrik…
TV LG dilaporkan memata-matai bahkan saat mati atau idle.
Benchmark ONECYL untuk pemodelan pengganti berbasis graf…
SkillAdam mengoptimalkan keterampilan agen dengan…
LLM mengandalkan pengetahuan parametrik daripada bukti…
AuK adalah model sumber terbuka untuk pembuatan ucapan dan…
Isyarat yang diatribusikan ke sumber dapat membuat LLM…
Bahasa C* menggabungkan pemrograman dan verifikasi formal.
Mengeksplorasi standar C de facto sejak 2016.
Agen yang berevolusi sendiri bergantian antara keadaan…
Polisi khawatir kacamata Meta memungkinkan perekaman…
Artefak BatchNorm membingungkan evaluasi unlearning…