OpenAI fought dirty on career-making math problem
OpenAI bị cáo buộc dùng chiến thuật không công bằng trong…
Điều giới xây dựng AI đang bàn luận ngay lúc này, lấy thẳng từ các nguồn — mới nhất lên trước.
OpenAI bị cáo buộc dùng chiến thuật không công bằng trong…
Chi tiết khả năng của tác nhân AI Muse của Meta.
Đối số hàm không áp đặt ràng buộc màu sắc.
Quảng cáo ứng dụng Nudify trên Meta dùng ảnh thật của trẻ…
ChatGPT Images 2.5 được công bố với cải tiến.
Mô tả phương pháp tạo mẫu lát gạch P3.
Các chuyến bay tại sân bay Anh bị hủy do sự cố kiểm soát…
Giải thích vai trò và hoạt động của Visa và Mastercard…
ReCite dùng suy luận tác tử để cải thiện trích dẫn.
Đồ thị thủ tục tiến hóa cấu trúc để dẫn LLM.
Hành vi tập thể của tác tử AI trong wiki được giải thích…
ERPO áp dụng RL lúc kiểm thử để sinh mã qua…
Hiệu chỉnh chuyên gia on-policy cải thiện mô hình yếu với…
ExecCritic huấn luyện tác tử tạo test và sửa mã.
Khả năng giải mã màu chuẩn tiết lộ thông tin khái niệm…
Tính ổn định tối ưu bất biến tỷ lệ được điều khiển bởi…
MeClear dùng lý thuyết trò chơi để xóa ký ức có hại trong…
SAEScientist-Bench đánh giá SAE tự trị của tác tử AI…
SPINE đo sự xu nịnh của LLM qua nhiều lượt liên tục.
Các bể chú ý và kích hoạt lớn bắt nguồn từ…
GoDeep nâng mô tả ngôn ngữ lên 3D để…
Tồn tại tối ưu phủ miền giữa huấn luyện, nhưng căn chỉnh…
ActReview dùng phản bác để huấn luyện mô hình tạo ra…
ToolLoop tổng hợp dữ liệu sử dụng công cụ qua vòng khép kín…
AI lâm sàng Doctorina vượt trội bác sĩ và tiên tiến…
PlayTrain tạo game JavaScript cho RL hiệu quả…
Thảo luận về vấn đề Giải thưởng Thiên niên kỷ Navier-Stokes.
Khung Narratives mô hình hóa dữ liệu biến thiên theo thời…
Giới thiệu vector tác vụ không huấn luyện cho hành vi LLM…
Cấu trúc kiểm toán ảnh hưởng phát hiện thiên vị LLM hơn…
OUI-1 là mô hình đầu tiên cho UI tạo sinh.
Biểu diễn suy luận không luôn giúp đánh giá.
Show HN: Công cụ trực quan hóa sự chú ý của LLM.
Theo dõi phân phối câu trả lời LLM để lộ suy luận.
DOJ chặn cáo buộc bắn súng của đặc vụ ICE dù công tố viên.
Khám phá quyền sở hữu và trách nhiệm trong mã hỗ trợ AI.
Khuếch tán liên tục cần tự sửa cho ràng buộc.
Kết nối máy móc trong bối cảnh mạng.
Đề xuất chỉ số đồ thị tri thức S3KG để đánh giá LLM.
Deposon thêm lớp phân tán kiểm toán được vào suy luận LLM.
Học sâu thông tin vật lý giảm báo động giả ICU.
Y Combinator ra mắt mạng truy cập sớm.
Transformer có thể hoạt động như bộ lấy mẫu ngữ cảnh cho dữ…
Gander hợp nhất nhận thức toàn diện, tương tác thời gian…
Checkpoint tiền huấn luyện tốt nhất có thể không tốt nhất…
PlannerForge dùng tác tử LLM để kiểm thử ADS theo kịch bản.
Cáo buộc đánh cắp nghiên cứu từ trò chuyện riêng tư.
SQLMorph biến đổi truy vấn và cung cấp số liệu chi tiết…
TV LG bị cáo buộc do thám ngay cả khi tắt hoặc không hoạt…
Chuẩn ONECYL cho mô hình thay thế dựa trên đồ thị…
SkillAdam tối ưu kỹ năng tác tử với cảm hứng từ Adam…
LLM dựa vào kiến thức tham số hơn bằng chứng trong…
AuK là mô hình mã nguồn mở cho tạo giọng nói và…
Tín hiệu gán nguồn có thể khiến LLM tuân theo câu trả lời…
Ngôn ngữ C* kết hợp lập trình và xác minh hình thức.
Khám phá các tiêu chuẩn C thực tế từ 2016.
Tác tử tự tiến hóa xen kẽ trạng thái nhanh và chính sách…
Cảnh sát lo ngại kính Meta cho phép ghi hình bí mật.
Các tạo tác BatchNorm gây nhiễu đánh giá quên học…