OpenAI fought dirty on career-making math problem
OpenAI被指控在数学问题上使用不公平策略。
AI 开发圈现在正在聊什么,直接从来源抓取——最新的在最前面。
OpenAI被指控在数学问题上使用不公平策略。
Meta的Muse AI代理功能詳述。
函数参数不施加颜色限制。
Meta平台上的Nudify应用广告使用未成年人真实照片。
ChatGPT Images 2.5发布,带来改进。
描述生成P3镶嵌图案的方法。
英国机场因航管问题取消航班。
说明Visa和Mastercard的角色与运作…
ReCite运用代理推理提升引用准确性。
程序化图谱演化执行结构引导LLM。
AI代理在wiki中的集体行为由…解释。
ERPO通过…将测试时强化学习应用于代码生成。
同策略专家修正以…提升较弱模型。
ExecCritic训练代理生成测试并修复代码。
规范色彩可解码性揭示…中的概念信息。
尺度不变优化稳定性由…控制。
MeClear运用博弈论清除…中的有害记忆。
SAEScientist-Bench评估AI代理自主SAE…
SPINE衡量LLM在持续多轮下的谄媚行为。
注意力汇集与大量激活源于…
GoDeep将语言描述提升至3D以…
中期训练领域覆盖最佳值存在,但对齐…
ActReview使用反驳来训练模型以产生可操作的…
ToolLoop通过闭环合成工具使用数据…
临床AI Doctorina表现优于医师和前沿…
PlayTrain生成JavaScript游戏以进行高效RL…
讨论Navier-Stokes千禧年大奖问题。
Narratives框架将时变数据建模为束…
引入免训练任务向量以进行LLM行为…
审计建构对LLM偏见发现的影响大于…
OUI-1是首个生成式UI模型。
推理表示不一定有助于人类评估。
Show HN:可视化LLM注意力的工具。
追踪LLM答案分布以揭示推理过程。
司法部阻挡ICE探员枪击指控,无视检察官。
探讨AI辅助代码的所有权与责任。
连续扩散需自我修正以处理约束。
在网络环境中连接机器。
提出知识图谱指标S3KG评估LLM。
Deposon为LLM推理添加可审计散射层。
物理信息深度学习减少ICU假警报。
Y Combinator推出早期访问网络。
Transformer可作为数据的上下文采样器。
Gander统一全感知、实时互动等。
最佳预训练检查点在完整SFT后未必最佳。
PlannerForge使用LLM代理进行基于场景的ADS测试。
指控从私人聊天中窃取研究。
SQLMorph变异查询并提供细粒度指标…
LG电视据报即使关机或闲置也会监视。
用于图形代理建模的ONECYL基准…
SkillAdam以Adam启发的方式优化代理技能…
LLM在…中依赖参数知识而非证据。
AuK是语音生成和…的开源模型。
来源归因提示可使LLM服从错误答案。
C*语言结合编程与形式验证。
探讨2016年起的实际C标准。
自演化代理交替快速状态和慢速策略…
警方担忧Meta眼镜可秘密录像。
BatchNorm伪影混淆遗忘评估…