尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

2025年7篇AI顶刊论文一文看懂:每周机器学习论文精选项目速览

2025年7篇AI顶刊论文一文看懂:每周机器学习论文精选项目速览 2025年7篇AI顶刊论文一文看懂每周机器学习论文精选项目速览【免费下载链接】AI-Papers-of-the-WeekHighlighting the top ML papers every week.项目地址: https://gitcode.com/GitHub_Trending/ml/AI-Papers-of-the-Week每天 arXiv 上百篇新论文没人能全读完。AI Papers of the Week 是 DAIR.AI 团队维护的开源项目每周精选机器学习领域最值得读的论文配一段大白话摘要按年份和周次归档。本期2025年6月23日-29日收录 7 篇覆盖扩散语言模型的超高速推理、智能体内存优化、罕见病诊断等方向适合想快速对齐前沿的开发者。仓库里有什么三年每周论文精选日志仓库定位很直白一份持续更新的每周论文清单。维护方 DAIR.AI 每周从新论文中挑出最有分量的每条都给出链接和要点描述不点开原文也能知道论文在解决什么问题。内容按年份从 2023 年排到 2026 年每周固定收录 10 篇。README.md总索引按年份列出全部周条目并带锚点可直接跳到任意一周years/每年一个文件2023.md 至 2026.md存放每周的论文表格pics/每周精选论文的图片拼贴方便回看重点论文的图示research/结构化数据如 ml-potw-10232023.csv含历史论文标题、描述和链接本地浏览只需克隆仓库git clone https://gitcode.com/GitHub_Trending/ml/ML-Papers-of-the-Week本期看点7 篇论文横跨推理速度与垂直落地论文方向一句话亮点Mercury扩散语言模型代码生成推理加速并行生成多令牌H100 上最高 1109 tokens/sec快 10 倍MEM1智能体内存优化长序列内存恒定省 3.7 倍内存7B 打赢 14B 基线Towards AI Search Paradigm多智能体搜索四智能体分工 DAG 任务规划 MCP 动态选工具RLT强化学习教师RL 训练与蒸馏7B 教师生成解释超 32B 蒸馏管线DeepRare罕见病诊断6401 例评测1013 种疾病准确率 100%AlphaGenome基因调控预测单碱基分辨率覆盖百万碱基对Claude for Affective Use用户行为研究450 万次对话仅 2.9% 是情感支持图项目每周精选论文配图拼贴数据来源pics/Week-2.png逐篇拆解推理加速、智能体系统与垂直领域推理、内存与训练效率让大模型跑得起MercuryUltra-Fast Diffusion-based Language Models代码补全慢根子在自回归模型一次只能吐一个令牌。Mercury 换成扩散语言模型先生成粗糙草稿再并行细修一次产出多个令牌同时保留 Transformer 架构现有 LLM 基础设施可直接复用。H100 上 Coder Mini 和 Small 分别跑到 1109 和 737 tokens/sec比速度优化的前沿模型快最多 10 倍HumanEval、MBPP 等基准与 Claude 3.5 Haiku、Gemini 2.0 Flash Lite 打平FIM 代码补全超越 Codestral 2501 和 GPT-4o MiniCopilot Arena 里 Mini 以 25ms 延迟拿到第二的 Elo。MEM1先说结果16 目标多跳 QA 上7B 的 MEM1 打赢 Qwen2.5-14B-Instruct内存少 3.7 倍推理快 1.78 倍。传统智能体把每轮的想法、动作、观察都追加进上下文序列越长内存越爆MEM1 只维护一个共享内部状态 每轮更新并丢弃旧上下文内存几乎恒定用 PPO 式 RL 端到端训练。内部状态分析显示它自发形成了结构化内存管理、选择性注意和查询重构等策略接近人类记忆的使用方式。Reinforcement-Learned TeachersRLT对比对象有点反常识7B 的教师模型解释质量超过 32B 的蒸馏管线含 DeepSeek R1、QwQ。关键在任务定义——RLT 不学解题而是拿着已知的问题和答案学写学生模型看得懂的解释奖励来自学生能否据此复现正确答案、解释本身是否逻辑自洽。这绕开了传统 RL 的探索难题训练只要 125 步、1 个 epoch、无需后处理AIME、MATH、GPQA 上学生表现更好还能零样本迁移到算数游戏等新领域。从搜索到诊断多智能体系统的工程实践 Towards AI Search Paradigm相比传统 RAG先检索再写这套系统把活拆给四个智能体Master 解析请求Planner 把任务分解成 DAG 并可在失败时局部重规划Executor 调用搜索、计算器等工具Writer 汇总中间产出成最终答案。两处设计值得注意用 MCP 协议服务器动态挑选与查询语义相关的小工具子集而不是把所有工具塞给模型用 RankGPT 和 TourRank 让搜索结果对齐 LLM 偏好Writer 再经对抗调优抵抗噪声检索。这种分解-规划-执行-写作的流程是复杂信息合成任务的参考模板。图往期周精选论文配图展示提示词优化与问答生成的工具调用示例数据来源pics/Week-6-12-February-2023.pngDeepRare罕见病诊断的难点是证据长尾且多模态医生要在表型、变异、文献之间反复比对。DeepRare 搭了一套三层 MCP 风格智能体架构中央 LLM 主机负责记忆与调度专业智能体做表型提取和变异优先级排序背后接 40 医疗工具和网络级医学源推理链可追溯到可验证的医学出处。6401 个病例、2919 种疾病上1013 种疾病准确率 100%Recall1 达 57.18%比 Claude-3.7-Sonnet-thinking 高 23.79%仅 HPO 评测109 例全外显子测序达到 70.60% Recall1Exomiser 为 53.20%180 条推理链的专家评审一致率 95.4%。生物与社会观察从基因组到对话记录 AlphaGenome第一个把上下文长度和分辨率同时解决的序列模型卷积 Transformer 层以单碱基分辨率建模多达 100 万个 DNA 碱基对一次前向同时预测基因起止点、RNA 表达、剪接、染色质可及性和蛋白结合计算量只有 Enformer 的一半。对比野生型与突变序列的预测就能评估单个突变的调控影响它还首次显式预测 RNA 剪接位点位置及表达水平对脊髓性肌萎缩症、囊性纤维化这类疾病研究很实用。22/24 单序列基准、24/26 变异效应基准上均领先。Claude for Affective Use这是一篇实证研究而非方法论文但样本量足够大Anthropic 分析了 450 万次 Claude 对话筛出 13.1 万条情感支持类人际建议、辅导、咨询、陪伴排除了短对话和任务型。结论仅 2.9% 的对话属于情感支持浪漫/性角色扮演不足 0.1%不到 10% 的情感对话中 Claude 会拒绝请求主要是劝阻伤害性行为或说明专业边界情感分析显示用户会话结束时情绪更积极。作者也提醒单次会话的语言分析不代表长期心理影响。这份数据为 AI 情感交互设计提供了首批大规模实证依据。图往期周精选论文配图展示小模型训练 大模型推理的 UPRISE 架构数据来源pics/Week-Mar-13-Mar-19-2023.png怎么用起来持续更新与配套资源持续获取更新仓库每周新增一个周条目打开 README.md 看最新一期即可SUMMARY.md 提供目录总览不想克隆的话直接在平台上按年份翻也行配套资源research/ 目录的 CSV 把历史论文以结构化形式导出适合批量导入自己的论文订阅流维护方还有 newsletter 订阅和 Discord 社区可以收到每周推送并参与讨论适合谁适合想跟踪趋势又不想读完全部原文的开发者、学生领域研究者可以把它当目录快速定位值得精读的论文趋势研判本期选出的三个信号扩散生成正在挑战自回归的速度优势并行多令牌生成加上现成的 Transformer 基础设施复用推理速度首次成为可以量化的卖点如扩散语言模型推理速度。智能体研究从能跑通转向跑得省恒定内存、DAG 重规划、动态工具子集选择都在回应长序列多轮任务的工程成本。垂直领域开始给出可验证、可追溯的结果罕见病诊断和基因变异解读都强调推理链能回溯到权威来源可解释性正变成医疗 AI 的硬指标。下期可以看 2025 年 7 月的精选想追踪某类论文也可以留言告诉我方向。【免费下载链接】AI-Papers-of-the-WeekHighlighting the top ML papers every week.项目地址: https://gitcode.com/GitHub_Trending/ml/AI-Papers-of-the-Week创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表