# DynaMiCS：带性能约束的大语言模型动态混合微调

- 来源：Apple Machine Learning Research（RSS）
- 发布时间：2026-07-07 08:00
- AIHOT 分数：55
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmrasd6r300hxihog9hxmteoz
- 原文链接：https://machinelearning.apple.com/research/dynamics-fine-tuning-llms

## 精选理由

苹果这篇论文做了一件不太起眼但有用的事——让模型在学新领域时自动平衡旧能力，不用手动调混合权重，对需要多任务微调又怕遗忘的团队是个小进步，不过算不上范式级突破。

## AI 摘要

DynaMiCS是一种动态混合优化器，将多领域微调建模为带性能约束的优化问题。它通过短领域特定探测运行估计跨领域效应斜率矩阵，再基于概率单纯形优化计算混合权重，在提升目标领域性能的同时将约束领域损失维持在参考水平以下。实验表明，DynaMiCS相比固定混合基线取得更强的目标领域提升和约束满足，且计算成本更低，无需参考模型、逐样本评分或手动调节混合权重。

## 正文

大语言模型的多领域微调需要在提升目标领域性能的同时，保持其在受限领域（如通用知识、指令遵循或安全评估）上的表现。现有的数据混合策略依赖固定启发式规则或自适应规则，无法明确强制保留这些能力。我们提出 DynaMiCS，一种动态混合优化器，将多领域微调建模为约束优化问题。在每次更新时，DynaMiCS 执行简短的领域特定探测运行，以估计局部跨领域效应的斜率矩阵，捕捉在每个微调数据集上训练如何影响每个评估领域。随后，这些估计值被用于在概率单纯形上通过优化计算混合权重，其目标是在提升目标领域性能的同时，将受限领域的损失维持在参考水平以下。在具有不同数量目标领域和受限领域的多领域微调场景中，DynaMiCS 相比固定混合基线，以更低的计算成本实现了更强的目标领域性能提升和更高的约束满足度，且无需参考模型、逐样本评分或手动调整混合权重。

† 苏黎世联邦理工学院

** 在苹果公司期间完成的工作

相关阅读与更新。

微调过程中遗忘现象的缩放定律：基于预训练数据注入

获得在目标领域表现良好的语言模型的一种广泛策略是，通过在该领域的数据上进行无监督下一个 token 预测训练来对其进行微调。微调面临两个挑战：一，如果目标数据量有限（大多数实际应用场景正是如此），模型会迅速过拟合；二，模型会偏离原始模型，遗忘预训练……

利用大语言模型进行零样本语音识别领域自适应的语料合成

尽管自动语音识别（ASR）系统已在许多实际应用中得到广泛使用，但它们通常难以很好地泛化到新领域，需要在这些领域的数据上进行微调。然而，在许多场景下，目标领域的数据通常不易获取。在本文中，我们提出了一种新策略，用于在没有任何目标领域文本或语音的情况下，将ASR模型适配到新的目标领域。为实现这一目标，我们提出了一种……

探索机器学习领域的机遇。
