NIPS 2025 Spotlight | 港大提出TreeSynth方法,一句话生成百万规模数据集

[复制链接]
周大 发表于 7 天前 | 显示全部楼层 |阅读模式
香港大学与香港中文大学联合提出TreeSynth,一种基于决策树机制的树引导子空间数据合成方法,旨在系统性生成多样化、全覆盖的训练数据。该方法通过递归划分数据空间并逐子空间生成样本,在数学推理、代码生成等任务中显著提升LLaMA3.1-8B模型性能,GSM8K准确率提升10.6个百分点,平均性能提高10%以上,最高增幅超17%,同时数据多样性提升达45%,展现出优异的可扩展性与分布均衡能力。
来源:https://mp.weixin.qq.com/s/fp29jkzxBL7Sku4tqlvGPw

搜索|Archiver|手机版|靠浦网络|靠浦ai课堂 ( 鄂ICP备17024134号-3 )

GMT+8, 2025-10-10 02:57 , Processed in 0.295002 second(s), 24 queries .

Powered by Discuz! X3.5

© 2001-2025 Discuz! Team.

快速回复 返回顶部 返回列表