监督微调 大模型 什么是监督微调 SFT?让模型学会特定任务与格式 SFT 是什么?它如何用高质量示例调整模型行为,和预训练、RAG、RLHF 有何区别,哪些业务场景值得做监督微调,一文讲清。 2026年8月27日
大模型 合成数据 什么是合成数据?AI 用自己造的数据训练自己 真实数据快用完了,AI 怎么继续变强?合成数据是什么、为什么在数学和代码上特别有效、「模型崩溃」是怎么回事,一文讲清这条绕不开的路。 2026年8月13日
大模型 Scaling Law 什么是 Scaling Law?大模型「越大越强」的底层规律 为什么各家敢砸几十亿训练模型?Scaling Law 是什么、参数量数据量算力该怎么配、为什么说它开始撞墙,以及推理时计算这条新曲线,一文讲清。 2026年8月12日