上一篇聊了推理模型"多想一会儿"。你可能注意到了一个名字反复出现——DeepSeek。这家公司2025年初突然爆火,所有人都在问同一个问题:它凭啥又强又便宜?强到跟GPT-4掰手腕,便宜到API价格只有对手的十分之一。答案藏在三个词里:混合专家、量化、蒸馏。
今天这篇番外,我们就来拆解这三把"降本增效"的板斧——看完你就能跟别人吹:为什么大模型可以又大又省钱,为什么你那台普通笔记本也能养一只私有的小硅。
🏥 混合专家:不是所有大夫一起给你看病
你去综合医院看个嗓子疼,不会100个科室的大夫一起冲出来给你看——前台分诊护士(Router)先判断你的问题属于哪个专科,然后只派耳鼻喉的专家出马。骨科、心内科、皮肤科那些大夫?该喝茶喝茶,根本不用起身。
大约 6 分钟