StableVicuna 概述
StableVicuna 是一款大规模开源聊天机器人,由 Stable Diffusion 背后的 StabilityAI 团队推出。该模型的重要意义在于,它是首个通过基于人类反馈的强化学习(RLHF)训练而成的同类项目。
模型与技术基础
StableVicuna 的底层基础是 Vicuna v0 13b 模型。它在此前的基础上进行了进一步的指令微调以及 RLHF 训练。追溯其根源,Vicuna v0 13b 本身就是一个经过指令微调的、拥有 130 亿参数的 LLaMA 模型。
AI训练模型
更新于2026年07月14日