StableVicuna

StableVicuna

第一个通过RLHF训练的大规模开源聊天机器人

AI训练模型 更新于2026年07月14日

StableVicuna 概述

StableVicuna 是一款大规模开源聊天机器人,由 Stable Diffusion 背后的 StabilityAI 团队推出。该模型的重要意义在于,它是首个通过基于人类反馈的强化学习(RLHF)训练而成的同类项目。

模型与技术基础

StableVicuna 的底层基础是 Vicuna v0 13b 模型。它在此前的基础上进行了进一步的指令微调以及 RLHF 训练。追溯其根源,Vicuna v0 13b 本身就是一个经过指令微调的、拥有 130 亿参数的 LLaMA 模型。

更多AI工具