大模型底下的踩和赞是如何进一步影响到大模型的

225 天前
 weishao666

大模型了解的比较模糊,主流的大模型平台对话框底下的踩和赞应该就是 RLHF 的前置步骤,即数据的收集,收集了之后一般是怎么影响到模型的呢,是不是还要隔一段时间将数据处理成指令数据集的格式,进行一轮微调?

816 次点击
所在节点    机器学习
2 条回复
laimailai
225 天前
隔一段时间将数据处理成指令数据集的格式,进行一轮微调。
------
正解!还需要进行一轮数据清洗过滤。
weishao666
225 天前
@laimailai 谢谢!

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1038533

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX