如果希望训练大模型对特定内容的推理能力,应该如何做?现在用 alpaca 格式的数据集进行训练,看到只有 instruction 、input 和 output 这几个 column ,没有找到合适的字段填写思考过程。希望不吝赐教,先谢谢了。下面是一个例子:
根据北京汽车限行尾号的规则来查找某天限行尾号时多少,需要先根据用户问题中的日期找到相应时间段,再找到时间段内的限行尾号和周几的对应关系,最后根据这个日期时星期几来找到对应的限行尾号。
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.