测试编码能力与 ds v4 flash 相近,用量多了差不多 6 倍。但提交的数据将用于 META 的训练
测试编码能力与 ds v4 flash 相近,用量多了差不多 6 倍。但提交的数据将用于 META 的训练
1
zjttfs Aug 20
能力差多了....
|
2
kirafreedom Aug 20
这个模型好像是跑分高,实际亦托
|
3
choryan Aug 20
实际体验过再说不错吧
|
4
CykaBlyat Aug 20
这玩意居然还可以接进 codex 用
|
5
CykaBlyat Aug 20
|
7
kingmo888 Aug 20
这玩意咋解决:API ERROR 403,模型在所在国家不可用。
|
8
Sezxy Aug 20
忘不了 llama4 被指责疑跑分作弊
|
10
LiuXin0367 Aug 20
不太行,开了代理时不时 503 端口不可用
|
11
kingmo888 Aug 20
经常性不可用。包括 hy3,平均单词 api 时间高达 160s
|
12
longaiwp Aug 20
实际测试略低于 V4F 的 MAX ,而且数据保留,会用来训练,并且时不时还会有点问题,也比较慢。
|
13
longaiwp Aug 20
话说我这还是跑分,不知道会不会高分低能
|
14
Galio12138 Aug 20
|
15
CykaBlyat Aug 20
@Galio12138 @wenning 其实就是我在 deepseek 接入 codex 的基础上,写了个用 opencode 接入 codex 的功能,然后让他检查目前接入方法中新出现的模型能不能兼容流式调用。
你检查一下目前 codex 的情况,我使用了 deepseek 的接入方法,我希望你用类似的方法,把 opencode go 也接入进来。方法是:base_url = "https://opencode.ai/zen/go/v1" wire_api = "responses" api key 是 xxxxxxxxxxxxxxxxx 就用这个里面的 deepseek v4 flash 就行了。 我希望你在桌面帮我生成三个脚本, 1——切换成原版 codex 2——切换成目前的 deepseek 版 codex 3——切换成 opencode 版 codex 注意,deepseek 版和 opencode 版应该共享一份对话记录 |
16
m1nm13 Aug 29
muse-spark-1.2-contributor 指令依从度特别特别的差,这个分数绝对是刷的,绝对是假的。它的水平跟千问 3.6 Plus 有的一拼。这是我唯二见过的,明确要它分发四个 sub agent ,拒不执行的模型. 我
测试了两次,结果一模一样。太牛逼了!可能比千问 3.6 Plus 的指令依从度都差,因为千问 3.6 Plus 它也只是概率性的不依从 某种意义上来说,你可以确认他应该没有用 claude 家的模型蒸馏过。因为我都想象不出来,如果蒸馏过怎么会是这样的水平. XD |