自回归模型不回归
怪不得 OpenAI 要推迟上市
自回归模型不回归
怪不得 OpenAI 要推迟上市
1
CodingIran 11h 57m ago 什么玩意,公司几十万行代码的项目一直都是用 Codex 开发的,从来没遇到这种问题
|
2
penzi OP @CodingIran 那你们的项目真挺简单的
|
3
nullyouraise 11h 54m ago
我改 Chromium 都是 Astra 一把梭,从来没遇到过问题,难以想象你们的项目是有多复杂
|
4
lozzow 11h 52m ago
@nullyouraise 甚至我用的 DeepSeek 4.1 flash 也能改得动
|
5
Finest 11h 49m ago
昨天才让 6.1-sol 一次改了 2000 多行代码,真不知道你的项目有多复杂
|
6
MHPSY 11h 49m ago
我自己弄了个指纹浏览器 用 claude 5.5 打 patch 改的很好
|
7
changnet 11h 48m ago
AI 基本只能在已有功能的例子上添加功能。如果没有框架限制,没有例子,尤其是需要扩展、修改原有框架实现时,现有的 AI 确实就是不行,跟代码行数没有太大关系
或者说 AI 实现得很奇怪,各种 if-else 打补丁。有些明明在基类扩展一个虚函数就很优雅,它偏不。除非不关注代码质量和后续维护,否则很难不人工修改 |
8
xing7673 11h 47m ago
降智了吧,现在黑 codex 都已经泥沙俱下了么?
|
9
cat9life 11h 44m ago
画个鹈鹕看看,大概率是降智了。
|
10
DOOMS 11h 44m ago
不知道的以为是去年发的帖子。
|
11
penzi OP |
12
Y25tIGxpdmlk 11h 43m ago 求大神让我们见识一下超高质量的项目代码(不简单的项目),学习一下。
|
13
maxwellz 11h 42m ago
可能被降智到 luna 了
|
15
CodingIran 11h 39m ago @penzi 不会接了个垃圾中转站,然后被降智后把责任怪到 codex 上了吧
|
16
Dk2014 11h 36m ago via Android
这个页面怎么跟 codex 不一样😅
o/前段时间本来就在治中转,并发多了就降智 你不会开了转发来用的吧 |
17
zeroFans 11h 33m ago 至少用上官方的 codex 再说话吧
|
18
haoooooooo 11h 32m ago
哥们,你是认真的吗?确定不是用的什么山寨 Codex ?
虽说 Astra 比不上 Opus5.5 ,但是也没不堪到这种地步。。。 |
19
alamaya 11h 28m ago
codex 需要有一个比较好的编码规范给到他才行
|
20
supersleepking 11h 28m ago
华为用户啊不奇怪了,大家喷之前可以看下这人发帖记录很有意思
|
21
icelas259 11h 28m ago
你这是掺水模型吧。先去订阅官方的 codex 看看。
|
22
mwenhua2023 11h 27m ago
5w 行都改得动
|
23
location123 11h 27m ago
deepseek 改个 500 行也是绰绰有余的吧
|
24
BanShe 11h 26m ago
xs😂
|
25
StarsunYzL 11h 25m ago 送人头 block ,但凡对当前的 AI 能力有一丁点认知+有一丁点思考能力的都会反思和反复验证自己哪里出问题了而不是下这种不过脑子的结论
|
26
strobber16 11h 21m ago
微内核
|
27
sima675 11h 20m ago
一个用中转站的就不要评论了,自己被卖了也不知道
|
28
xylxAdai 11h 15m ago
你用的什么垃圾中转站啊。500 行都改不动。你用半年前的 glm 都不至于五百行改不了。更别提 codex 了。
|
29
pengtx 11h 12m ago
懒得喷
|
30
hookbreak 11h 11m ago
你用的中转站吗
|
31
furlxy 11h 9m ago
你这个智能机器人是个什么?
中转被偷换了模型,自己不知道么? |
32
osilinka 11h 6m ago
ms build, 肯定是微软的系统,如果没有足够的 training 材料,肯定是这样啊
现在都把 AI 看的太聪明了 |
33
Satoshl 11h 6m ago
截图中转站绷不住了,自己还能发出来
|
34
Haku 11h 5m ago
@penzi #14 随机数测试只能在 GPT 内的模型进行,告诉你是否产生了 GPT 内的模型降级(例如 6.1 SOL 可能使用 luna 回复),如果你接的是中转站,给你注水成 DS 或者别的模型,随机数测试是分辨不出来的。
|
35
ishengge 11h 5m ago block, 影响我智商
|
36
laodao 11h 4m ago
你家 codex 叫智能机器人?
|
37
fkdtz 11h 3m ago
不像演的
|
38
Promtheus 11h 2m ago
|
39
keshawnvan 11h 2m ago
我用 Astra 改过最大的改动是 68 万行,其中 2 万行是业务改动,剩下都是单元测试+集成测试。
测试阶段和生产验证都是 0 BUG 。 |
40
firemiles 10h 58m ago
看到用户名 penzi ,真怀疑 up 是不是故意炒话题的
|
41
tim9527 10h 55m ago
不至于。
|
42
nutting 10h 51m ago
你这是机器人不是 codex ,更不是 ai
|
43
BRZ001 10h 47m ago
中转站 注水了兄弟,用原生 codex 吧
|
44
stardew 10h 46m ago
😅
|
45
yougg 10h 42m ago
不要回答! 不要回答! 不要回答!
这就是来骗铜币的!!! |
46
aicong2021 10h 39m ago
不太可能,500 行开源 8B 参数的模型应该都能改的动
|
47
yoyoyoyolol 10h 38m ago
你把这个问题的文本描述打出来,让大家问一下看看答案是不是和你一致,就知道是谁的问题了
|
48
d119 10h 34m ago
改是能改,就是跑不起来
|
49
seanxx 10h 32m ago
直接 block 完事,明显装糖骗回复
|
50
413420 10h 31m ago
糖 b
|
51
tcchen PRO |
52
jerseyhero 10h 22m ago
感觉像在带节奏骗回复
|
53
cropflre 10h 19m ago
怕不是中转站接的是豆包模型
|
54
hidemyname 10h 19m ago
@penzi #2 几十万行的代码挺简单???
|
55
iyaozhen 10h 7m ago
你得在 codex 里面用吧,我们之前测试过不同 harness 框架差异很大
不知道你那个什么智能机器人是怎么部署的 |
56
Kafuka578 10h 6m ago
难绷
|
57
ttkit 10h 3m ago
|
58
TofuBazinga 9h 45m ago
看到这个智能机器人绷不住了。。。
|
59
niubilewodev 9h 44m ago
哈哈,‘我写了 99 行脚本和 109 行测试。’
你用到正品 GPT 了。 |
60
Y25tIGxpdmlk 9h 42m ago
@Kafuka578 #56 你这头像倒是和难崩非常贴切。哈哈哈
|
61
Y25tIGxpdmlk 9h 41m ago
我们只是嘲讽你说 500 行代码改不动的观点,为啥就剥夺我们用 cc 的权利呢?凭啥啊?我 tm 非要用,我想用 cc 就用 cc ,想用 gpt 就用 gpt ,你管我啊?
|
62
jadeborner 9h 30m ago
这个智能机器人是什么鬼,能不能直接用官方的?
|
63
ziyanghua 9h 15m ago
你这算是那种 500 元以下没有好耳机的提问方式吗?
可以先按官方推荐的开发最佳示例开始尝试呗。 https://learn.chatgpt.com/docs/developers gpt 可能不如 claude ,但是你说的也太夸张了。 |
64
guanhui07 8h 24m ago
不太可能
|
65
fyq 8h 22m ago
区区 500 行,免费的 Claude 都能改啊……
|
66
QS0x01 8h 3m ago
唐完了
|
67
tomyark123 8h 2m ago
v2 真是遍地嘉豪
|
68
achira 7h 54m ago
确实是有差距的,就像你和正常人类一样。block
|
69
YiCheng88 7h 41m ago
deepseek 都行 你活在啥年代了
|
70
bqn 7h 17m ago
你这是什么 harness
|
71
Hilalum 7h 8m ago
gpt 和 claude 同时高强度使用十几个项目,虽然 gpt 差一点,但也差不了多少。你这不是被注水了就是 agent 的问题吧
|
72
NullIsLife PRO 有过类似的感受,一个 bug 实际上修改 10 几行代码即可. gpt 给我改了 10 几个文件上千行代码,单独的实现了一个分支功能.
opus fable 给我最大的感觉就是克制 |
73
goumadantui 6h 53m ago
500 行哈哈,我这随便十几个文件几千行上万行都是随便改,改完它自动执行用例自测,基本都是能完成功能的
|
74
Wh1t3zZ 6h 51m ago
鉴定为用中转站把脑子用坏了
|
75
jackOff 6h 46m ago
你这是不是掺水了豆包啊
|
76
hzzhzzdogee 6h 45m ago
@iyaozhen 现在 deepseek 哪个 harness 最适合呢. 各个评测/榜单, 说法都不尽相同
|
77
keethebest 6h 39m ago
笑死我了 智能机器人, 这个机器人靠谱保真吗
|
78
lemoncoconut 6h 26m ago
兄弟 币又不够用了?
|
79
deplives 6h 24m ago
|
80
94 6h 23m ago
多多少少是有点抽象的
|
81
OrangeDark 6h 22m ago
能工智人来了
|
82
cluulzz 5h 44m ago
|
83
cnevil 5h 33m ago 感觉已经塞后面了,等别人回复奖励自己
|
86
wwwwjack 5h 21m ago
看界面,有没有可能是你中转站的问题, 我反正用 gpt 经常单次改动超过 10-20 个文件, 代码都是几千行, 没出现过类似现象
|
87
Y25tIGxpdmlk 5h 16m ago
@izzzz #84 像是某个中转站的 web 对话窗口,看上去跟某些小网站的右下角智能客服窗口似的。嘻嘻
|
88
MaxJin 5h 2m ago
你这个是维护的代码吧,除非是各种代码累积出来的屎山代码,要不然连 GPT 不应该遇到这种情况。我之前遇到过用 ai 搞不定的就是屎山代码,因为内容多还在维护还要出新功能,文件关联的又多的那种会出现 ai 开始瞎写代码的情况。
|
89
Ketter 4h 53m ago
哥们连开一个官方正式的 codex 账号都不会啊?
|
90
EvaElfie 4h 41m ago
难绷,你的中转站都是掺假的你知道不?
常见的测试题测不出来的都给你路由了 |
91
mosesyou 4h 41m ago
咱能不用这些中转站了吗
|
92
i36lib 4h 41m ago
九成用的中转,掺屎了卖给你,你还以为是 codex
|
93
haidaomihuan 4h 21m ago
大概率你们项目一坨屎山、要么就是需求不明确(使用姿势不对)
|
94
lemolee 4h 17m ago
这模型现在就是一坨屎,每个任务都能搞出一个 BUG ,老子换 deepseek 了,效果都差不多,给 openai 送钱干毛
|
95
jmliang 4h 2m ago
这是 qwen 0.6b 吧
|
96
iyaozhen 3h 48m ago @hzzhzzdogee deepseek 我用得少。但肯定是适配了 Claude Code ,以及 DeepSeek 自家的。
哦哦 我们之前测试是 ChatGPT 系列,用不用 codex 差异较大 |
97
desstiony 1h 37m ago
最开始用 codex200x,切到 opus5.5 用了一周左右,被 ban 了,现在换回 codex ,难受的一批,太慢,太多防御门槛,一堆无用测试
|
98
chidiansha 1h 18m ago
至少先订阅个官方的吧哥们
|