V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  zhmouV2  ›  全部回复第 1 页 / 共 12 页
回复总数  234
1  2  3  4  5  6  7  8  9  10 ... 12  
4 天前
回复了 zeni18 创建的主题 问与答 一直不理解 skills, 这不就是提示词吗?
skills ,可按需加载的、可复用的提示词。
传入的是摘要,然后模型自己判断是否需要加载 skills 的全文。

有人说脚本,脚本也不是 skills 的本质特征啊,你不要任何 skill ,直接告诉 LLM 脚本 / 接口怎么调用,一样能调用吧,这是模型的 function / tools calling 能力。

LLM 输入输出都是 token ,这意味着大部分新名词都是换个皮的说法。譬如 context 和 prompt 之间差异,包括之前的智能体,大多数时候不也是写一段角色扮演的提示词?真的是新瓶装旧酒,利用了 LLM 极强的 few shots 能力。

进一步说,思维链一开始也只是提示词而已,就是输入上让它一步步思考。后面才发展出来专门的 <think> 标记,以及训练上鼓励这些 token 的生成还有思维链的长度奖励函数。
不过现在 openclaw 的热度不都快凉了吗?是一个啥样的 ai 产品? ai 客服? ai 总结分析?
8 月 31 日
回复了 meetqyx 创建的主题 分享发现 上线了一个整理照片的网站
虽然没用过,说几个常见的 idea
有没有手机相册 app 那种常见的面容聚类?同一个人的人像打上一样的 tag
类似时间线的时间管理维度,以及基于 exif 属性的地图钉模式
图片相似度(phash 、直方图余弦相似度),便于用户误存重复图片时筛选质量最高的图
@coefu
你提的这几个问题很“有意思”,但是哪个都不是单独靠 harness / agent 能实现的。我倒是想听听你对解决这些问题有什么的 idea

第一条,如果要用 harness 思考,像是把 MOE 架构的路由前置到用户侧。主动思考基本上把一个小模型塞到 harness 里面,那问题又变成了,怎么决定这个主动思考的小模型什么时候唤醒?这个问题依然可以继续延伸下去。让 harness 思考这个说法本身就很怪异,仿佛我们是用 prompt 本身来思考一样。

第二条,依赖 LLM 本身的 context 。harness 本身能做的就不多,上下文压缩不可能完全摆脱 LLM:基于预设规则移除工具调用记录的输出、基于 LLM 本身的摘要总结。没听说过什么 harness 方案能让 gpt-3.5-4k 的上下文变成 1M 的

第三条,这个问题本身就像大语言模型能否思考一样抽象。harness 到底要怎么“感受”?这个问题且抛开不谈,就算问大语言模型能否 [感受] 到时间流逝也是纯纯的哲学研究,跟讨论中文房间的思想实验差不多。从理论上来看,LLM 就是无状态的,你今天提问 LLM 一个问题 和 明天提问 LLM 一个相同的问题,在输出上不会有显著的差异。一个具有时间平移不变性的物理定律能感知到时间流逝么?我们能通过某个实验现象来区别实验是今天还是昨天做的?甚至我们对时间的定义本身就是哲学思辨。
百度首页:
https://imgur.com/a/6jCHZjq

另外 acid3 是个比较老的测试标准了,html5test.co 按照支持特性打分目前是 381 / 588
8 月 13 日
回复了 WorkerMatt 创建的主题 问与答 大家真的觉得 Manus 是套壳 Agent 么
“当时只到是寻常”
8 月 11 日
回复了 Ayanokouji 创建的主题 程序员 大模型领域 token 这个词, apple 的翻译
词元并非官方硬点才有的翻译。。。
8 月 10 日
回复了 Tiger1994 创建的主题 问与答 你们是怎么一眼看出对方发的是 AI 写的?
ai 在某些语气、遣词造句上过拟合了。
“不是 xxxx (一个很浅显的名词),而是 xxxx (一个很高大上的名词)”
“你的说法基本正确,但更准确地说...”
“一句话说” / “一句话总结” ...
8 月 7 日
回复了 Acegik 创建的主题 生活 独居居家办公一般吃什么?
是啊,吃什么!
7 月 30 日
回复了 pc10201 创建的主题 教育 公办二本计算机专业,有必要听老师讲课吗?
@xtreme1 机器学习里面分类器的 hello world ,就是泰坦尼克数据集
一等舱和二等舱的生还率是有显著区别的。。。。。。
7 月 23 日
回复了 loveyou1 创建的主题 分享发现 梁文锋四小时投资人会议实录
别的没啥意见,我觉得认为第 3 条 多模态只是 产品 / C 端 的需求有点狂妄了。。。。。。
跟股市恐怕没啥关系吧
现在世界杯 很明显了
7 月 20 日
回复了 KarlDai 创建的主题 Claude 看不懂 claude 的输出了,虽然都是中文
@DingJZ 你这带衬线字体看着更累。。。
7 月 19 日
回复了 bluescorpio 创建的主题 程序员 小红书下载无水印视频原理是什么?
@iixy 那更应该不要水印啊,我下片儿都得精挑细选个没有新葡京广告的,至少也得是字幕组精心压制的版本。平台水印怎么能忍!
@HotieCutie 确实啊 我记得 v 站也有人发这种 demo 的,这种确实也在 ai 能力的甜点区,我并没有觉得特别惊艳
xai 发 grok4.5 的 benchmark 里面 SWE Pro 5.5xhigh 打不过 glm5.2
7 月 8 日
回复了 yujianfei 创建的主题 OpenAI GPT 5.5 的 Context window 只有 258k!
我虽然没觉得这是个问题,但是我就是用的中转站的 api ,cli 能生效 app 就是不生效 有点蛋疼
来源呢?这么多 emoji ,又是 ai slop?
6 月 29 日
回复了 SayHelloHi 创建的主题 OpenAI OpenAI 偷偷给部分用户推送 GPT-5.6-sol
我开 5.5high 都是 128 欸。。。。。。而且我用的是中转站 更不可能优先体验 5.6 了
输出 token vs 输入 + 输出 token 吧

用 New API 建站的中转站就是显示的后者,而且由于大模型是无状态的,每次请求都得带上所有之前的对话,多轮对话的累积输出是线性增加的,但是输入就成等差数列求和,是按平方增长的
1  2  3  4  5  6  7  8  9  10 ... 12  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2786 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 40ms · UTC 12:41 · PVG 20:41 · LAX 05:41 · JFK 08:41
♥ Do have faith in what you're doing.