V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  zhmouV2  ›  全部回复第 1 页 / 共 13 页
回复总数  245
1  2  3  4  5  6  7  8  9  10 ... 13  
❮ ❯
17 小时 42 分钟前
回复了 enihcam 创建的主题 › macOS › macOS 下很多软件都是在弥补 macOS 的设计缺陷。
better display 必备啊

比方说我 2560*1600 的副屏尺寸比较小,想开低分辨率用。

结果都是 16:10 。开 1600*1000 就糊得一批,1280*800 就很清晰。。。。。。
9 月 24 日
回复了 SKull4 创建的主题 › 问与答 › 如何让非 coding 朋友用上 Astra/最好的模型
那不是 api 按量随用随付比较好吗
非 coding ,那多半没有超长上下文,主要考虑输出开销,astra 1M 输出是 50 刀,一天一个问题,最多 0.5 刀,3 块钱左右。不担心隐私问题,那就找中转站,还能折价 50%
cc-switch 接 opencode 的 mimo 上有俩问题,一个是推理强度只有 high ,开 xhigh 就直接报错,没有 fallback 。其次 图片不支持 detail level ,得手动改下 model_catalog 那个文件。
9 月 22 日
回复了 Giaorui 创建的主题 › 职场话题 › 救命 上班看微信被领导谈话了。。。
@bclerdx 上班时间刷 V2 ?
低成本的决策模型,但是结果对不对就不知道了
玩梗归玩梗,X 上崔添翼帖子底下的声音还是批评居多。
这个切换只能说明 Deepseek 官方还是不适合作为 api 提供者,哪个公司会依赖这样版本管理的 api 去做产品?
(不过仅作为个人 coding 用户,我本来也用不起 dsv4 pro ,而且我早就知道切换下架 api 很快这一点,所以我并不意外,而且貌似代码相关的表现很好,所以我本身没有反感,影响不到我。)
之前会议上说用户赶都赶不走,不想做 to C ,现在这个表现又不适合做 to B 那就要问 Deepseek/梁文锋到底打算做谁的生意呢?总不能说我就是想搞研究,就是不做生意吧?
两个 llm 互相 check 吧,前者生成结果后者 check 咯,后者 check 完的结果让前者确认下。
就算是试卷类的也没有那么重要吧,国家级试卷?
只要不是小语种,我觉得可能更需要担心一下 glitch token 而不是翻译效果。如果真的财大气粗,那就请人翻译咯(
什么样的预算就接受什么样的效果嘛
你这猫帧率有点低哈哈
9 月 1 日
回复了 zeni18 创建的主题 › 问与答 › 一直不理解 skills, 这不就是提示词吗?
skills ,可按需加载的、可复用的提示词。
传入的是摘要,然后模型自己判断是否需要加载 skills 的全文。

有人说脚本,脚本也不是 skills 的本质特征啊,你不要任何 skill ,直接告诉 LLM 脚本 / 接口怎么调用,一样能调用吧,这是模型的 function / tools calling 能力。

LLM 输入输出都是 token ,这意味着大部分新名词都是换个皮的说法。譬如 context 和 prompt 之间差异,包括之前的智能体,大多数时候不也是写一段角色扮演的提示词?真的是新瓶装旧酒,利用了 LLM 极强的 few shots 能力。

进一步说,思维链一开始也只是提示词而已,就是输入上让它一步步思考。后面才发展出来专门的 <think> 标记,以及训练上鼓励这些 token 的生成还有思维链的长度奖励函数。
不过现在 openclaw 的热度不都快凉了吗?是一个啥样的 ai 产品? ai 客服? ai 总结分析?
8 月 31 日
回复了 meetqyx 创建的主题 › 分享发现 › 上线了一个整理照片的网站
虽然没用过,说几个常见的 idea
有没有手机相册 app 那种常见的面容聚类?同一个人的人像打上一样的 tag
类似时间线的时间管理维度,以及基于 exif 属性的地图钉模式
图片相似度(phash 、直方图余弦相似度),便于用户误存重复图片时筛选质量最高的图
@coefu
你提的这几个问题很“有意思”,但是哪个都不是单独靠 harness / agent 能实现的。我倒是想听听你对解决这些问题有什么的 idea

第一条,如果要用 harness 思考,像是把 MOE 架构的路由前置到用户侧。主动思考基本上把一个小模型塞到 harness 里面,那问题又变成了,怎么决定这个主动思考的小模型什么时候唤醒?这个问题依然可以继续延伸下去。让 harness 思考这个说法本身就很怪异,仿佛我们是用 prompt 本身来思考一样。

第二条,依赖 LLM 本身的 context 。harness 本身能做的就不多,上下文压缩不可能完全摆脱 LLM:基于预设规则移除工具调用记录的输出、基于 LLM 本身的摘要总结。没听说过什么 harness 方案能让 gpt-3.5-4k 的上下文变成 1M 的

第三条,这个问题本身就像大语言模型能否思考一样抽象。harness 到底要怎么“感受”?这个问题且抛开不谈,就算问大语言模型能否 [感受] 到时间流逝也是纯纯的哲学研究,跟讨论中文房间的思想实验差不多。从理论上来看,LLM 就是无状态的,你今天提问 LLM 一个问题 和 明天提问 LLM 一个相同的问题,在输出上不会有显著的差异。一个具有时间平移不变性的物理定律能感知到时间流逝么?我们能通过某个实验现象来区别实验是今天还是昨天做的?甚至我们对时间的定义本身就是哲学思辨。
百度首页:
https://imgur.com/a/6jCHZjq

另外 acid3 是个比较老的测试标准了,html5test.co 按照支持特性打分目前是 381 / 588
8 月 13 日
回复了 WorkerMatt 创建的主题 › 问与答 › 大家真的觉得 Manus 是套壳 Agent 么
“当时只到是寻常”
8 月 11 日
回复了 Ayanokouji 创建的主题 › 程序员 › 大模型领域 token 这个词, apple 的翻译
词元并非官方硬点才有的翻译。。。
8 月 10 日
回复了 Tiger1994 创建的主题 › 问与答 › 你们是怎么一眼看出对方发的是 AI 写的?
ai 在某些语气、遣词造句上过拟合了。
“不是 xxxx (一个很浅显的名词),而是 xxxx (一个很高大上的名词)”
“你的说法基本正确,但更准确地说...”
“一句话说” / “一句话总结” ...
8 月 7 日
回复了 Acegik 创建的主题 › 生活 › 独居居家办公一般吃什么?
是啊,吃什么!
1  2  3  4  5  6  7  8  9  10 ... 13  
❮ ❯
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   786 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 30ms · UTC 21:15 · PVG 05:15 · LAX 14:15 · JFK 17:15
♥ Do have faith in what you're doing.