V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  sentinelK  ›  全部回复第 1 页 / 共 85 页
回复总数  1684
1  2  3  4  5  6  7  8  9  10 ... 85  
没有 agent 相关经验,能测出个啥来呢……

AI 时代特别可怕的一点就是,一大票人认为:AI 会做 = 自己懂了
这点特别可怕。
这个目录结构也是典中典了。
难懂程度和课本有一拼,有“反自学设计”。
“假如让 ai 来参与设计语言,应该会很厉害吧”
是,毕竟 AI 的上下文更长,更容易找到语法解析、语义效率、语义展示这三者之间的甜点。

但是没必要。目前的“编程语法”是自然语言。
用 4bit 量化可以,但效率慢到哭。
RTX PRO 5000 ,540p 竖屏,15 秒 I2V ,要 700 秒。
换成普通 m5 的话(不是满血 MAX ),大概时间要 5x~10x 。

性能其实是视频模型很重要的一个参数,毕竟和 LLM 不同,图、视频是要 seed 抽卡的。
5 天前
回复了 sh537612856486 创建的主题 程序员 加入学习 FDE 技能
@dko 生存空间几近压缩,只能说目前固定收入(类似维护费、年费)还能活。
好在我司一直是走小公司路线,所以成本比较低。

目前我们的解题思路是借着 AI 的生产力解放,基本上是让甲方无边界定制。
只要有需求,且给定制费,就无条件给做。

相当于从产品思路转换成了定制服务的思路,从而增高自己的壁垒。防止行业内竞争对手的价格内卷循环。
5 天前
回复了 sh537612856486 创建的主题 程序员 加入学习 FDE 技能
@dko 就是这个逻辑。本质上是顶着专业人员的名头,实际履行的是半个销售,半个客服。
5 天前
回复了 sh537612856486 创建的主题 程序员 加入学习 FDE 技能
@dko 我司是传统 saas 行业,所以理论上讲,很多业务是和甲方基层有利益冲突的。所以和甲方基层“打成一片”就是我们这边实施的必修课。

在我的经验看来,你不能跟总监/部门经理搭上话,实施基本上是不合格的。
5 天前
回复了 sh537612856486 创建的主题 程序员 加入学习 FDE 技能
在国内驻场实施不就是个“出气筒+陪酒员+传声筒”么?
什么是“三件套”……

可以当作了解或者学习的练手。
但是试图做头部还是算了……

这其中有几个因素是决定性的。
1 、你不知道未来的模型走势,很有可能你做了几个月,结果第二天模型版本更新直接掀了你的桌子。
2 、你不知道模型和运行环境的细节,导致很多优化都是臆测或者穷举。这就导致你的生产力极度受限。
3 、你不懂模型核心,这就导致你的 harness 很大程度上是空中楼阁。

一个适配自家模型的团队,和一个完全第三方的个人,你认为谁出精品的概率更大……
再不济,你真的是骨骼精奇,做出了世界第一 Agent ,你的成果对于官方而言可能就是几分钟的工作量而已……
再退一万步,你的 Agent 独步天下,不用你的 Agent 就没法 coding 。官方把你的 Agent 封禁了,或者负优化,你又如何?
5 天前
回复了 gux928 创建的主题 程序员 阿里的 tokenplan 真是一言难尽
阿里的 deepseek 限流非常严重,TPM 1.2M token
1:没有顺序。Agent 的本质就是 ReAcT 这篇论文。
2:目前流行的 Agent 都是“反框架”的。
4:没有顺序,他们分别只是不同的能力。你说你是先学走路、先学吃饭还是先学说话?都要学,但哪个先学都可以。
5:OpenCode 就不错
6:没有突出的,或者说大家都一样。Agent 这个东西他就没有客观评价体系。主观的输入 + 主观的引擎 = 主观的结果。
7 月 30 日
回复了 0bit0 创建的主题 程序员 你们公司会自己研发编程 agent 吗?
能想到的需要自开发 Agent 的场景,要么就是要限制权限(模型调用,对话内容,工作区限制等),要么就是要搜集数据(比如把员工的 Agent 操作流程和行为抽象成 skill )
7 月 28 日
回复了 ujujzhaos 创建的主题 OpenAI 为了 token 的价格会是按小时进行浮动
电力公司为何要跟模型公司谈判……
强者要主动跟弱者谈判吗?

另,目前 LLM 根本就不是如何计费的问题,目前的问题是,很多模型产品,压根消费者就没权利知道消费详情。
模型公司说你烧了多少钱,就是多少钱。
7 月 27 日
回复了 chnwine 创建的主题 程序员 半年 OPC, 打算终结这段旅程了
一般的 OPC 不是真的“一人”,只是人力极少。
出圈的基本都是 3~5 人这个规模。

核心就是一个人销售(公共关系、客户关系)、一个人运营(公司管理、成本控制)、一个人开发(业务实现,方案支持)。
这种东西不讨喜的,因为无法证伪。
很简单,谁定义谁负责。
他用 AI 出方案,你用 AI 实施。
靠开源 agent 找工作:很难,agent 只有大厂有兴趣,本质上就是借 agent 这个入口做数据飞轮。
而大厂其实对你做了什么完全不感冒。除非你是行业头部 top3 ,比如你是 hermes agent 、openCode 的核心作者。即便如此,他们看中你的也不是你的 Coding 技能,而是你作为头部的业务资源。

code agent 是不是太卷了:不是卷,是门槛太低。随便一个阿毛阿狗都可以三分钟复刻一个 Agent ,而且 ReAcT 像模像样。你怎么证明你和他们不一样?
本质上就是 agent 这个东西,几乎不能独立自证自己架构的价值。可能你今天的表现很棒,但是第二天结论就翻覆了。

你花几个月的时间打磨适配给世界第一厨师的炒锅,第二天厨师手断了,或者老年痴呆了,又或者厨师改做法不用炒了,你的炒锅和其他几十块钱的有什么区别?
提需求的人怎么会管技术选型呢?你吃馒头你要管他用什么锅蒸吗?

工程学当然是谁定方案谁负责。
这跟智力没什么关系,单纯的就是后训练的审查边界太低。
这就像是谁都知道女孩着急上厕所可以去闯男厕,她们之所以不去不是因为智商不足想不到,而是因为道德和心理约束。

至于说为何“审查边界低”,那就不得而知了。我只知道审查边界低有助于模型的表现上限。
1  2  3  4  5  6  7  8  9  10 ... 85  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1352 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 32ms · UTC 17:00 · PVG 01:00 · LAX 10:00 · JFK 13:00
♥ Do have faith in what you're doing.