https://typesafe.ai/blog/introducing-system-one-models-and-jev
看下来花里胡哨的,不确定是噱头还是真厉害,只看文章确实有独到之处,有没有用过的分享一下
https://typesafe.ai/blog/introducing-system-one-models-and-jev
看下来花里胡哨的,不确定是噱头还是真厉害,只看文章确实有独到之处,有没有用过的分享一下
1
Cambra1n 6h 54m ago
网络延迟大于生成延迟,中文泛化有点弱。这个方向还挺值得关注。
|
2
zhangli2946 6h 45m ago
waitlist 已经 join. 求个 invite
|
3
skuuhui 6h 42m ago
觉得是未来 harness 环节中的一环。
|
5
kuhung 6h 41m ago
其实算上乱七八糟的延迟,没有那么快。我用 openrouter 简单测了下,推理速度比 Gemini2.5 flash lite 快很多,但成本其实只能控制到一半。https://jev.kuhung.me/
个人觉得,最大的传播点就是用来做判别器。AI slop 检测器、小游戏演示、类似发牌的翻页。 |
6
sampeng 6h 41m ago
已经在用了。改造 pi 中。计划中的:
1.根据上下文自动设置思考等级 2.压缩优化,自动判定 tool 结果需要保留还是总结 3.子模型自动选择模型 4.code gate |
7
EyebrowsWhite OP @zhangli2946 vercel 和 cloudflare 都可以用,我正在接入,准备上手试试
|
8
AEDaydreamer 6h 31m ago
用来加速 use browser 的速度,其他暂时懒得折腾.
|
9
raptor 6h 13m ago
这种东西开源本地部署还不错,云端就算了
|
10
naythefirst01 5h 52m ago
有人用 qwen 小参数模型做出同样的效果了,感觉就是要速度有速度,要智商有速度
|
11
KJH 5h 50m ago
之前申请通过了,然后试了试,有点没用明白
|
12
wxm 5h 49m ago
本地部署需要什么配置
|
13
sampeng 5h 30m ago
@naythefirst01 差远了
|
14
drealism 5h 29m ago
@naythefirst01 openjev 看到了,但是效果咋样,没看到具体的数据了。。。
|
15
SilencerL 5h 10m ago
|
16
liushengxian1230 5h 6m ago
不理解 感觉这个边界不是早被通用大模型吃过了吗。而且国产模型又便宜又好用
|
17
andrew2558 5h 6m ago
不得不说这些人创新能力是真的强,这么奇特的应用场景。发掘点真的是强
|
18
maolon 5h 1m ago 概念是花里胡哨的,因为实际用途就是一个意图分类模型(基于 bert ),也早就有人做过了,主要用于像是比如过信息过滤(垃圾邮件过滤),模型路由,安全过滤这些用 llm 太重太慢的场景。
除了楼上那些用小型 llm 去模拟他的效果,这个应该才是跟 jev 同源的最接近的模型( https://github.com/NandhaKishorM/laya ),作者提供了和 jev 的直接对比而且比 jev 还快(以及暗搓搓的暗示 jev 是抄他们的),非常适合本地部署。 但是话又说回来了,你的料再扎实也不如这个包装的好牛逼,这个 system one 营销是真的牛逼 |
19
sampeng 4h 50m ago via iPhone
@maolon 我也知道肯定有,但是这东西就是像 pi 一样…没有 openclaw 等热门的东西使用很难爆发。这个方向我认为是对的,有更好的本地我当然用本地的。感谢分享,这个才是和 jev 一路的。qwen 的都是模拟的
|
20
7gugu 4h 44m ago
试了一下 vercel 的 API ,看起来只能用来回答 Yes or No 或者概率分布的问题,可能最大的卖点就是上下文够短,可以做本地部署了吧
|
21
maolon 4h 39m ago
@sampeng #19 llm 很多场景都是大炮打蚊子,特殊场景用特殊模型才是最优解。
我不爽 jev 就两点,一个是他的 api 居然收这么贵(作为这个特定的用途,特别是比较其他同类模型),二是他的隐私政策完全不透明,那么默认应该当成这次测试所有的请求他们都会拿来训练,就限制了很多用途我不想用他来做分类 |
22
sampeng 4h 36m ago via iPhone
@maolon 你推荐的这个确实不错,我简单看了一下。但也只是底模,要能用要做微调,也是个麻烦事。这就是 ai 时代的新特点吧,图省事,用 close 的模型。喜欢折腾,这种特化的自己训练微调一下还真不一定比 jav 的差哪去
|
23
ndxxx 4h 29m ago via Android
这个 jev 的特性,马上就能被国模公司抄下来,让子弹飞一会就行了,延迟价格分分钟给你打下来🤣
|
24
sunnysign 4h 13m ago
试了。确实好秒级输出。并且是在上下文不算小的场景下。如果是普通的模型输出要几分钟的东西,用 jev 能够缩短到 300ms ,且结果正确。
|
25
chengxiao 3h 33m ago
这个东西一出来是不是以后的游戏里全是外挂了
|
27
wingoo 2h 43m ago
程序里面原本用 llm 的大量判断可以替代了, 而且价格便宜, 感觉下个月应该有可用的开源出来了
|
28
chlsg88 2h 5m ago
结合 claude hooks 做了一个完成度判断
|