sentinelKV2EX member #631792, joined on 2023-05-30 20:41:02 +08:00Today's activity rank 34 |
| deepseek-flash 的第三方跑分趣闻 DeepSeek • sentinelK • 9h 50m ago • Lastly replied by sentinelK | 3 |
| Hermes Agent 9 月更新纪实: bot 机制补全了 hermes 的最后一块基石,产品功能设计逐渐向 GUI 倾斜。 Hermes Agent • sentinelK • 3 days ago |
| mac m5 ultra 上线中国官网。1.2T 显存带宽, 256GB 版本 8.6 万 Local LLM • sentinelK • Aug 28 • Lastly replied by sadan9 | 51 |
| RTX PRO 5000(或其他 48GB 显存)的 Qwen3.8-27B-FP8 配置交流(prefill 5000+t/s, decode 60+t/s)
1 Local LLM • sentinelK • Aug 26 • Lastly replied by tgfbeta
|
55 |
| OpenCode go 订阅开始区分模型提供额度, kimi-k3、deepseek-v4-pro 等只有 15$的额度,请各位注意用量。 程序员 • sentinelK • Jul 20 • Lastly replied by shuck | 49 |
| lama.cpp 目前有重大性能 bug: checkpoint 的巡回逻辑对于混合模型(比如 qwen3.6-27B)无效,从而导致大概率每次对话都要 prefill 全文,严重拖慢速度 Local LLM • sentinelK • Aug 3 • Lastly replied by tgfbeta | 16 |
| 阿里百炼的自建 DeepSeek 限速是 TPM 1.2M,这限速是拍脑袋的吗? 程序员 • sentinelK • May 28 • Lastly replied by sentinelK | 2 |
9h 50m ago Replied to a topic by sentinelK › DeepSeek › deepseek-flash 的第三方跑分趣闻 |