yanaraika

yanaraika

V2EX member #157703, joined on 2016-02-01 14:38:05 +08:00
Today's activity rank 16029
Per yanaraika's settings, the topics list is hidden
Deals info, including closed deals, is not hidden
yanaraika's recent replies
@sillydaddy 感谢写了这么多回复。我刚看完了李永乐和彭导的挂谷猜想感觉各有千秋。李永乐并没有详细介绍证明历程和证明方法而只是介绍了问题本身和成果,里面也有人说这里没看懂可以去看漫士。

我的观点是公式和概念和科普并不是天然冲突的,如果能受众看懂公式并希望了解发展方向,纳入其中就是挺好的方式,所以个人没有那么抗拒。如果想做面向大众的科普的确你说的这几个会更适合一些。
@sillydaddy 我以为他的目标群体是学过大学高数、了解过基本分析学概念的理工科人士。和李永乐和彭导不是一个赛道的。类似于大学里的没那么难的 xx 学概论课这种。有的东西确实没有公式说不清,他给的公式也都是简化形式的。跟上节奏的话很爽甚至可以举一反三自己学科里的某个理论
@sillydaddy 我是它的前 1000 个订阅者,他的科普还不错啊我每期必看。只是现在圈子扩大到他本来不打算涉及到的人群了
这个不是共识吗?稍微想想就知道,目前教育制度下完全没有任何中小学“教好课”的激励措施,你是老师为什么要好好教?能教好课的我直接在外面补习就行了
很多时候大公司签了只用某家云的协议,作为代价云处理所有的 billing 、税务、合规、统一 sdk 、SLA ,所以云的价格是会比原来的 api 更贵的
之前看到种猜想是 5h 是附近几个数字中不能被 24h 整除的,这样每天 reset 时间不一样让用户没法规划“等一等就好了”,push 大家去买产品。如果是 7h 又太久了
10 days ago
Replied to a topic by iorilu › 程序员 › 感觉 github 也被 ai 搞废了
而且现在有很多金絮其外的草包项目,表面上看上去 ui readme 做得不错,实际上很多功能都不实现或者是错的。以前可以从 readme 质量判断项目质量,现在不行了
@SiWXie “让模型决定何时自己开启思考模式,QWen 曾经尝试过,证明这是一个坏主意”来源请求?如果你说的是 qwen3 hybrid thinking ,那是比较早在小模型下的老黄历了,而且也有一些模型像是 anthropics 在这个模型下做的不错的。这两年也有很多 paper 专门做这个取得了不错的效果。qwen 属于刚做这个后训练没做好,不是普遍规律

现在大部分模型都会自己决定思考深度,当年的 fixed budget 模式早就过时了。思考深度和 accuracy 的平衡也是后训练重要的一环。现状恰恰说明了依靠第三方做思考深度、怎么 compact 这些优化迟早会被第一方做掉
@SiWXie 外置决策模型也只是一个暂时的状态。完全可以主模型自己 sft/rl 出什么时候需要、怎么 compact 。而且目前有最多 harness 使用数据的还是第一方(第三方 harness 的热度被夸张了,有大量的企业用户依旧只能使用第一方)。我倾向于 harness 层第三方没有太多可做的
Self Compacting Language Model Agents 这个方向是正确的。压缩应该在 rl 阶段直接作为模型的一部分提供,最终呈现为 server side compaction 。现在 coding agent 的这一大堆杂七杂八的实现长期来看没太大意义
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   908 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 9ms · UTC 20:34 · PVG 04:34 · LAX 13:34 · JFK 16:34
♥ Do have faith in what you're doing.