资讯365
热点关键词

怎么看网友用两小时就实现了 TypeSafe AI 用了两年 RLCD 才做到的 Jev 模型效果?怎么回事?

前几天,ChatGPT/RLHF 早期核心贡献者之一 Diogo Almeida,在最近发布了 Jev 模型,他花了2年在 stealth 模式开发新训练方法 RLCD(Reinforcement Learning for Calibrated Decisions)才训练出来 Jev ,定位是“System One 决策模型”:不生成自由文本,只做结构化决策/分类/路由,输出带校准概率的 type-safe 结果。 宣称比普通 LLM 快 20-200 倍、便宜 40-400 倍,输出 token 免费,专为软件可直接调用的决策场景优化。 然后 Harsha 直接开源了一个基于 Qwen-2.5-1B 的小模型(Qwen-2.5-1B-RLCD),在用极短时间开源一个“穷人版 Jev 核心能力”,因为 TypeSafe AI 公司发布的 Jev 模型是没有开源的。

广告合作位内容与广告清晰分离

为什么受到关注?

该关键词近期出现在知乎热榜,历史最高排名第 24 位。热榜排名只能反映平台内一段时间的关注程度,不等同于事件重要程度或事实结论。

已确认的信息

前往原平台核验详情 ↗

榜单趋势

最近 7 次榜单快照的排名走势(排名越低越靠前),每格为一次采集记录。

09-24 01:16
第24名79 万热度
09-24 01:31
第24名84 万热度
09-24 01:46
第24名74 万热度
09-24 02:01
第24名77 万热度
09-24 02:16
第24名70 万热度
09-24 02:31
第24名93 万热度
09-24 03:46
第26名89 万热度

相关热点

用这个关键词创作