Jev
Jev 是 TypeSafe 在 9 月 15 日放出来的一个模型。
最近又开始轰炸我的信息流。
记录一下一些看法。
从原理上讲,它既然是零样本分类器,不是自回归大模型,那么它就只适合干快速‘决策’。官方说法叫“System One”模型。
https://docs.typesafe.ai/concepts/system-one
不要跟着自媒体自嗨,它的快是因为它既然是分类器,这也就意味着你是不能指望它帮你产出选项,也不能帮你给解释。
你提供【选项 + 自然语言的描述】,它产出【决策】。
这种组合尤其适合玩实时游戏、操作机械。
是不是AI玩星际争霸2又可以再搞起来了?
这种组合突然之间就爆开了,但这里面每一项东西其实也不是什么新的。主要还真是你看,技术再怎么发展,都得靠人去灵活运用它,把它做成产品、做成服务。
多模态支持吗?
目前不是多模态模型,图像、音频、视频都得你在外面先转成文字或结构化字段再喂给它。
所以现在还打不了通用游戏——它看不见屏幕。想玩星际,得先有个模块把画面转成它能读的结构化状态。
短板决定你怎么使用它
- 无法做出解释。
- 中文理解能力差。
- 上下文短,32k/64k,准确率会随着无关材料增多而下降。
- 无法处理量化要求,不会算术,官方明确要求计算放在代码里做,Jev只做语义印象。
- 快反射,而非慢思考,意味着不适合做很多推理条件、多层推理的任务。判断力会被稀释。
- 不能微调。
对我有啥用
我好像个人暂时用不上,我就算是文档审核都是需要反馈意见的。用它不够。而文风验证的场景,它也不能直接胜任,因为文风要求的复杂度较大、交叉维度较多,需要深度思考。
公司项目那边从样本到决策如果逐渐复杂到要分路由的话,可以把一部分环节交给Jev。