“中文常识题、英文理解、代码生成、数学推理、长文本总结,五个方向,各出了二十道题。”
她叹了口气。
“五个方向,它都赢了。”
桌上一片沉默。
李总放下了筷子,眉头皱着。
“赢得多吗?”
邱明丽自嘲的笑了一声。
“我就不说具体分数了,但差距……不小。”
“尤其是那种需要多步推理的题,我们这边的模型基本上做到第三步就开始胡言乱语了。”
“它还能稳稳地往下推。”
“你把一道国内高考压轴题扔给它,它就算做错,它做错的路子也是对的。”
“它是在认真地算错,不是那种一看就知道在瞎编的错。”
“这个东西,是我们目前的模型最缺的。”
那个戴眼镜的男人放下了刀叉,慢慢地开口。
“邱总,我其实一直有个问题想请教。”
“gpt-3到gpt-3.
5中间这一跳,到底关键是跳在哪儿的?”
“外面现在一提就是rlhf,好像那一套人类反馈就是所有答案。”
“但我总觉得没那么简单。”
邱明丽笑了一下。
“你这个问题,问到点子上了。”
“rlhf这几个字,最近被炒得有点太凶了。”
他用筷子头在桌布上虚划了一下。
“gpt-3到gpt-3.
5,真正那一跳,不是rlhf。”
“是代码。”
桌上有人愣了一下。
“代码?”
邱明丽点头。
“openai中间悄悄干了一件事。”
本章未完,请翻下一页继续阅读.........