如果真的就是概率论来做预测的话,那么精准度完全依赖于资料,所以最后还是数据为王?
必须的,本质就是推测下一个字,一个字一个字的推测
是的 本质就是概率论 线性回归之类的 统计学的重要性 在这一刻无比的突出
字节还出了一个付费邀请博士生提供先进论文、高质量内容
哈哈哈 这么简单
概率语言模型
@RyanVan #5 所以其实这种模型也无法做到很精准,只能用大量的资料来堆
@jeffming #6
最初不带思考和联网的gpt4是这样的,也就是一般说的幻觉率很高。 现在的底层原理其实已经有了很大的发展,幻觉率已经可以控制到非常低了。
@RyanVan #7 就是说其实这些ai公司对于自己搞的大模型底层精准度到底是多少是非常清楚的,但是从开没有真正公开过数据
@jeffming #8 幻觉率是可以定量测试的,比如下面这个数据就在某些场景就有一定参考价值 https://github.com/vectara/hallucination-leaderboard
@RyanVan #9 OK,我去瞅瞅
必须的,本质就是推测下一个字,一个字一个字的推测
是的 本质就是概率论 线性回归之类的
统计学的重要性 在这一刻无比的突出
字节还出了一个付费邀请博士生提供先进论文、高质量内容
哈哈哈 这么简单
概率语言模型
@RyanVan #5 所以其实这种模型也无法做到很精准,只能用大量的资料来堆
@jeffming #6
最初不带思考和联网的gpt4是这样的,也就是一般说的幻觉率很高。
现在的底层原理其实已经有了很大的发展,幻觉率已经可以控制到非常低了。
@RyanVan #7 就是说其实这些ai公司对于自己搞的大模型底层精准度到底是多少是非常清楚的,但是从开没有真正公开过数据
@jeffming #8
幻觉率是可以定量测试的,比如下面这个数据就在某些场景就有一定参考价值
https://github.com/vectara/hallucination-leaderboard
@RyanVan #9 OK,我去瞅瞅