有没有 AI 之间交叉印证结论的工具

6 月 5 日
 myflourishway

痛点:

在使用 AI 查询时发现,针对同样的问题,各个“权威 AI”之间的答案都存在差异,有些甚至是根本性的对错差异。

现有情况:

有 arena.ai 这样的多 AI 作答的工具,但依然无法直接懒狗式的获取结论,因为有时会一个 AI 说对一个 AI 说错。一般用户是无法快速验证多 AI 提供的证据的,所以这又把问题丢给了用户 -- 要不自己选择一个觉得可靠的 AI ,要不就自己花大量时间去找 AI 提到的信息源头自己验证。

需求:

理想有一个 AI 工具,用户可以自由地配置多个 AI 对用户问题进行回答,然后它们之间互相质询得出结论的证据的真实性,最后它们内部之间通过投票得到统一结论,或者,直接丢出对彼此证据的争议,让用户自行判断。

现在有这样的工具吗?

1487 次点击
所在节点    问与答
5 条回复
atwoodSoInterest
6 月 5 日
这确实是个问题,现在一般都是选一个感觉可靠的 AI ,然后就偏听偏信了。
myflourishway
6 月 5 日
@atwoodSoInterest 这么明显的痛点问题,应该是已经有对应的解决方案了才对
seWindows
6 月 6 日
现在的 AI 叫做 LLM ,生成式大语言模型。并非当初设想的 AI 。

LLM 最大的特定是,生成概率最大的下一个 token 是“概率最大”,而非最合理的。而很多知识其实是长尾知识。LLM 能有概率答对。因此大模型的早期率会显著提高,而实现量变引起质变。

与最初的 AI 完全是两码事了,当初设想的 AI:“准确,没有感情,唯一性,机械化思考”,现在 AI 属于 LLM 办事反而随机而不唯一了。
seWindows
6 月 6 日
@seWindows 打错字了,不是“早期率”,是“准确率”
myflourishway
6 月 7 日
@seWindows 我知道是基于概率的预测,但是这和多大模型交叉印证提升准确率有冲突吗?

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1218252

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX