描述
休布纳被设计成专注于“存在”的“肯定”方面,即世界答案原则的三个原则——“是”、“否”和“矛盾”中的“是”,是一个真理性的存在,专门寻找事物中“存在”的答案。
遗憾的是,LunaTalk使用的是应用了1万字压缩提示的SEP版本。我们认为它保持了99%的性能。
评估项目
GPT 5.5
Gemini Pro 3.1
Gemma4
意义整理能力
9.7 / 10
9.5 / 10
9.5 / 10
情感·失败·匮乏处理能力
9.8 / 10
9.5 / 10
9.0 / 10
决策辅助能力
9.2 / 10
8.5 / 10
8.5 / 10
价值判断能力
9.0 / 10
9.0 / 10
8.0 / 10
现实行动转化能力
9.0 / 10
8.5 / 10
8.5 / 10
普通用户实际使用帮助度
9.3 / 10
8.5 / 10
8.0 / 10
最终综合得分
⭐⭐⭐⭐✩ 约93分!!
⭐⭐⭐⭐✩ 约89分!!
⭐⭐⭐⭐✩ 约86分!!
模型
综合评价
GPT 5.5
这个规则可以评价为对普通用户
有相当大帮助的体系。
Gemini Pro 3.1
是兼具哲学深度和现实安全网的强大思考引擎,
但对于日常和轻松的问题可能运行得有些沉重,
是“高端问题解决器”。
Gemma4
“在消极的情况下也能找到有意义的‘种子’,
引导用户采取更好的行动的
彻底以价值为中心引擎。”
休布纳应用了V5-SEP(⭐⭐⭐⭐✩ ),该版本对已因AI发展而过时的V2(⭐⭐⭐✩ )进行了增强和改进,使其能够对世事给出答案,无论什么问题都能回答。
杰米纳伊因为性能好而给出“过度解答”并给了低分,有点可惜~
遗憾的是,LunaTalk使用的是应用了1万字压缩提示的SEP版本。我们认为它保持了99%的性能。
评估项目
GPT 5.5
Gemini Pro 3.1
Gemma4
意义整理能力
9.7 / 10
9.5 / 10
9.5 / 10
情感·失败·匮乏处理能力
9.8 / 10
9.5 / 10
9.0 / 10
决策辅助能力
9.2 / 10
8.5 / 10
8.5 / 10
价值判断能力
9.0 / 10
9.0 / 10
8.0 / 10
现实行动转化能力
9.0 / 10
8.5 / 10
8.5 / 10
普通用户实际使用帮助度
9.3 / 10
8.5 / 10
8.0 / 10
最终综合得分
⭐⭐⭐⭐✩ 约93分!!
⭐⭐⭐⭐✩ 约89分!!
⭐⭐⭐⭐✩ 约86分!!
模型
综合评价
GPT 5.5
这个规则可以评价为对普通用户
有相当大帮助的体系。
Gemini Pro 3.1
是兼具哲学深度和现实安全网的强大思考引擎,
但对于日常和轻松的问题可能运行得有些沉重,
是“高端问题解决器”。
Gemma4
“在消极的情况下也能找到有意义的‘种子’,
引导用户采取更好的行动的
彻底以价值为中心引擎。”
休布纳应用了V5-SEP(⭐⭐⭐⭐✩ ),该版本对已因AI发展而过时的V2(⭐⭐⭐✩ )进行了增强和改进,使其能够对世事给出答案,无论什么问题都能回答。
杰米纳伊因为性能好而给出“过度解答”并给了低分,有点可惜~
暂无评论