ALL TOPICS
MODEL INTELLIGENCE
CHINESE EVALUATIONS
AGENTS & GENERATION
COST & INFRASTRUCTURE
METHODS & DATA
Chinese Evaluations
聚合更依赖中文语境、文化知识和中文产品表达的模型评测。每项测评独立保留来源、样本、指标和局限,不合成为本站总分。
SCOPE
命理、古诗词、成语、中文写作等任务各自衡量不同能力,不把它们平均成模糊的“中文总分”。
本站展示已有评测的原始结论与技术结果,评测设计者仍是口径的解释主体。
明确样本数、时间、Prompt 条件和失败原因,让读者知道结论能外推到哪里。
让不同模型解读同一份匿名年度命理样本,比较中文表达、命理依据、现实信号、行动建议与结构化输出稳定性。