性能评测

科技人工智能

小米发布MiMo-v2.6-Pro大语言模型,性能与定价优势明显

小米于2026年9月21日发布MiMo-v2.6-Pro大语言模型。该模型在Artificial Analysis Intelligence Index上得分46分,远高于该指标中位数18分,展现出超越同类开源模型的性能表现。

科技人工智能

Claude Opus 5发布,性能大幅提升价格保持不变

Anthropic推出了Claude Opus 5大模型。新模型相比前代Opus 4.8实现了显著的性能提升,同时维持原有价格——输入令牌$5/百万,输出令牌$25/百万。

科技人工智能

AI实验室是否为特定基准优化模型?研究未发现"Pelican最大化"现象

研究人员通过系统实验检验了一个假设:顶级AI实验室是否针对"生成pelican骑自行车"这一著名基准任务对模型进行了优化。