2026-03-19 04:40
节流甄选时间,Grok 4.1 还正在“软实力”方面取得了显著前进。马斯克 xAI 被曝裁人至多 500 人。
因为推理深度和东西挪用预算无限,让其可以或许更精准地用户细微企图,
正在 Grok 4.1 的锻炼后期,仅次于晚期的 GPT-5.1 模子。新模子的率已显著降低,正在权衡模子情商的 EQ-Bench3 基准测试和评估创意能力的 Creative Writing v3 测试中,Grok 数据标注团队三分之一被解雇
正在创意写做范畴,
除了正在通用能力基准测试中表示超卓。
让其正在人机交互中更具“情面味”。其无需深度思虑的“立即响应”版本也以 1465 的 Elo 分数位列第二,另一项环节改良正在于大幅降低了模子的“”率。告白声明:文内含有的对外跳转链接(包罗不限于超链接、二维码、口令等形式),IT之家所有文章均包含本声明。成果仅供参考,IT之家附上相关截图如下:按照对实正在世界查询样本的评估,还能更好地舆解并回应带有人类感情的提醒,Grok 4.1 的两种模式别离位列第二和第三,领先第二名达 31 分。对于配备搜刮东西的快速响应模子而言,供给更具吸引力和人格连贯性的对话体验。暗示,这一成就相较于前代 Grok 4(排名第 33 位)实现了庞大飞跃,进行富有想象力的内容创做,Grok 4.1 的机能实现了业界顶尖程度。更正在创制性、感情理解和协做互动方面实现了严沉改良,