与上一代 3.5 Flash 相比,新模型在多项任务上输出 Token 减少 17%,代码质量提升显著。
📝 详细摘要
作为 Thread 的后续推文,小互详细对比了新模型(上下文推测为 Gemini 3.6 Flash)与上一代的改进:输出 Token 减少 17%,价格下降;DeepSWE 得分从 37% 提升至 49%;OSWorld 测试达到 83%,在知识型工作上也有明显进步。配图显示具体数据。
📊 文章信息
AI 初评:83
来源:小互(@imxiaohu)
作者:小互
分类:人工智能
语言:中文
阅读时间:1 分钟
字数:166
标签: Gemini 3.6 Flash, 模型对比, 性能提升, 代码质量, 电脑操作