京东开源 JoyAI-Video-Edit 实现 720p 实时因果视频编辑;LightX2V 推出 LightWan2.2-A14B 单卡 5090 将 Wan2.2 视频生成提速至 22.5 秒;ChatGPT 免费版将开放 GPT-5.6 Luna 无限纯文本聊天;PyroDash 与 code-review-graph 分别提供模型协同推理和代码理解工具。
📝 详细摘要
本文为机器之心 SOTA 模型的每日发现,介绍了五项最新 AI 开源进展。京东开源的 JoyAI-Video-Edit 面向开放时长视频做逐帧因果编辑,用户可在视频进行中持续输入指令更换主体、场景或风格,官方在单张 NVIDIA B200 上报告 720p 約 30 FPS,代码與約 34.06 GB 權重已採用 Apache-2.0 授權並提供邀請制 Demo。LightX2V 團隊針對 Wan2.2-A14B 推出高效版 LightWan2.2-A14B,透過 Phased DMD 將 40 步去噪壓縮為兩步高噪聲專家+兩步低噪聲專家,結合 NVFP4 量化感知訓練與動態塊稀疏注意力,單張 RTX 5090 生成 5 秒 720p 視頻的端到端延遲為 22.5 秒(文生)和 26.7 秒(圖生),相較原版分別加速 118.7 倍和 100.5 倍。OpenAI 在 8 月 6 日更新確認 GPT-5.6 Luna 成為 ChatGPT 免費用戶的默認模型,並計提供下週起無限純文本聊天(文件、圖片等工具仍有額度),事實錯誤率較 GPT-5.5 Instant 下降約 62%。PyroDash 是一個小模型自行判斷何時將部分推理軌跡交給大模型的框架,基於 Qwen3.5-4B 的 SFT 與 GRPO 權重,λ=0.05 版本在五個數學推理基準上平均準確率 64.04%,比 LLM-only 基線高 6.36 個百分點並降低 20.4% 成本。code-review-graph 使用 Tree-sitter 構建代碼倉庫的本地關係圖,修改後自動計算影響半徑與最小審查集合,並可透過 MCP、CLI 或 GitHub Action 將相關上下文交給編碼 Agent;基準顯示使用圖譜檢索後 Token 使用量中位數減少約 65 倍。所有項目均提供開源權重與部署說明,門檻從低(Docker、ComfyUI)到高(需專業 GPU 與視頻推理經驗)不等。
💡 主要观点
- JoyAI-Video-Edit 实现 720p 实时因果视频编辑,单卡 B200 达 30 FPS。 京东开源的该系统由多模态条件编码器、因果 Video VAE 和 16B MMDiT 组成,用户可在视频进行中持续输入自然语言指令更换主体、场景或风格,代码与约 34.06 GB 权重采用 Apache-2.0 授权并提供邀请制 Demo。
💬 文章金句
- 官方在单张 NVIDIA B200 上报告 720p 约 30 FPS。
- 单张 RTX 5090 生成 5 秒 720p 视频最快需 22.5 秒。
- ChatGPT 免费用户将可无限进行 GPT-5.6 Luna 纯文本聊天。
- λ=0.05 版本在五个数学推理基准上的平均准确率为 64.04%,比其 LLM-only 基线高 6.36 个百分点,同时降低 20.4% 成本。
- 使用图谱检索后 Token 使用量中位数减少约 65 倍。
📊 文章信息
AI 初评:72
来源:机器之心SOTA模型
作者:机器之心SOTA模型
分类:人工智能
语言:中文
阅读时间:11 分钟
字数:2652
标签: AI 编程, 视频生成, 视频编辑, 模型推理, 开源项目