ARTICLE · 人工智能

京东开源 JoyAI-Video-Edit,实现 720p 实时因果视频编辑;LightX2V 推出 LightWan2.2-A14B,单卡 5090 加速 Wan2.2 视频生成至 22.5 秒

作者:机器之心SOTA模型 来源:机器之心SOTA模型 2026-08-07 16:36 11 分钟 2652 字
AI 编程视频生成视频编辑模型推理开源项目
一语总结

京东开源 JoyAI-Video-Edit 实现 720p 实时因果视频编辑;LightX2V 推出 LightWan2.2-A14B 单卡 5090 将 Wan2.2 视频生成提速至 22.5 秒;ChatGPT 免费版将开放 GPT-5.6 Luna 无限纯文本聊天;PyroDash 与 code-review-graph 分别提供模型协同推理和代码理解工具。

AI 总结

本文为机器之心 SOTA 模型的每日发现,介绍了五项最新 AI 开源进展。京东开源的 JoyAI-Video-Edit 面向开放时长视频做逐帧因果编辑,用户可在视频进行中持续输入指令更换主体、场景或风格,官方在单张 NVIDIA B200 上报告 720p 約 30 FPS,代码與約 34.06 GB 權重已採用 Apache-2.0 授權並提供邀請制 Demo。LightX2V 團隊針對 Wan2.2-A14B 推出高效版 LightWan2.2-A14B,透過 Phased DMD 將 40 步去噪壓縮為兩步高噪聲專家+兩步低噪聲專家,結合 NVFP4 量化感知訓練與動態塊稀疏注意力,單張 RTX 5090 生成 5 秒 720p 視頻的端到端延遲為 22.5 秒(文生)和 26.7 秒(圖生),相較原版分別加速 118.7 倍和 100.5 倍。OpenAI 在 8 月 6 日更新確認 GPT-5.6 Luna 成為 ChatGPT 免費用戶的默認模型,並計提供下週起無限純文本聊天(文件、圖片等工具仍有額度),事實錯誤率較 GPT-5.5 Instant 下降約 62%。PyroDash 是一個小模型自行判斷何時將部分推理軌跡交給大模型的框架,基於 Qwen3.5-4B 的 SFT 與 GRPO 權重,λ=0.05 版本在五個數學推理基準上平均準確率 64.04%,比 LLM-only 基線高 6.36 個百分點並降低 20.4% 成本。code-review-graph 使用 Tree-sitter 構建代碼倉庫的本地關係圖,修改後自動計算影響半徑與最小審查集合,並可透過 MCP、CLI 或 GitHub Action 將相關上下文交給編碼 Agent;基準顯示使用圖譜檢索後 Token 使用量中位數減少約 65 倍。所有項目均提供開源權重與部署說明,門檻從低(Docker、ComfyUI)到高(需專業 GPU 與視頻推理經驗)不等。

核心要点
  1. JoyAI-Video-Edit 实现 720p 实时因果视频编辑,单卡 B200 达 30 FPS。

    京东开源的该系统由多模态条件编码器、因果 Video VAE 和 16B MMDiT 组成,用户可在视频进行中持续输入自然语言指令更换主体、场景或风格,代码与约 34.06 GB 权重采用 Apache-2.0 授权并提供邀请制 Demo。

  2. LightWan2.2-A14B 将 Wan2.2 推理压缩至 4 步,单卡 RTX 5090 生成 5 秒 720p 视频仅需 22.5 秒。

    通过 Phased DMD 将 40 步去噪压缩为两步高噪声专家+两步低噪声专家,结合 NVFP4 量化感知训练与动态块稀疏注意力,端到端延迟为 22.5 秒(文生)和 26.7 秒(图生),相较原版分别加速 118.7 倍和 100.5 倍。

  3. ChatGPT 免费用户将获得 GPT-5.6 Luna 无限纯文本聊天。

    OpenAI 8 月 6 日更新确认 GPT-5.6 Luna 成为免费及 Go 用户的默认模型,下周起提供无限纯文本聊天(文件、图片等工具仍有独立额度),事实错误率较 GPT-5.5 Instant 下降约 62%。

  4. PyroDash 让小模型自行决定何时将推理交给大模型,平衡准确率与成本。

    基于 Qwen3.5-4B 的 SFT 与两组 GRPO 权重,λ=0.05 版本在五个数学推理基准上平均准确率 64.04%,比 LLM-only 基线高 6.36 个百分点并降低 20.4% 成本;λ=0.6 版本可将 LLM Token 占比压至 1.90%,总成本从 49.36 美元降至 1.78 美元。

  5. code-review-graph 通过本地关系图显著降低编码 Agent 的 Token 消耗。

    使用 Tree-sitter 扫描函数、类、调用等关系并存入 SQLite,修改后计算影响半径与最小审查集合,基准显示使用图谱检索后 Token 使用量中位数减少约 65 倍,支持多种 AI 编码平台及增量更新。

京东开源 JoyAI-Video-Edit,实现 720p 实时因果视频编辑;LightX2V 推出 LightWan2.2-A14B,单卡 5090 加速 Wan2.2 视频生成至 22.5 秒

本文为机器之心 SOTA 模型的每日发现,介绍了五项最新 AI 开源进展。京东开源的 JoyAI-Video-Edit 面向开放时长视频做逐帧因果编辑,用户可在视频进行中持续输入指令更换主体、场景或风格,官方在单张 NVIDIA B200 上报告 720p 約 30 FPS,代码與約 34.06 GB 權重已採用 Apache-2.0 授權並提供邀請制 Demo。LightX2V 團隊針對 Wan2.2-A14B 推出高效版 LightWan2.2-A14B,透過 Phased DMD 將 40 步去噪壓縮為兩步高噪聲專家+兩步低噪聲專家,結合 NVFP4 量化感知訓練與動態塊稀疏注意力,單張 RTX 5090 生成 5 秒 720p 視頻的端到端延遲為 22.5 秒(文生)和 26.7 秒(圖生),相較原版分別加速 118.7 倍和 100.5 倍。OpenAI 在 8 月 6 日更新確認 GPT-5.6 Luna 成為 ChatGPT 免費用戶的默認模型,並計提供下週起無限純文本聊天(文件、圖片等工具仍有額度),事實錯誤率較 GPT-5.5 Instant 下降約 62%。PyroDash 是一個小模型自行判斷何時將部分推理軌跡交給大模型的框架,基於 Qwen3.5-4B 的 SFT 與 GRPO 權重,λ=0.05 版本在五個數學推理基準上平均準確率 64.04%,比 LLM-only 基線高 6.36 個百分點並降低 20.4% 成本。code-review-graph 使用 Tree-sitter 構建代碼倉庫的本地關係圖,修改後自動計算影響半徑與最小審查集合,並可透過 MCP、CLI 或 GitHub Action 將相關上下文交給編碼 Agent;基準顯示使用圖譜檢索後 Token 使用量中位數減少約 65 倍。所有項目均提供開源權重與部署說明,門檻從低(Docker、ComfyUI)到高(需專業 GPU 與視頻推理經驗)不等。

文章金句

"

官方在单张 NVIDIA B200 上报告 720p 约 30 FPS。

"

单张 RTX 5090 生成 5 秒 720p 视频最快需 22.5 秒。

"

ChatGPT 免费用户将可无限进行 GPT-5.6 Luna 纯文本聊天。

"

λ=0.05 版本在五个数学推理基准上的平均准确率为 64.04%,比其 LLM-only 基线高 6.36 个百分点,同时降低 20.4% 成本。

"

使用图谱检索后 Token 使用量中位数减少约 65 倍。