每日维护

今天更新了
什么?

先看模型、数据集和数据关系发生了什么,再看排行榜、监控状态与仍未披露的信息。

按日期查看

更新摘要

每期固定从六个维度总结。没有变化会直接写明,不用从技术日志里寻找结论。

11最新
六个维度

2026-08-16 更新

01

模型

新增 LTX-2.5、SCoPE、EVOKE、Jogg-Avatar V2V 5B、TD-V2A、Genesis 与 Seedream 4.0。Genesis 提供官方开放权重,Seedream 4.0 为 API-only;另记录 JoyAI-Video-Edit 8 月 14 日参考图引导检查点升级。

02

数据集

新增 RealEstate10K、PanShot、OmniWorld、OmniEdit-Bench、TD-V2A FreeSound Training Snapshot,以及 Git-10M、SAT-493M、Million-AID、GeoPile、SSL4EO-S12、SkyScript、DIOR、RSI-CB、MagicBench 4.0、DreamEval。Git-10M 与五个公开上游补齐官方入口;SAT-493M、GeoPile 统一包和两个 Seedream 评测集明确标为无可核验下载。OpenHumanVid-Talking 更新为替换后的 8,989 段、约 12 小时版本;MVHumanNet++ 改指官方 ModelScope 下载入口,PosterCraft 明确组件级访问门槛。

03

数据关系

在原有 17 条关系上新增 11 条可解析关系:Genesis→Git-10M/SAT-493M、Seedream 4.0→MagicBench 4.0/DreamEval、Git-10M 对六个命名上游数据集的 source-component 谱系,以及 GeoPile→Million-AID 的嵌套来源关系。训练、继承预训练与评估保持严格区分。

04

排行榜

本日累计检测到 11 个榜单快照变化。最新一轮中,图片编辑榜 FLUX.2 [max] 离榜、Nano Banana 2 Lite 进入第 15;文生图榜 MAI-Image-2.5-Flash 与 FLUX.2 [max] 互换第 11/12,Krea 2 Medium Turbo 离榜、Seedream 4.0 进入第 15。Seedream 4.0 已用一手材料补卡,文生图覆盖恢复 required;DreamImage 2.0 与 MAGI-2 Preview 仍保留 monitor 缺口。

05

监控

新增 Genesis、Seedream 4.0、Git-10M、SAT-493M、六个上游源和两个 Seedream 评测集的官方页面或精确 revision 探针;已处置的 Hugging Face 候选加入排除列表。Dailymotion 监控范围同步纳入官方文档新增的 AI 辅助元数据能力。最终复扫检查 450 个来源:0 个新候选、3 个已核验重要修订、0 个失败、2 个榜单变化与 2 个 monitor 缺口。

06

未披露

Genesis 未披露 Git-10M 保留子集、采样权重与完整训练配置;Seedream 4.0 未披露精确数据身份、权利组合、混合权重、编辑三元组与偏好数据规模。SAT-493M、MagicBench 4.0 与 DreamEval 未发布数据文件;Git-10M 的统一许可不能替代上游与 Google Earth 权利审查。

查看完整核验记录 返回数据目录
10
六个维度

2026-08-05 更新

01

模型

新增 Qwen Image 3.0 Pro、JoyAI-Video-Edit、QuerySplat、InfiniSplat 与 LeapTalk。前者为阿里云限量预览 API,其余四项均有官方可下载权重;同时把 FLUX 3 Video 从 early access 更新为正式 API,并补充 Veo 3.1 Lite 的编辑与原生音频能力边界。

02

数据集

新增 Hypersim、DL3DV-Evaluation、ETH3D、ScanNet++、Tanks and Temples、VividHead 与 LongV2VBench。前六项均给出官方浏览或下载入口及访问条件;LongV2VBench 虽被论文正式命名并披露 229 个任务,但文件未发布,因此保持 unavailable 且不提供伪下载链接。

03

数据关系

新增 12 条可解析模型—数据集关系:JoyAI 关联 OpenVE-Bench/LongV2VBench;QuerySplat 区分 DL3DV-10K 训练与 DL3DV-Evaluation 评测;InfiniSplat 仅以 Hypersim 训练、四个真实数据集评测;LeapTalk 以 VividHead 蒸馏、HDTF/CelebV-HQ 评测。

04

排行榜

Arena 文生图新增第 5 名 Qwen Image 3.0 Pro 并完成映射;Artificial Analysis 图片编辑榜 Reve 2.1 新进第 1,文生视频榜发生 Kling 3.0、Wan 2.7 与 Veo 3.1 Fast/Lite 的顺位变化。最终无未映射的榜单模型。

05

监控

一手来源监控新增 12 个精确模型/数据集探针及相关项目源;FASHN VTON 1.5 的不稳定项目页被官方 GitHub 与已有精确模型探针替代。最终扫描 413 个来源,来源失败和排行榜缺口均为零。

06

未披露

Qwen Image 3.0 Pro 未披露模型架构与任何训练数据;JoyAI 虽披露各阶段规模和过滤/合成方法,但未命名源语料;QuerySplat/InfiniSplat/LeapTalk 均仍受冻结基础模型的继承数据未知影响。VividHead 许可元数据与正文不一致,Tanks and Temples 许可页也存在相互冲突的开放与非商业条款。

查看完整核验记录 返回数据目录
09
六个维度

2026-08-04 更新

01

模型

新增 VTON 360 历史模型卡,按 2025-03-15 官方论文日期排序;官方提供 THuman/MVHumanNet 两套百度 checkpoint,但没有 API,也未声明官方代码或权重许可。另补充 Grok Imagine Video 1.5 的 Arena 720p 排行榜别名。

02

数据集

新增 THuman2.0、CultureVidBench 与 MIE-Bench。THuman2.0 为申请制、非商业且禁止再分发;两个新评测均公布规模,但实际文件尚不可下载,因此明确记录 unavailable 且不提供伪下载链接。

03

数据关系

新增 VTON 360 到 THuman2.0 与 MVHumanNet 的四条关系,分别保留 fine-tuning 与 evaluation 角色;Stable Diffusion v1.5 继承语料维持 undisclosed,不创建无证据 catalog_id。

04

排行榜

记录 Arena 文生视频及 Artificial Analysis 图片编辑、图生视频、文生视频四榜变化;修复 Arena 图生视频端点并补齐 Grok Imagine Video 1.5 720p 映射后,所有前 15 名称均可解析。

05

监控

监控扩至 401 个一手来源,加入 VTON 360、THuman2.0、CultureVidBench 与 MIE-Bench 精确探针,并把 Arena 图生视频从失败的 filter 查询迁移至官方 first-rows 端点;最终扫描 0 失败、0 coverage gap。

06

未披露

VTON 360 未披露官方 checkpoint 许可、基础模型精确继承链、训练混合/算力/筛选与电商服装权利;CultureVidBench 与 MIE-Bench 未公开文件、许可、源内容权利及完整标注协议,MIE 官方占位下载当前返回 404。

查看完整核验记录 返回数据目录
08
六个维度

2026-08-03 更新

01

模型

新增 Qwen-Image-SP、MoRoute、Helios、SeFi-Image 与 Qwen-Image。Qwen-Image-SP 公开 Apache-2.0 图像权重及独立 35B-A3B 结构化提示扩展器;MoRoute 公布统一 T2V/I2V/参考生成/视频编辑方法但尚无代码、权重或 API;Helios 补齐 2026-03-04 已公开的 14B 实时长视频模型缺口;SeFi-Image 补齐 1B/2B/5B Base、Turbo 与 5B RL 非商业权重家族;Qwen-Image 补齐 2025-08-04 的 20B Apache-2.0 开放权重及其分阶段数据策略。

02

数据集

新增 25 张数据卡:Context Scaling 五套语料,MoRoute 的公开、受限及未发布训练/评测来源,Helios 三套训练/蒸馏/评测资源,SeFi-Image 的 450M 内部预训练、28M 合成文字、9M 续训、约 650K SFT 与 DiffusionNFT 提示池,以及 Qwen-Image 的 VAE 文字密集语料、预训练混合、SFT 与 DPO 偏好。下载状态、访问门槛、许可与缺失链接分别记录,不以模型许可覆盖训练媒体权利。

03

数据关系

新增 28 条模型—数据集关系:Qwen-Image-SP 五条、MoRoute 十条、Helios 三条、SeFi-Image 六条、Qwen-Image 四条。MoRoute LAION 子集、Helios ODE 对、SeFi 合成文字语料及续训混合共新增四条数据 lineage;评估集保持 evaluation-only,继承自 BAGEL、Wan2.1、Qwen3.5 等模型的未披露血缘没有伪造 catalog_id。

04

排行榜

Artificial Analysis 图像编辑榜中 FLUX.2 [max] 15→14、Kling Image 3.0 14→13、HiDream-O1-Image 13→15;图生视频榜 Vidu Q3 Pro 进入第 15、Veo 3.1 Lite 移出;文生视频榜 Kling 3.0 Omni 720p Standard 与 1080p Pro 分别 13→12、12→13。当前前 15 名称全部可解析,不从榜单能力或名次推断训练数据。

05

监控

新增 Context Scaling、MoRoute、Helios、SeFi-Image 与 Qwen-Image 官方项目/组织广域源,以及 5 个模型和 25 个数据集的一手 revision 探针;公开 Hugging Face 数据集和模型页加入候选排除表,避免将已覆盖条目反复当作新发布。PosterCraft、Wan 2.7、LTX-2.3、Dailymotion、Pexels 的 revision 均完成内容核对;WorldWeaver 仍因 Physical AI/交互环境范围明确排除。未修改 `sources/scenarios.yaml`,未创建 Physical AI 分类。

06

未披露

Qwen-Image-SP 未披露原始图片来源、权利、扩散微调规模、六类 RFT 提示源与 35B 公开扩展器相对论文 397B LoRA 的迁移方法;MoRoute 未披露内部视频、UE5 资产、各公开源实际贡献、权重与模型许可;Helios 未披露 0.8M 视频来源、过滤/去重/安全策略、ODE 对规模和完整 Wan2.1 血缘;SeFi-Image 未披露 450M 内部图片来源与权利、9M/650K 混合组成、合成字体许可及 RL 总迭代;Qwen-Image 未披露所有阶段的总规模、来源身份、许可与组件级配比。RefVIE-Bench 无数据集许可证;多套公开数据仍需分层复核媒体权利或非商业限制。

查看完整核验记录 返回数据目录
07
六个维度

2026-08-02 更新

01

模型

新增 Wonder:Adobe Research 与 Johns Hopkins University 于 2026-07-28 公布的相机可控实时视频生成系统。它以 Wan2.1-I2V-14B 初始化双向教师,再蒸馏为四步、三学生生成器的因果流式系统,支持图生视频和视频重拍、分钟级 16 FPS 生成与稀疏长程记忆;代码、权重、API 与模型许可证均未发布。

02

数据集

新增 MultiCamVideo、CamXTime、Wonder UE I2V Corpus、Wonder Blender V2V Corpus、Wonder I2V Benchmark、Wonder V2V Benchmark 与 MPIE-Bench 七张数据卡。前两项分别记录 333 GB 可直接下载的 136,000 条 UE5 多机位视频和需研究机构申请的 360,960 条完整时空网格视频;Wonder 两套合成训练语料和两套评测集均未发布;MPIE-Bench 已在官方仓库公开 2,500 个多人交互编辑测试样本与评分代码。

03

数据关系

新增 Wonder→DL3DV、MultiCamVideo、CamXTime、Wonder UE I2V Corpus、Wonder Blender V2V Corpus 五条微调关系,以及 Wonder→Wonder I2V/V2V Benchmark 两条评测关系。Wan2.1 继承数据单独记为未披露预训练血缘,不把评测集写成训练集。

04

排行榜

Artificial Analysis 图像编辑榜发生七处变化;生视频榜 Veo 3.1 Lite 进入图生视频前 15、Vidu Q3 Pro 移出,文生视频榜 Wan 2.7 与 SkyReels V4 互换第 8/9。所有前列名称仍可解析到模型卡,榜单只作为监控信号,不用于反推训练数据。

05

监控

新增 Wonder、MultiCamVideo、CamXTime 与 MPIE-Bench 一手探针,并把相机可控、交互式和长视频生成映射到既有生视频场景。Pexels 访问卡补充默认 200 次/小时、20,000 次/月限额、无限调用审核条件、可返回媒体尺寸和不返回标题/标签/详细统计的边界;API 可访问不代表获得训练权利。未创建 Physical AI 分类或公开入口。

06

未披露

Wonder 未披露各训练源精确留存量与混合权重、合成资产来源和许可、继承自 Wan2.1 的完整数据血缘、总训练步数、最终系统参数占用、代码、权重、API 与模型许可证。其四套未发布语料/评测集缺少文件、逐项来源和许可证;CamXTime 未声明数据许可证;MultiCamVideo 的 Fab/Mixamo 资产权利需另审;MPIE-Bench 的 Pexels、Harmony4D 与 CHI3D 媒体权利仍分层适用。

查看完整核验记录 返回数据目录
06
六个维度

2026-08-01 更新

01

模型

新增 Seedance 2.5 与 InstructAV2AV 两张模型卡;前者是最长 30 秒、支持参考控制和音视频联合编辑的产品模型,后者是已开放 Apache-2.0 权重的指令式音视频编辑模型。同步更新 Grok Imagine Video 1.5 的文生视频、图像/预设声线参考能力。

02

数据集

新增 InsAVE-80K、MovieBench、Condensed Movies、Short-Films-20K 与 AvED-Bench 五张数据卡;分别记录可下载的 139 GB 音视频编辑对、三项上游长视频来源和 110 条评测元数据的访问与分层权利边界。

03

数据关系

新增 InstructAV2AV→InsAVE-80K 微调关系和 InstructAV2AV→AvED-Bench 评测关系;新增 InsAVE-80K 对 MovieBench、Condensed Movies、Short-Films-20K、VGGSound 的四条 source-component lineage,以及 AvED-Bench→VGGSound 的 benchmark-derivative lineage。

04

排行榜

Artificial Analysis 图像编辑榜发生七处名次调整:MAI-Image-2.5 升至第 3、Nano Banana 2 降至第 4、Nano Banana Pro 升至第 5、Seedream 5.0 Pro 降至第 6、FLUX.2 max 升至第 13,HiDream 与 Kling Image 3.0 顺移;文生图榜 GPT Image 1.5 high 与 Nano Banana 2 互换第 5/6。没有未映射的前列模型。

05

监控

新增 Seedance 2.5、InstructAV2AV、InsAVE-80K、MovieBench、Condensed Movies、Short-Films-20K 与 AvED-Bench 的一手探针,并把 audio-video-editing、video-extension 纳入生视频场景映射;未创建 Physical AI 分类或发现入口。

06

未披露

Seedance 2.5 未披露架构、参数、技术报告、API、权重或任何训练数据;InstructAV2AV 未给出最终参数量、完整混合权重、逐来源留存量和继承自 Ovi 的预训练血缘;InsAVE-80K 的底层媒体权利、去重与论文 79K/公开版 87,074 训练对差异仍需逐项审计;AvED-Bench 未声明数据许可证。

查看完整核验记录 返回数据目录
05
六个维度

2026-07-31 更新

01

模型

新增 MiniMax H3、ShadowDancer、S-Avatar、UniGen-AR 与 ReMind 5B 五张模型卡:覆盖统一多模态视频、动作条件世界模型、单图 3D 头部数字人、统一视觉生成和动态记忆视频生成。

02

数据集

新增十三张数据卡,包含 Shadow Library、NeRSemble、DL3DV-10K、MiraData、Open X-Embodiment、ReMind1M、未发布的 ReMind Pexels 动态片段,以及 UniGen-AR 的五项公开训练来源和独立评测套件;每张卡均记录访问边界、下载入口与权利限制。

03

数据关系

新增十二条模型到数据集关系和四条数据集 lineage;S-Avatar 的 NeRSemble 与 UniGen-AR 的六项 benchmark 明确保持 evaluation-only,ShadowDancer 只把未发布的 Shadow Library 写成微调语料,ReMind 的公开和未发布来源分别关联。

04

排行榜

Artificial Analysis 的 MiniMax-H3 新进图生视频第 3、文生视频第 2、视频编辑第 1,并触发相邻名次顺移;图像编辑中 Seedream 5.0 Pro 升至第 5、Gemini 3 Pro Image 降至第 6。

05

监控

为五个新模型和十三张新数据卡建立一手探针,Sana Video 2 的限流探针改用稳定 arXiv 页面;按当前范围移除 Physical AI 场景分类及世界模型/机器人视频主动发现入口,目录继续聚焦生成式媒体应用。

06

未披露

MiniMax H3 未披露任何训练语料或技术报告;Shadow Library 未发布文件、完整配比和统一许可;S-Avatar 继承组件的数据 lineage 未重述;UniGen-AR 虽披露 800 万训练对,但未发布权重、代码、最终参数量和完整去重方案;ReMind 未披露完整来源配比和 Pexels 留存清单。

查看完整核验记录 返回数据目录
04
六个维度

2026-07-30 更新

01

模型

新增 Oxygen-TryOn、ID-V2V 与 JoyFox LiveTalk-DH 1.3B 三张模型卡,并把 Grok Imagine Video 1.5 的访问地址更新为官方稳定 API 页面。

02

数据集

新增九张数据卡,并确认 MV-Fashion 的受控仓库已实际上传按主体拆分的视频和标注压缩包;其访问仍须人工审批及签署非商业研究协议。

03

数据关系

新增六条模型到数据集关系和两条数据集衍生关系;训练、奖励模型、强化学习、评测与上游组件保持独立,不把评测集写成训练数据。

04

排行榜

图像与视频榜单完成两轮更新;最新一轮文生图、文生视频和图生视频榜单出现顺序变化,所有前列名称仍已映射到模型卡。

05

监控

监控扩大到 328 个一手来源,新增 17 个 Hugging Face 模型发布 feed,覆盖图像/视频生成与编辑、数字人/本地化、试衣、音视频和 3D,并对 LoRA、量化、镜像与 Demo 自动降级。

06

未披露

Oxygen-TryOn、ID-V2V 与 JoyFox LiveTalk-DH 均未完整披露训练来源、权利基础和配比;Hugging Face 上的搬运仓与衍生权重不视为新模型发布。

查看完整核验记录 返回数据目录
03
六个维度

2026-07-28 更新

01

模型

本轮没有发现证据充分的新模型或需要修改事实卡的模型版本;已跟踪的主流图像、视频、数字人和试衣模型保持不变。

02

数据集

没有新增数据集;PosterCraft 等公开数据页面的规模和许可结论未发生实质变化。

03

数据关系

没有新增训练、微调、偏好或评测关系;九个机器候选均未形成可核验的新数据血缘。

04

排行榜

图生视频榜单出现一次明确换位:Dreamina Seedance 2.0 720p 升至第一,Gemini Omni Flash 降至第二。

05

监控

更新 Dailymotion API v2 资料并替换四个不稳定探针;298 个一手来源的最终复扫无失败、无恢复项、无排行榜映射缺口。

06

未披露

多家模型页面虽有内容更新,但没有新增训练数据名称、规模、清洗方法、合成策略或许可信息,因此未推进核验日期。

查看完整核验记录 返回数据目录
02
六个维度

2026-07-27 更新

01

模型

集中补齐世界模型、视频编辑、影视配音、口型同步、视频试衣、3D 生成和统一图文生成模型,代表性新增或更新包括 WorldWeaver、Solaris、ElasticTTT、Mage-Flow、InnoText、AgentHOI 与 fMRI2Face。

02

数据集

为新增模型补齐公开下载、受限申请和未发布三类数据卡,重点覆盖 Solaris、DAVIS、CineDub、CelebV-Dub、TryAny-Bench、ViViD、ConsIDVid 等数据资产。

03

数据关系

模型与数据集关系扩展到 129 条,数据集衍生关系达到 27 条;训练、评测、运行时输入和继承数据被分别标注,并修复了页面中的关系跳转。

04

排行榜

扩展多家供应方的图像与视频排行榜覆盖,记录 Recraft V4.1 与 Grok Imagine Image Quality 的名次互换,并补齐前列模型映射。

05

监控

监控范围扩大到 298 个一手来源,新增世界模型、配音、试衣和 3D 数据的重点探针;最终扫描没有来源失败或排行榜映射缺口。

06

未披露

多项论文只披露数据规模或处理流程,未发布语料文件、来源清单或完整许可;脑信号、人脸、影视素材和游戏数据继续保留隐私与权利边界。

查看完整核验记录 返回数据目录
01
六个维度

2026-07-26 更新

01

模型

首轮集中补齐图像、视频、数字人、虚拟试衣、音频和 3D 模型,代表性新增包括 Midjourney V8.2、Muse Image / Video、Omni2Sound、SANA-Video 2.0、Mage-Flow、TalkVerse-5B 与 OpenVE-Edit。

02

数据集

新增 SoundAtlas、Cap3D、Objaverse-XL、完整 Omni2Sound 音频语料链,以及 Try-On、数字人、图像生成和视频编辑方向的一批公开或受限数据卡。

03

数据关系

建立模型到训练、微调、偏好和评测数据的明确关系,并加入数据集之间的衍生链路;评测集、未发布语料和可下载训练集不再混写。

04

排行榜

开始维护五个主流图像与视频榜单的前列模型,首批记录 66 个席位;所有重点席位都要求能映射到具体模型卡。

05

监控

建立覆盖模型、数据集、官方仓库和新数据发布源的持续监控体系,并让关系变化能够反向定位受影响的模型和数据集。

06

未披露

多项闭源或 API 模型仍未公开训练语料名称、来源权利和配比;目录明确保留“未披露”,不根据生成能力猜测训练数据。

查看完整核验记录 返回数据目录