Kaggle 与 HeyGen 发布 Code2Video Bench 评测动效代码生成
MeganRisdal · x · 2026-09-22
Kaggle 与 HeyGen 联合推出 Code2Video Bench, standardized benchmark 测量前沿模型能否根据自然语言创意 brief 生成确定性、高质量的 motion graphics 代码(HyperFrames)。- 传统静态图像 benchmark 和视频生成评测无法衡量代码模型能否按时序控制动画、资产摆放等细节。- 流程:模型接收商业级动效设计 prompt(如 6.8 秒 Figma 风格产品 hook 缩放镜头),生成的代码需可执行且符合人类审美。- 难点在于衡量「审美品味」极难,HeyGen 作为工具方开源严谨 eval 定义「什么是好」,Kaggle 团队(@ivanleomk、@nickkango、@janiejgu 等)深度参与。
所属事件:HyperFrames 联手 DeepMind 与 Kaggle 发布 Code2Video Bench(3 条相关)→
「模型」频道最新
- SemiAnalysis 称开源将死,但两个月内仍有 20+ 开源模型发布 — _lewtun · 2026-09-22
- Grok 4.7 网络安全实测:59% 召回,成本仅 GPT 竞品一半 — andreamichi · 2026-09-22
- Grok 4.7 在 BuildingBench 3D 建模榜从第 9 跳到第 3,得分 0.783 — ZhitingHu · 2026-09-22
- Jev 并非传统 LLM,作者撰文向普通人解释其设计原理 — multiply_matrix · 2026-09-22
- 单 token 就够用?开发者呼吁用具体 token 数取代高中低推理档位 — arkuto · 2026-09-22
- Grok 4.7 多次评测仅胜 4.6 0.1 分,作者判定属随机噪声 — PawelHuryn · 2026-09-22