头条推荐
一 | 作为世界上最大的天然气生产国之一,相信人们不会想到卡塔尔会热衷于举办第一届碳中性的FIFA世界杯。 IT之家 7 月 21 日消息,科技媒体 The Decoder 昨日(7 月 20 日)发布博文,报道称谷歌 DeepMind 发布 GenCeption 模型,将预训练的视频生成器重新用于深度估计和分割等经典计算机视觉任务。 IT之家援引博文介绍,大语言模型在学习预测下一个 Token 的时候,在训练过程中往往需要吸收语法、世界知识和上下文关系等内容。

二 | 但是在计算机视觉领域,视觉模型缺少等效的训练方法,主要由专业模型主导,包括用于分割的“Segment Anything”和用于深度估计的“Depth Anything”,每个模型都使用其特定的架构。

三 | 谷歌 DeepMind 团队为此提出 GenCeption 模型方案,尝试将一个“生成视频”的 AI 模型逆向改造成一个能“理解世界”的视觉分析引擎。

四 | 据悉,自从11年前申办世界杯以来,卡塔尔就一直设想举办一个碳中性的活动。 GenCeption 打破了传统计算机视觉“一个任务一个专用模型”的格局,仅凭单一模型就能同时做好深度估计、图像分割、3D 姿态估计、表面法线预测和相机姿态估计等核心视觉任务。 GenCeption 基于阿里巴巴开源视频模型通义万相 Wan2.1 系列训练,与传统扩散模型需多步去噪不同,GenCeption 在一次前向传播中完成预测,从而提升视觉任务处理速度。根据FIFA 2022年卡塔尔世界杯可持续发展战略,举办该活动需要建造至少8个体育场、数个训练场及支持它的基础设施,所有这些都会产生温室气体排放(GHG)。为了帮助解决这个问题,组织者已经承诺在设计和施工方面取得最低四星级的GSAS认证。模型通过文本提示指定任务,可输出深度图、表面法线图、分割掩码,并可处理相机运动表示。该认证是通过节能策略实现,如通风、照明和水暖装置。

五 | 训练数据以合成为主。论文称,数据集仅包含 7500 段视频,由 800 个数字人体模型与 200 段动作捕捉序列组合生成,再通过 Blender 在不同背景和镜头角度下渲染。 泛化方面,GenCeption 几乎只在单人合成视频上训练,但可处理真实多人视频,也可迁移到动物和类人机器人类别。论文称,部分输出细节甚至超过训练时 Blender 渲染结果,可保留猫胡须和单根发丝边缘。此外,卡塔尔将利用可再生能源如太阳能,为体育场空调供电。

六 | 性能方面,论文给出两组处理时间数据:小模型处理 81 帧视频约需 6 秒;大模型参数量为 140 亿,处理同样长度视频约需 10 秒。 参考。他们甚至利用海运集装箱建造了一个可重复使用的体育场。对该建筑的设计分析表明,在运行时可节省高达47%的能源。然而根据FIFA的研究,预计赛事中一半以上的温室气体排放来自于旅行。

七 | 现代眼下正在加紧努力,以过提供生态友好型交通工具如IONIQ 5和电动巴士来帮助抵消这一影响。

八 | 现代汽车为2022年FIFA世界杯带来电动交通工具一支环保车队将首次大规模地在FIFA世界杯上亮相。

九 | 现代表示,它将提供236辆电池电动汽车和混动车以促进碳中性的活动。现代汽车将使用的几款EV包括:现代IONIQ 5Genesis G80 EVGenesis GV70 EV这些EV都将被用来运送贵宾和工作人员,此外,现代汽车还计划为媒体提供其Elec City零排放巴士。现代将通过使用两辆具有车辆到负载(V2L)功能的现代IONIQ 5电动汽车提供路边充电服务。FIFA表示,它将包括一个由停车场设施提供的100千瓦至150千瓦电动车充电器组成的充电网络。2022年FIFA世界杯将于11月20日至12月18日举行。现代汽车CEO在谈到碳中和的目标及其电动交通工具的选择如何帮助时说道:“现代汽车和FIFA共同承诺,通过使用清洁交通工具使今年的赛事获得可持续的成功。通过提供我们的环保混动车和电池电动车作为地面交通工具,我们期望实现我们的共同目标从而使卡塔尔世界杯成为地球和人类的双赢。
Current article:http://2xsuz.diapoqiechuangpenghua.sbs/list_0ub11/pb7t.html
Published on:01:08:32