4月15日,可灵AI在北京中关村国际创新中心举行“灵感成线模型发布会,宣布基座模型再次升级,面向全球正式发布可灵2.0生成模型及可图2.0图像生成模型。
数据显示,自去年6月发布以来,可灵AI已累计完成超20次迭代,截至目前,全球用户规模突破2200万。来自世界各地的超1.5万开发者和企业客户,将可灵的API应用于不同的行业场景中。
一直以来,可灵AI致力于提升模型基础质量,增强画质清晰度,并引入更多创新功能,以满足用户多样化需求。快手高级副总裁、社区科学线负责人盖坤表示,可灵希望让每个人都能用AI讲出好故事,实现更加精准的复杂创意表达。
可灵AI全系模型进入2.0时代,定义人和AI交互的全新方式
4月15日,可灵大模型2.0版本及可图大模型2.0版本正式面向全球发布。据悉,可灵2.0模型在动态质量、语义响应、画面美学等维度,保持全球领先;可图2.0模型在指令遵循、电影质感及艺术风格表现等方面显著提升。
盖坤介绍,两款模型在团队内部的多项胜负率评测中,均稳居业内第一。例如在文生领域,可灵2.0对比谷歌Veo2的胜负比为205%,对比Sora的胜负比达367%,在文字相关性、画面质量、动态质量等维度上显著超越对手。
自去年6月发布以来,可灵AI已累计完成超20次迭代。3月27日,全球知名AI基准测试机构Artificial Analysis发布了最新的全球生成大模型榜单,快手可灵1.6pro以1000分的Arena ELO基准测试评分登陆图生赛道榜首。
作为全球首个用户可用的DiT生成模型,截至目前,可灵AI全球用户规模已突破2200万,累计生成1.68亿个及3.44亿张素材。自去年6月上线个月时间里,可灵AI的月活用户数量增长25倍。
盖坤认为,AI在辅助创意表达上拥有巨大潜力,但当前的行业发展现状还远远无法满足用户需求,在AI生成内容的稳定性、以及用户复杂创意的精确传达上仍有“很多挑战”。也因此,要真正实现“用AI讲好每一个故事”的愿景,必须对基模型能力进行全方位提升,定义人和AI交互的“全新语言”。
一直以来,可灵AI致力于提升模型基础质量和模型效果,并引入更多创新功能,以满足用户的多样化需求。在本次2.0模型的迭代中,可灵AI正式发布AI生成的全新交互理念Multi-modal Visual Language,让用户能够结合图像参考、片段等多模态信息,将脑海中包含身份、外观、风格、场景、动作、表情、运镜在内的多维度复杂创意,直接高效地传达给AI。
“大家应该很自然地会感受到文字在表达影像信息时,是不完备的。我们需要有新的方式,能让人真正精准地表达出心中所想。”盖坤指出,MVL由TXT和MMW组成,能从生成设定的基础方向以及精细控制这两个层面,精准实现AI创
基于MVL理念,可灵AI正式推出多模态
可灵2.0大师版正式发布,全新上线多模态
基于MVL这一全新交互方式,发布会现场,快手副总裁、可灵AI负责人张迪发布了全新的可灵2.0大师版,在语义响应、动态质量、画面美学等方面显著提升生成效果。
“可灵2.0大师版不仅仅是一次简单的技术升级,更是一次全方位的体验跃升。”张迪介绍,可灵2.0大师版实现了技术、体验、美学的三重突破。
值得一提的是,可灵2.0大师版全面升级及图像创作可控生成与
张迪披露,当前,图生约占到可灵AI创作量的85%,质量也对的生成效果产生重要作用。
在图像生成大模型领域,快手的可图2.0处于行业领先水平,拥有多项核心优势,诸如强大的复杂语义理解能力、电影级的画面质感、多条件的可控风格化生成等。在团队内部的多项胜负率评测中,相较于Midjourney V7、FLUX1.1 [pro]以及Reve等行业领先的图像模型,均保持明显优势。
张迪介绍,可图2.0文生图能力迎来全面升级。包括大幅提升指令遵循能力、显著增强电影美学表现力以及更多元的艺术风格。在风格化响应上,可图2.0可支持60多种风格化的效果转绘,模型出图创意和想象力实现大幅跃升。
同时,可图2.0也上线了实用的图像可控
AIGC技术迅猛发展,为全行业发展注入全新活力
除了C端订阅用户,可灵AI也面向B端商家提供API接入等服务。目前,可灵AI已与包括小米、亚马逊云科技、阿里云、Freepik、蓝色光标等在内的数千家国内外企业客户建立了合作关系。
盖坤披露,来自世界各地的超1.5万开发者,已将可灵的API应用于不同的行业场景中,累计生成的图像数量约1200万个,生成的素材超过4000万个。
如今,可灵正在成为AI时代创作的新基础设施。AIGC技术的迅猛发展,也正在重构包括广告营销、专业创作、影视、娱乐创意等在内的多个行业。
以二次元AI创作社区产品狸谱为例,其产品负责人一休介绍,可灵AI为狸谱带来了创新突破。其1.6版本在人物运动流畅度、镜头移动等方面展现出卓越性能,助力狸谱成功接入“动态LIVE”和“新春萌偶摇”两大功能。前者实现“图 - 影 - 音”快速创作,后者在春节期间引发60万用户转播。未来,双方将基于狸谱的优质内容数据与可灵的算法能力,打造动画模型,推动AI成为内容引擎,并共同孵化优质创
“可灵AI可全面融入剧集级创作流程”。可灵AI超级创
从剧本创作到内容发行,异类Outliers团队完成了一次完整的影像工业化创作流程,覆盖从美学表达到镜头结构,再到复杂动作场景与细节的全面呈现。“我们实践之后发现,可灵AI是一个能够稳定、大规模嵌入剧集创作流程的生成式协作大模型。”陈翔宇认为,在AI的辅助下,导演及编剧团队的大量内容创意也实现了更富有想象力的表达,“AIGC也许是下一代内容结构的雏形”。
为了进一步激发AI爱好者们的创作热情,快手副总裁、可灵AI负责人张迪还在发布会现场正式发起“可灵AI NextGen 新影像创投计划”。该计划将加大对于AIGC创
面向未来,盖坤表示,可灵AI将持续大力推动技术创新,用人与AI交互的全新语言,帮助用户实现复杂创意的精确表达,“我们的初心,是让每个人都能用AI讲出好的故事,我们也真切地希望这一天更快到来”。
消息,阿布扎比的穆巴达拉在其比特币ETF头寸上增持超过9000万美元,而阿布扎比投资委员会在...
2 麻吉黄立成:BTC多单滚仓增持至3枚消息,麻吉黄立成在HyperLiquid平台上增持BTC多单3.00枚,约合235,238.00美元,持仓规模达到1,251,...
3 美国终止俄罗斯原油销售豁免消息,霍尔木兹海峡危机未解,美国特朗普政府允许一项鼓励俄罗斯原油销售的制裁豁免到期...
4 麻吉黄立成:ETH多单增持750枚,当前盈亏消息,麻吉黄立成在HyperLiquid平台增持ETH多单750枚,约合1,645,935.00美元。目前持仓规模为7,200...
5 加密市场周六蒸发近700亿美元消息,近期加密市场在周六滑落,导致总市值减少近700亿美元,目前总市值降至2.6万亿美元。...
6 Deedy Das:AI浪潮加剧硅谷财富分化消息,Menlo Ventures合伙人Deedy Das今日发文指出,受AI浪潮影响,旧金山湾区正经历严重的财富分...
7 山寨空军车头「多币种空仓 TOP 1」:TAO空消息,山寨空军车头「多币种空仓TOP 1」的TAO空单减持1,401.72枚,约合761,486.87美元。当前持仓规...
8 伊朗已准备好管理霍尔木兹海峡机制消息,伊朗议会国家安全委员会负责人表示,伊朗已准备好一套机制,以沿指定航线管理霍尔...
9 Thorchain推出1000万美元黑客事件退款门户消息,Thorchain在确认遭遇1000万美元黑客攻击后,推出了一个恢复门户。此次攻击影响了12,847个...
10 比特币ETF结束六周资金流入,单周净流出截至5月15日的周内,比特币ETF录得10亿美元的净流出,结束了六周的资金流入。这是自1月底以...
成都来彰科技 蜀ICP备2025134723号-1
资讯来源互联网,如有版权问题请联系管理员删除。