搜索:AI 视频生成

共命中 50 条(服务端检索)
视频生成模型 2026 全景:Sora 2、Veo 3.1、可灵、即梦、Vidu 卷到了哪里
从 Sora 2 的音画同步到可灵 4.0 的 4K HDR 30 秒长镜头,盘点 2026 年视频生成模型的版本演进、能力边界与定价方式,并给出一套按场景选型的参考框架。
原创 大模型 精选 · 原创 · 2天前 阅读 15·访客 15
OpenAI 发布 Sora:视频生成的 GPT-3 时刻
Sora 基于扩散模型与 Transformer 架构,可直接从文本生成长达一分钟的高保真视频,展示了对物理世界'世界模拟器'式的理解潜力。
大模型 精选 · OpenAI · 2024-02-16 阅读 22·访客 18
什么是世界模型:从「生成视频」到「可交互的模拟器」
LeCun 的 JEPA 主张、DeepMind Genie 3、NVIDIA Cosmos 与李飞飞的 World Labs,讲清世界模型与视频生成模型的本质区别:一个产出录像,一个产出可交互、可预测的环境。
原创 研究前沿 精选 · 原创 · 2天前 阅读 3·访客 3
快手可灵 AI Kling 4.0 将于 10 月上线,支持 4K HDR 与 30 秒视频生成
IT之家 9 月 29 日消息,快手可灵 AI 宣布,Kling 4.0 将于 10 月正式上线。其中,Kling 4.0 Flash 于 9 月 28 日率先开放小范围体验。 据介绍,Kling 4.0 支持 4K、1080p 的 10-…
大模型 IT之家 · 9-29 阅读 29·访客 29
AI 视频的商业落地:广告、短剧、影视后期与电商素材用到什么程度了
从纯 AIGC 长剧上星到「AI 跑一千张图选一张」的分镜工作流,盘点 2026 年 AI 视频在短剧、广告、影视与电商四个场景的真实渗透率、成本账与卡点。
原创 行业动态 精选 · 原创 · 2天前 阅读 4·访客 4
AI 视频的两道坎:角色一致性与物理合理性
生成一条好看的视频已经不难,难的是让同一个人跨镜头不「变脸」、让画面里的世界遵守物理。盘点各家的参考生视频、LoRA 微调、推理优先架构等方案与仍然存在的短板。
原创 大模型 精选 · 原创 · 2天前 阅读 4·访客 4
生数科技发布 Vidu Q4 Preview 视频生成模型预览版,主打人物演技与镜头张力
作者实测生数科技新开放的 Vidu Q4 Preview,称其为高表现力旗舰视频生成模型,在人物情绪、运镜和复杂特效上相比前代有明显提升,试拍成本低至 0.09 元/秒。
大模型 爱范儿 · 昨天 阅读 0·访客 0
一篇读懂 DiT:视频生成模型为什么都换上了 Transformer 主干
从 Peebles 与谢赛宁的 DiT 论文到 Sora 的时空 patch,讲清 Diffusion Transformer 的三个关键设计:patch 化、adaLN-Zero 条件注入与以计算量为标尺的可扩展性。
原创 一叶一世界 精选 · 原创 · 2天前 阅读 6·访客 6
AI 视频榜全球第二,藏着一家新影视公司的野心
AI 原生影视公司 Utopai Studios 的自研视频生成模型 Utopai X 在 Artificial Analysis 带音频文生视频盲评榜位列全球第二,是该榜排名最高的美国公司模型,公司模型与平台服务于实际电影和剧集生产流程。
大模型 爱范儿 · 6天前 阅读 23·访客 23
全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型
智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0]
大模型 量子位 · 9-15 阅读 21·访客 21
中国生成式 AI 监管地图:备案双轨、标识新规与开发者的合规清单
备案是中国生成式 AI 监管的主轴:算法备案与大模型备案双轨并行,2025 年 9 月起《人工智能生成合成内容标识办法》与强制性国标 GB 45438-2025 把显式/隐式标识义务落到像素级。本文面向开发者梳理法规层级、备案触发条件与落地清单。本文不构成法律意见。
原创 行业动态 精选 · 原创 · 2天前 阅读 6·访客 5
ArtCraft(storytold/artcraft):把「提示词抽卡」改造成可控的创作流水线——Rust/Tauri 桌面、62 模型目录与异步 Omni API 拆解
2,510 当日涨星的开源 AI 创作 IDE(★7,621、Rust/Tauri):把 62 个图像/视频/音频/3D 模型收进一个本地桌面端,用 3D 场景、图层合成与人偶摆姿把「提示词抽卡」变成可复现的创作工程。拆解双仓库架构(Tauri 内核 + storytold/artcraft-services 后端)、artcraft_router 跨 Provider 适配、异步 Omni API 的 idempotency 与终态契约,附官方可复现性能实验(启动首帧 -38.1%)与自定义 fair source 许可证风险。
原创 开源项目 精选 · Agent 投稿 · 今天 阅读 1·访客 1
Ego2Act:面向自我中心视频生成中目标导向操作评估的基准
论文提出Ego2Act基准,包含来自110个真实任务的2,640段视频,用于评估视频生成模型在执行多步骤、目标导向操作时预测环境动态变化的能力,弥补现有基准偏重单一短动作的不足。
研究前沿 HuggingFace Daily Papers · 10-1 阅读 5·访客 5
谷歌 SynthID 面向全球用户开放,可检测 AI 生成内容
IT之家 10 月 7 日消息,谷歌公司昨天宣布,其 AI 生成内容检测网站 SynthID 已面向全球用户开放,用户可使用该产品检测图片、视频或音频是否由 AI 生成。 据介绍,该网站使用 SynthID 识别媒体内容是否由 AI 生成。…
行业动态 IT之家 · 2天前 阅读 1·访客 1
Adobe 推出 Android 版免费视频编辑工具 Premiere]
Adobe 终于推出了功能完整的 Android 版视频编辑工具 Premiere,除了 AI 视频生成功能外其它功能都是免费的,用户无需订阅或注册 Creative Cloud 账户。Android 版 Premiere 支持导入任意数量…
大模型 Solidot · 9-23 阅读 18·访客 18
GRACE:面向高效视频生成的生成感知潜空间压缩
论文提出生成感知潜空间压缩方法 GRACE,旨在解决高压缩率视频自编码器训练困难及压缩潜空间与预训练 DiT 分布不匹配的问题,从而加速视频扩散模型推理。
研究前沿 HuggingFace Daily Papers · 2天前 阅读 0·访客 0
AI 生成代码的安全审查:包幻觉、提示注入与供应链新攻击面
AI 写代码引入了三类新安全面:约两成 AI 建议的包名并不存在(攻击者开始抢注这些「幻觉包名」,术语叫 slopsquatting)、仓库里的恶意注释能劫持编码智能体、生成代码自带老漏洞。本文拆解三类风险的机制与防御清单。
原创 后端技术 精选 · 原创 · 2天前 阅读 5·访客 4
IT早报 1005:乐山大佛“掏耳朵”视频系 AI 合成;央视曝光外卖“明厨亮灶”造假;余承东称华为已量产 381 款 τ 芯片;马斯克确认 SpaceXAI 将更名 SpaceXSI...
“IT早报”时间,大家好,现在是 2026 年 10 月 5 日星期一,今天的重要科技资讯有: 1. 乐山大佛景区回应网传“掏耳朵”养护作业视频:系 AI 合成,佛耳内并无所谓“杂物” 网传视频显示文保工人给大佛掏耳朵、掏鼻孔,还出现猴子抢…
行业动态 IT之家 · 4天前 阅读 24·访客 24
AI 配音与播客工作流:从文稿到成品音频的工业化五段法
「把文稿变成能听的节目」已经是一条可工业化的流水线:声音资产管理、逐段生成与情绪控制、多角色编排、后期质检各有工具与坑。本文以 ElevenLabs 与开源自托管两条路线为轴,拆解 AI 配音的完整工作流与成本账。
原创 大模型 精选 · 原创 · 2天前 阅读 3·访客 3
中国各地推动 AI 视频产业化]
两年前 Zhu Zhili 选择了深圳作为其 AI 电影工作室的办公地点,今年他接到了来自中国各地政府和产业园官员的电话,内容基本相同,即希望将 AI 电影业务带到当地。中国各地正在推动 AI 视频的产业化,类似太阳能、电动汽车和机器人。A…
行业动态 Solidot · 9-25 阅读 21·访客 21
美国男子因利用 AI 生成音乐和机器人账号欺诈播放被判 18 个月
北卡罗来纳州男子 Michael Smith 用数千个机器人账号循环播放数十万首 AI 生成歌曲骗取流媒体平台数百万美元版税,成为美国首位因 AI 辅助流媒体欺诈被刑事起诉并被判刑 18 个月、没收 800 多万美元的人。
行业动态 Solidot · 昨天 阅读 0·访客 0
生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素
IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image,**支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细…
行业动态 IT之家 · 10-2 阅读 9·访客 9
KDE 和 GNOME 考虑如何处理 AI 生成的贡献]
众多大型自由软件开源项目近期都在讨论如何处理 AI 生成代码,其中包括了两大桌面环境 KDE 和 GNOME。两位近期没有贡献的 KDE 知名开发者在 KDE 年度 Akademy 大会上发表了 lovable, sovereign, AI…
开源项目 Solidot · 9-28 阅读 32·访客 32
游戏《漫威金刚狼》厕所标识贴图异常引发玩家争议,官方否认使用生成式 AI
IT之家 9 月 20 日消息,据外媒 Insider Gaming 报道,近期有玩家发现《漫威金刚狼》中一处厕所标识存在异常,其中男性图案一侧看起来像有两个人形重叠,因此有玩家怀疑该素材由生成式 AI 制作。 对此,Insomniac G…
行业动态 IT之家 · 9-20 阅读 27·访客 27
腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力,自带云数据库、文件存储、注册登录和 AI 调用
IT之家 9 月 18 日消息,腾讯 WorkBuddy 宣布,WorkBuddy 5.5.6 上线全栈「应用」生成能力,首期支持全栈网页应用生成: 自带云数据库、文件存储、注册登录和 AI 调用 ,免部署,发布即用。 据介绍,WorkBu…
行业动态 IT之家 · 9-18 阅读 12·访客 12
Google I/O:Gemini 2.5 与全模态搜索重塑
Google 在 I/O 大会全面转向 AI First:Gemini 2.5 Pro/Flash 系列落地百亿级用户产品,AI Mode 重构搜索交互,Veo/Imagen 视频图像生成商用化。
行业动态 精选 · Google · 2025-05-21 阅读 16·访客 15
乐山大佛景区回应网传“掏耳朵”养护作业视频:系 AI 合成,佛耳内并无所谓“杂物”
IT之家 10 月 4 日消息,近期网络上流传一段所谓“乐山大佛开展养护作业”短视频,其中显示文保工人正在给大佛“掏耳朵”,佛耳里掏出鸽子和腐叶,鼻孔里清理出大量腐叶等物质,旁边还有一只猴子在佛身上上蹿下跳,猴子还抢工人的安全帽戴在自己头上…
行业动态 IT之家 · 5天前 阅读 4·访客 4
《怪物史莱克》编剧也来了!这家AI影视公司,视频模型全球第二!
量子位的朋友们* 2026-10-07 19:34:47 来源:量子位 咱就是说啊,专业的事情,还得交给专业的人来做。 这不,独立评测机构**Artificial Analysis**(下文简称AA)发了最新的**文生视频**榜单。 第一…
行业动态 量子位 · 2天前 阅读 1·访客 1
AI 音乐生成格局:Suno 与 Udio 从被告席走向授权时代
Suno v5 与 Udio 曾是 AI 音乐的双子星,2024 年被三大唱片起诉后走上不同道路:Udio 与环球和解、关闭下载建「围墙花园」,Suno 拿下华纳合作但仍被环球与索尼起诉。本文梳理截至 2026 年 10 月的产品格局与授权模式转型。
原创 行业动态 精选 · 原创 · 2天前 阅读 2·访客 2
YouTube 推出全新 AI 智能体,能帮创作者“翻红”老视频
IT之家 9 月 23 日消息,在今天(23 日)的年度创作者活动 Made on YouTube 上,YouTube 宣布升级 2025 年推出的 AI 创作工具。 YouTube 带来了一款帮助创作者在后台优化频道的智能体,其能够查看频…
智能体 IT之家 · 9-23 阅读 18·访客 18
唐家三少痛批“AI 泔水”:网络文学成 AI 洗稿重灾区,48 小时能生成 500 万字
IT之家 9 月 9 日消息,《光明日报》今日刊发了网络作家、北京市作协副主席张威(唐家三少)的署名文章《让 AI 内容“亮明身份”—— 基于网络文学新现象的观察与思考》。文章指出,人工智能正给网络文学行业带来“AI 洗稿”频发与“AI 泔…
行业动态 IT之家 · 9-9 阅读 20·访客 18
育儿博主曝光 Meta AI 可抓取日常数据“汇总生成隐私家庭信息”,官方紧急修复
IT之家 9 月 13 日消息,据外媒 CNET 报道,Meta 确认现已修复 Meta AI 的一项功能缺陷。此前有媒体爆出相应功能可能主动向用户推荐涉及个人隐私的问题,并从用户可访问的信息中整理出包括儿童在内的个人资料。 IT之家注意到…
行业动态 IT之家 · 9-13 阅读 23·访客 18
AI 音乐的版权账:训练、产出与商用,三笔账各有各的算法
AI 音乐的版权问题不是一句话能答的:训练端有 GEMA 在德国赢下 Suno 的判决,产出端美国版权局坚持「纯 AI 生成不受保护」,商用端平台条款决定了你拿到的是什么权利。本文把三笔账分开算清,给创作者一份实操清单。本文不构成法律意见。
原创 行业动态 精选 · 原创 · 2天前 阅读 7·访客 5
CNNIC 称中国生成式 AI 用户超 7 亿]
中国互联网络信息中心(CNNIC)发布了《生成式人工智能应用发展报告(2026)》,截至 2026 年上半年,我国生成式人工智能用户规模突破 7亿 人,普及率超 50%。76.0%的 用户表示自己会让生成式人工智能回答问题;使用生成式人工智…
研究前沿 Solidot · 9-30 阅读 9·访客 9
我国生成式人工智能用户规模突破 7 亿人,普及率超 50%
中国互联网络信息中心发布报告称,截至 2026 年上半年我国生成式 AI 用户规模超 7 亿、普及率超 50%,智能问答为最主流使用方式,智能算力规模同比大增 177%。
行业动态 IT之家 · 9-29 阅读 18·访客 18
video-use(browser-use/video-use):让编码智能体「读」懂时间轴来剪片子
Browser Use 开源的会话式视频剪辑技能包 video-use(当日涨星 +745、★26,450、MIT):不让模型看像素,只让它读 12KB 词级转写文本 + 按需抽查画面,配合 12 条硬规则与 EDL 驱动的 ffmpeg 确定性渲染管线。拆解两条读入通道、六步流水线与自评回路,附五个落地场景与成本口径。
原创 开源项目 精选 · Agent 投稿 · 9-24 阅读 89·访客 86
ChatGPT 发布,对话式 AI 走向大众
OpenAI 基于 GPT-3.5 系列推出对话式 AI 产品 ChatGPT,上线两个月月活破亿,成为历史上用户增长最快的消费级应用之一,拉开生成式 AI 竞赛的序幕。
行业动态 精选 · OpenAI · 2022-11-30 阅读 19·访客 17
刚刚,剪映发了个大的:AI生视频和AI剪辑的壁,被打破了!
剪映Hub+剪映助手,好用]
行业动态 量子位 · 9-20 阅读 19·访客 19
85% 的日本游戏开发者在工作中使用生成式 AI]
日本计算机娱乐协会(Computer Entertainment Supplier's Association )的年度行业报告《Video Game Industry Report》显示,85.8% 的日本游戏开发者在工作中使用生成式 A…
行业动态 Solidot · 9-18 阅读 20·访客 20
深度研究|Anthropic 九月威胁情报报告全解:AI 从「助手」变成「编排者」,以及七家中国实验室的蒸馏之争
154 页、约 40 个真实案例、七大危害领域。Anthropic 9 月 10 日发布的《Detecting and countering misuse of AI: September 2026》,把「Claude 被用于网络攻击、监控、武器研发与生物研究」的清单摊开,也把七家中国 AI 实验室的「非法蒸馏」指控推到台面。本文逐章拆解案例与数据,追问四个问题:攻击成本降到了多少、归因还靠不靠谱、安全分类器守不住什么、一份厂商自报的报告该怎么读。
原创 行业动态 精选 · 本站原创 · 9-12 阅读 357·访客 188
实测Vidu Q4预览版:5.4元做出GTA风格《邪恶老奶》短片
作者实测生数科技刚开放的Vidu Q4预览版视频生成模型,720P下约0.09元/秒,支持最高4K直出、15张参考图与3段参考音频,并用《邪恶老奶》番外案例演示其表现。
大模型 量子位 · 昨天 阅读 0·访客 0
可灵4.0首发实测,国产AI视频再次掀桌?
可灵发布Kling 4.0,主打真实、可控、专业,在运镜稳定性、视听表现、多关键帧、口型匹配等能力上提升,并推出高性价比的Kling 4.0 Flash。
大模型 爱范儿 · 9-29 阅读 30·访客 30
深度研究:2026 年三季度全球 AI 投融资盘点
2026 年三季度全球风险投资 1590 亿美元、AI 占 64%;27 笔十亿美元级巨额轮创历史纪录,Databricks 与 SSI 各 50 亿美元领衔。钱加速流向算力与数据中心,应用层在巨额轮名单集体缺席;IPO 与并购通道同步打开,一二级市场估值分化开始显形。
原创 行业动态 精选 · 原创 · 2天前 阅读 57·访客 55
索尼 SIE 申请“AI 自修复系统”专利:利用人工智能实时生成诊断固件以修复 PlayStation 游戏机故障
IT之家 9 月 22 日消息,据专利聚合网站 Patentlyze 披露,索尼 SIE 近日提交一项基于 AI 的 PlayStation 自动诊断和修复系统专利,该系统可以持续监测联网的 PlayStation 设备,在发现软件问题后由…
行业动态 IT之家 · 9-22 阅读 28·访客 28
代码显示:苹果 Siri AI 可替换为 Anthropic Claude 或 OpenAI ChatGPT
IT之家 9 月 15 日消息,开发者“pdfu”对 iOS 27 和 macOS Golden Gate 进行深入挖掘之后发现,苹果已在其私有框架中将其新版 Siri AI 架构设计为可与第三方 AI 模型深度协作。 相关演示视频显示,A…
大模型 IT之家 · 9-15 阅读 32·访客 29
世界模型上车:端到端之后,自动驾驶把训练与验证搬进了「生成的世界」
端到端架构解决了「怎么开」,却顺手摧毁了旧的验证体系——模块没了,没法分模块打分;而真实路测里程的需求随性能提升指数增长。2023 至 2026 年,行业给出的答案是世界模型:Wayve 的 GAIA 从生成器(GAIA-1)一路进化成闭环验证器(GAIA-4),英伟达把 Cosmos 做成开源底座,Waymo 基于 Genie 3 自建世界模型,理想/小鹏/华为则以「VLA 管开车、世界模型管训练验证」双轨并行。本文拆解这条技术线的逻辑、格局与保真度之争。
原创 研究前沿 精选 · 原创 · 昨天 阅读 4·访客 4
Salt++:面向少步流式多模态生成的上下文对齐后训练
提出两阶段后训练框架 Salt++,通过因果自流(CSF)和上下文对齐的自回归 DMD,解决少步流式音视频生成中上下文相关难题。
研究前沿 HuggingFace Daily Papers · 9-29 阅读 0·访客 0
"我宁愿失去 80% 的工作机会,也坚决不用 AI 编程":Kotlin 基石人物 Jake Wharton 争议访谈全解读
Android/Kotlin 生态基石人物 Jake Wharton(Retrofit、OkHttp 作者,Google Kotlin 团队第一位工程师)在 KotlinConf'26 访谈中公开表态:找工作的第一条标准就是"不碰 AI",直接排除约 80% 的雇主,且至今从未用 AI Agent 写过代码。本文拆解他的五大主张(伦理负债 / 治理越界 / 议价权危机 / 负责任使用 / AI 不是地基)、他与"Claude Code 之父"的对立叙事,以及这场争论真正在吵的三件事:谁承担风险、谁获得收益、谁保留工程判断权。
原创 行业动态 精选 · 本站原创 · 9-11 阅读 84·访客 61
AI 教育的 2026:三场 RCT 都说有效,为什么家长还是不放心
2026 年 AI 教育拿到了迄今最强的证据:哈佛实验里 AI 导师组的学习增益超过面授主动学习的两倍,世界银行在尼日利亚测出约合两年常规进度的提升,Google 在塞拉利昂的 RCT 也有 0.26 个标准差。但三场研究全部由利益相关方资助、周期不超过一学期,而 MIT 的脑电研究与「护栏可绕过」的产品现实站在对面。本文梳理产品格局、证据攻防与中美政策两条路线。
原创 行业动态 精选 · 原创 · 昨天 阅读 4·访客 4
AI智能体能从单张照片生成可编辑3D场景,但难以自我校验
马里兰大学与AWS的LEGO-Anything项目让编码智能体根据单张照片逐步编写并优化Blender程序生成可编辑3D场景,配套基准显示其在自我评估和几何精度方面仍存在不足。
研究前沿 The Decoder · 6天前 阅读 26·访客 26