登录

生成


分类

质量

过去两年,文生视频领域的竞争几乎围绕模型公司和AI大厂展开,从模型能力、参数规模,到生成质量、用户体验,一轮又一轮的视频模型不断刷新排行榜。
文章

新版本将搭载最新一代3DFoundationModel,并支持最高8K级贴图生成,重点提升复杂几何、人物、生物、服装、雕塑以及其他非规则曲面的生成质量。
文章

视频

物理规律(Physics):关注的是模型是否真正理解现实世界,涵盖重力因果、流体飞溅、水体折射等,无论是推入浅水的木船还是受重力翻滚跌落的玩偶,彻底摆脱了传统生成视频的「漂浮感」与「橡胶质感」;
文章

长片工业需要的,不只是一个会生成视频的大模型
文章

自由

它真正的难题不在于「能不能打上」,而在于能否精确计量:为了换取可检测的信号,模型究竟让出了多少生成自由。
文章

能力

虽然视频生成底层基于MiniMax等基础模型搭建,但其技术研发的核心,始终放在「如何组织、调度并控制底层生成能力,服务于严肃的长片叙事」,而非仅仅孤立地生成几段短视频。
文章

结果

在这套工作流里,GPT-6Astra负责理解需求、拆解任务、选择工具,并把生成结果继续送进Blender、网页或游戏引擎等下游环境;
文章

排第三,这三项指标分别从像素还原、感知差异和生成结果的整体分布差异等角度衡量效果。
文章

通过视频来看,AholoLux3D保住了鼠首的几个关键特征:正面轮廓、长鼻梁、圆眼、竖耳、短颈部,以及青铜雕塑的整体观感,同时,深褐青铜材质也比原始生成结果更接近博物馆展陈里的金属文物效果。
文章

(3)能不能进入后处理工具,不能被Blender检查、改材质、加灯光、导出,就还只是一个生成结果,不是资产。
文章

此外,如果用户对AI生成的参考图比较满意,可以直接保存AI生成结果。
文章

每组生成结果只有4张可选,如果都不喜欢,就需要重新生成、反复挑选。
文章

虽然产品在逐步记录用户偏好,如用户不满意生成结果删除时询问原因等,但目前看来暂时没有太大改进。
文章

生成

目前,OpenAI的ChatGPTImages2.5依旧是全球领先的图像生成编辑模型。
文章

谷歌AI图像模型NanoBanana2.1发布,提升视觉设计、蒙版编辑、主体一致性2026年10月07日09:01IT之家IT之家10月7日消息,谷歌于今日正式发布了NanoBanana2.1,这是该公司AI图像生成与编辑模型的升级版本。
文章

实际上,这意味着他找到了一种能够促进产物中某一种对映体生成的方法。
文章

当前大模型主要依赖人类生成的数据,尤其是文本数据。
文章

当前大模型的训练高度依赖大规模数据,尤其是人类生成的文本、图像、音频和视频。
文章

AI热潮刚刚掀起之初,他曾把大模型生成的影像类比成“预制菜”,能吃,但缺少锅气——“做电影最美妙的部分,是错误,是人类在现场的失控,无法复制的瑕疵。
文章

导演需要不断叠加限定性辞藻,输出更具体的需求,使模型生成的内容更贴合“脑海中的正确答案”,最后才能把图片做成动画。
文章

最初人们发现,在AI里打字就能得到几秒小视频,很快,阿里模型生成的视频质量不断提高,人们可以随意调整画面的色彩和光影,像导演一样“制作后期”。
文章

仔细想想,审稿中评价实验结果的部分,也在做统计报告生成:读一篇满是数字的论文,再把这些结果组织成评价。
文章

例如临床总结、报告生成和AI审稿。
文章

EMNLP2026|「AI把数字说歪」,官方AI审稿现场演示了一遍2026年10月01日09:50机器之心Pro现如今大模型生成报告越来越流行,然而幻觉问题始终影响着报告的可信度。
文章

对于开发者之外的用户而言,前端的生成效果很容易判断,在内容场景上也有大量的落地空间。
文章

千问生成的文档也可自动上传至网盘,并与团队或家人共享,让多个Agent能够围绕同一份资料协同工作。
文章

不同于Benchmark摸不着的分数或是模型架构的细节,大模型生成的网页与游戏日趋成熟,已经快成了通向AGI的里程表。
文章

想要规模化发挥多智能体价值,就需要管控每个智能体生成的假设、以及上下文来源。
文章

现在,用户可以让千问根据网盘照片生成不同主题的相册应用,也可以自动挑选合适的照片制作海报。
文章

根据马铃薯制品、谷物制品和烘焙咖啡加工过程中丙烯酰胺生成的工艺关键点,新标准对食品加工环节提出了相应的控制要求。
文章

这次新制定的《食品中丙烯酰胺污染控制规范》系统规定了食品加工各环节中控制丙烯酰胺生成的基本要求与管理措施,杜绝过度烘焙或油炸。
文章

万小智3.0生成文章、场景配图及企业视频。
文章

企业生成内容也更容易保持相对一致的品牌表达。
文章

内容生成后,还可以根据不同渠道的特点进行适配和分发。
文章

新版本增加GEO与SEO诊断优化、内容生成与多平台分发能力,并将产品从AI建站平台升级为“面向中小企业的AI建站与经营平台”。
文章

「Superpose」的生成的参考
文章

复杂主体由V2Fun生成。
文章

随后,这些复杂部件分别通过V2Fun生成。
文章

总结来说,Astra将具备以下强大的能力——前端非常强大,0样本一次生成端到端训练的多Agent编排,轻松驾驭超长周期任务;
文章

作为面向空间智能与具身智能的成果,Puffin-World首次在一个统一多模态框架中,将物理、几何和外观定义为三种原生的三维世界状态,并贯通重力场感知、自由视点空间仿真、三维世界生成与重建以及闭环探索,预测机器人行动后世界将处于什么状态。
文章

在RealEstate10K三维世界生成测试中,Puffin-World取得17.22的PSNR、0.595的SSIM和0.318的LPIPS,三项视觉一致性指标均优于对比方法。
文章

第三,三维世界生成与重建。
文章

因此Motus2采用动作优先(Action-first)的信息流,让动作只读取此前信息,未来视频读取动作,价值评估再读取动作和预测结果,以保证动作生成过程符合真实部署时的因果顺序。
文章

它用共享模型连接动作生成、后果预测和价值评估,从约13万小时人类第一视角视频中提取操作先验,再用机器人轨迹完成本体适配。
文章

此前,生数科技发布的Motus已在统一潜在动作世界模型中连接视频预测和动作生成。
文章

在相机可控生成基准Puffin-Cam-Bench上,模型生成结果的上方向、纬度和重力方向中位误差分别为0.84度、1.26度和0.79度,FID为75.93,均优于参与比较的通用图像生成模型和已有相机可控生成方法。
文章

模型生成新视角时,不仅要回答画面应该是什么样,还要保证该画面在物理方向和三维结构上成立。
文章

因此,Motus2沿用T-Rex的触觉响应思路,设置轻量触觉专家,主模型生成动作片段并缓存特征,每个短片段执行前,专家读取最新触觉,对尚未执行的动作作最后修正。
文章

到底谁的细节更稳、结构更干净、一次生成完成度更高,已经可以直接摆到台面上比了。
文章

如果后来发现这封信其实是由人工智能生成的,它的意义就会发生变化。
文章

目前所有AI生成的图像均已加注SynthID数位水印,并可被Gemini等谷歌工具识别为AI生成内容,公司也会拦截涉及有害主题的图像生成请求。
文章

据BBC周五(7月31日)报道,谷歌日前在其GoogleEarth平台推出了一项AI新功能,让用户只需点击按钮,便能利用人工智能图像生成器NanoBanana2,在真实的卫星、航拍或三维图像基础上,生成虚构场景。
文章

辅助文书起草借助大模型的生成、校对和润色能力,覆盖公文起草、格式校核、内容纠错、摘要提炼等全流程,着力破解基层写稿耗时长、表述不规范、体例不统一的问题。
文章

直播中,专家将结合元宝高考通生成的AI志愿方案进行点评与补充,让考生家庭在“AI+专家”双重视角下完成更稳妥的填报决策。
文章

更干净的一次性代码生成,更精确的“指令遵循”。
文章

代码生成与代码安全,两手都要抓,两手都要硬。
文章

模型标识为“claude-mythos-1-preview”,明确指向代码生成和安全两大应用场景。
文章

每一个生成的token(标记),都是电子移动、热量管理以及能源转化为计算力的结果。
文章

在数字世界一侧,Vidu系列持续探索对视觉世界的生成与交互。
文章

Motus2没有把动作生成、未来模拟和结果评估做成三套彼此独立的系统。
文章

在未来的研究阶段中,研究人员希望能够进一步提高训练结束后信号生成的稳定性。
文章

群核科技共有三篇论文入选,涵盖空间感知与推理、强化学习数据生成、高保真物理仿真等物理AI关键领域。
文章

这是陆川用阿里视频生成模型生成的短片,也是首次使用AIGC技术应用于影视级影像物料生产的尝试。
文章

正面

glb,并生成正面、左前45度、右前45度三张渲染预览图。
文章

模型

淘宝TaoMate-H3开源:三步生成「分钟级」音视频连续创作2026年10月02日09:30机器之心ProTaoMate-H3是由阿里巴巴TaoLiveAIGC团队研发的音视频联合流式生成模型。
文章

但从自然语言需求出发,先快速验证轮廓,再生成高质量资产,随后进入Blender检查、调材质、加底座、渲染和导出,这已经不只是“生成模型”,而是一条可调度、可验收、可继续加工的资产生产链路。
文章

因此,3DAI的竞争重心正在从“谁能生成模型”,转向“谁能把模型接进真实工具链和应用链路”。
文章

这个结果回答了一个关键问题:当3D生成模型接入Agent和专业软件后,能不能把一段自然语言需求推进到可交付资产?
文章

这也是GPT-6Astra+AholoLux3D与单一3D生成工具的区别,只从三张照片生成一个鼠首模型,单个生成模型也能完成一部分任务;
文章

这次测试不是一次“图片变模型”的炫技,而是一次3D资产生产链路的摸底考试,给出一个清楚的结论:AholoLux3D这类3D生成模型已经能进入真实工具。
文章

例如,不少主流视频生成模型可以参考真人视频做多模态联合建模,提取其中的动作时序、神态特征以及肢体参数等,将其整合、适配、迁移到目标虚拟角色的骨骼绑定及面部拓扑结构上,从而达到虚拟角色完全复刻真人表演的效果。
文章

此前很多生成模型可以把单个物体画得很好,但面对完整的平面设计任务时,容易出现信息层级混乱、文字位置失控,或者整体看起来「元素很多,却不像设计稿」的问题。
文章

生成模型会画图,和它能完成设计工作,仍然是两回事。
文章

生成模型越能控制修改范围,越接近传统Photoshop等编辑软件所提供的确定性。
文章

技术

成龙电影《十二生肖》里,有一段3D生成技术的片段,龙叔靠近圆明园十二生肖鼠首,用特制扫描手套获取文物的三维信息,再把数据加密传输到另一端,借助3D打印做出高仿鼠首。
文章

2024年是视频生成技术迭代跃升之年。
文章

上溯AI影视生成技术的发展脉络:2022年是图像生成与大语言模型元年,AI首次具备高质量图像生成与自然语言交互能力,为影视创作提供了视觉素材与文本侧的基础能力。
文章

当被问及对AI内容生成技术未来有何展望时,她左手平摊向上,右手食指垂直抵于左手掌沿,仿佛平地竖起一根旗杆。
文章

视频生成技术迅速进步,AI人物越来越“像真人”。
文章

式AI

他是2012年以来首位获此奖项的华人统计学家,评奖委员会列举的贡献中,第一项就是生成式AI的统计基础。
文章

《人工智能法》(EUAIAct)第50条自2026年8月2日起适用,要求生成式AI提供方以机器可读的方式标记输出内容。
文章

工具

声音

TaoMate-H3面向需要持续生成声音与画面的创作场景。
文章

基因组

上述研究团队以ΦX174噬菌体作为设计模板,建立了一套用于生成和评估数千个AI生成基因组的框架,其中近300个基因组被化学合成并在实验室条件下进行了测试,最终获得了16种可存活的噬菌体。
文章

参考图

而第一步就不容易,AI生成的参考图,未必就是用户“脑海中的照片”,比如同样站在街边,有人想要自然随意的抓拍,有人想拍完整穿搭,也有人希望照片更有氛围感;
文章

内容

据悉,9月20日在腾讯视频上线的真人出演AI精品剧《行镖》,采用真人实拍与AI生成相结合的制作方式,其中分镜生成、实拍素材与生成内容的融合、多版本镜头迭代等环节均在WorkRally上完成。
文章

元素

模型开始更稳定地处理一整张视觉作品的结构,而非单独优化某一个生成元素。
文章

代码

《辐射:纽约》易于访问这一点同样值得重视,任何人都可以直接在浏览器当中运行这款由Claude生成代码的辐射衍生游戏。
文章

据IT之家了解,《辐射:纽约》是一款完全依靠ClaudeOpus5.5生成代码制作的浏览器游戏。
文章

这是最可怕的一点,Astra可能在生成代码的同时,在内部沙盒中完成了“虚拟渲染”或AST语法树的逻辑跑通。
文章

之外

如果这条路径跑通,Suno拿到的会是音乐生成之外的一块新地盘;
文章

专业

例如在PPT上,百度文库支持专业、创意等多种模式的PPT创作类型,专业模式支持生成专业排版、模块丰富、带有柱状图、饼状图、热力图等结构化图表的大师级PPT,创意模式则在品牌宣贯、历史文化、卡通故事等多类型上,能呈现精准适配其场景的高级视觉,图文并茂、创意丰富、是PPT的「颜值天花板」。
文章

一个

从这一视角来看,世界模型的发展尤其值得关注——它已开始从“生成视频”走向“生成一个可以持续存在、可以进入和改变的世界”。
文章

4张

用户找到想拍照的场景后,可以连人带景先拍一张,AI会结合人物、服装和周围环境,在10秒内生成4张不同姿势的参考图。
文章

用户每天拥有5次生成机会,每次可生成4张参考照片。
文章