AIGC技术的学习 系列一

news2024/10/19 13:24:26

文章目录

  • 前言
  • 一、AIGC技术演进
    • 1.1 图像视频生成
    • 1.2. 文本生成
    • 1.3. 多模态生成
    • 1.4. 小结
  • 二、CAD&CAE软件介绍
    • 2.1. CAD软件
    • 2.2. CAE软件
    • 2.3. 小结
  • 三、AIGC技术与CAD&CAE软件的集成案例
    • 3.1. 土建设计领域
    • 3.2. 机械设计领域
  • 四、结语
  • 五、参考文献
  • 总结


前言

在全球智能制造的大潮中,我们见证了技术的飞速发展与产业的深刻变革。然而,即便在这样的背景下,工业设计的道路上仍布满了堵点和痛点,它们如同顽石般阻碍着创新的脚步。随着人工智能生成内容(AIGC)技术的兴起与扩散,我们仿佛站在了一个新的起点。AIGC以其卓越的内容生成能力,正在逐步改变我们对创作过程的理解。它不仅能够辅助设计师快速产出多样化的设计方案,还能够在虚拟现实、增强现实等领域开辟新的应用场景,极大地丰富了设计的表达手法和交互体验。


一、AIGC技术演进

示例:pandas 是基于NumPy 的一种工具,该工具是为了解决数据分析任务而创建的。

1.1 图像视频生成

在图像视频生成方面,生成技术逐渐从变分自编码器(VAEs)、流模型(Flow-based Models)、生成对抗网络(GANs)发展到扩散模型(Diffusions),其中GANs和Diffusions技术极大程度地推动了AIGC的发展,两种模型架构各有自己的特点,共同在图像、音频、视频、3D数据的生成领域发挥重要作用。
图像视频生成关键时间点展示图

  • 生成对抗网络(GANs)

    • 生成对抗网络(Generative Adversarial Networks,简称GAN)是由Ian Goodfellow在2014年提出的一种深度学习模型。GAN的核心思想是通过生成器(Generator)和判别器(Discriminator)之间的对抗训练,使得生成器能够生成逼真的数据样本。生成器的任务是从随机噪声中生成尽可能真实的数据样本,而判别器的任务则是区分输入数据是来自真实数据集还是生成器产生的。这两个网络在模型训练过程中相互竞争,共同进化,从而生成高质量的数据样本。
    • GAN的提出是AIGC技术发展的重要里程碑,GAN在图像生成、风格转换、数据增强、图像超分辨率重建、图像修复等领域均有广泛应用,但其训练过程的稳定性、模式崩溃问题、生成结果的多样性等缺点制约其进一步发展。为了解决GAN训练过程中出现的稳定性问题,研究者们提出了多种改进方法,如条件CGAN、PGGAN、CycleGAN、GigaGAN等,旨在提高生成样本的质量和多样性。
      请添加图片描述
  • 扩散模型(Diffusions)

    • 扩散模型(Diffusion)思想最早由Jascha Sohl-Dickstein于2015年在Deep Unsupervised Learning using Nonequilibrium Thermodynamics中提出,2020年Jonathan Ho提出DDPM将该思想融合进生成式深度学习模型,在此基础上,2021年Robin Rombach提出了Latent Diffusion,从此扩散模型得到了快速发展。扩散模型包含两个主要过程:前向扩散过程和逆向去噪过程。前向过程是逐步向数据中添加噪声的过程,直到最终得到纯高斯噪声。逆向过程则是从最终的噪声逐步恢复原图的过程,使用的是共享参数的U-Net结构。
    • 与生成对抗网络(GANs)相比,扩散模型在生成质量和训练稳定性上有明显优势。GANs在训练过程中存在不稳定性和模式崩溃的问题,这是由于GANs本质是minmax问题的求解,存在鞍点问题; Difffusions本质是标准的凸交叉熵损失最小化问题。扩散模型通过学习数据扩散和逆向去噪的过程,避免了这些问题,并能够生成更多样的样本。虽然在图像合成方面,扩散模型已经超越了GANs,成为了新的SOTA,但其自身存在条件控制和计算效率等问题。为了解决这些问题,研究者在此基础上提出了很多改进方法,如Controlnet、LayerDiffusion、MultiDiffusion、DIT等。

请添加图片描述

1.2. 文本生成

大型语言模型 (LLM) 主要是指参数量级在十亿级别以上的基于Transformer的与预训练语言模型(PLM

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/2217422.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

FreeRTOS - 信号量

在学习FreeRTOS过程中,结合韦东山-FreeRTOS手册和视频、野火-FreeRTOS内核实现与应用开发、及网上查找的其他资源,整理了该篇文章。如有内容理解不正确之处,欢迎大家指出,共同进步。 队列用于传输数据:在任务之间、任务…

冻干咖啡市场洞察:销售额占比背后的消费密码

冻干咖啡销售额前十占比分析 一、概述 本报告基于从淘宝商品搜索接口和淘宝精确月销量接口中提取的数据,分析了前十个品牌在销售额上的占比情况。分析涵盖了销售额和占比的数据,为决策提供了依据。(数据获取时间:2024.09.20&…

音乐播放器项目专栏介绍​

1.简介 本专栏使用Qt QWidget作为显示界面,你将会学习到以下内容: 1.大量ui美化的实例。 2.各种复杂ui布局。 3.常见显示效果实现。 4.大量QSS实例。 5.Qt音频播放,音乐歌词文件加载,展示。 6.播放器界面换肤。 相信学习了本专栏…

C++【内存管理】(超详细讲解C++内存管理以及new与delete的使用和原理)

文章目录 1.C/C内存分布2.C语言中动态内存管理方式3.C内存管理方式3.1 new/delete操作内置类型3. 2new/delete操作自定义类型 4. operator new与operator delete函数(重点)5. new和delete的实现原理5.1 内置类型5.2 自定义类型5.2.1 自定义类型调用new[]…

【机器学习】特征降维|低方差过滤|主成分分析PCA|相关系数法|皮尔逊相关系数|斯皮尔曼相关系数

特征降维 特征降维 为什么要进行特征降维? 特征对训练模型非常重要,当用于训练的数据集包涵一些不重要的特征时,可能会导致模型泛化性能不加 eg:某些特征的取值较为接近,其包含的信息较少eg:希望特征独立存在对预测产生影响,两…

Unity使用TriangleNet参考

TriangleNet下载如下: TriangleNet 效果如下: 代码参考如下: using System.Collections.Generic; using UnityEngine; using TriangleNet.Geometry;public class TestTriangleNet : MonoBehaviour {[SerializeField]Material material;voi…

2024下半年,国内大模型六小虎最新发展情况怎么样了?

最近大模型圈有点冷,ChatGPT访问量下降,英伟达的股价都跟着跌,更是有人开始唱衰大模型。这感觉就像经历了一场盛夏酷暑后的骤然降温,资本市场也开始理性回归。但与此同时,国内的"六小虎"却展现出另一番景象——热火朝天!这真是冰火两重天啊! 在这看似矛盾的局…

CNStream流处理多路并发Pipeline框架相关问题整理:Pipeline整体流程、数据传输、多路并发

目录 1 CNStream之前博客汇总 1.1 Pipeline中的EventBus 1.2 Pipeline中的内存池 1.3 Pipeline中的视频解码流程分析 1.4 Pipeline中的视频编码流程分析 1.5 Pipeline中的反射机制 1.6 Pipeline中的单例模式代码 1.7 怎么将CNStream适配到NVIDIA Jetson Orin 2 构建Pi…

EI收录检索报告是什么样的?怎么出具?一文了解!

一、EI检索报告是什么 EI(Engineering Village)数据库是全球最全面的工程检索二次文献数据库,它收录了7,000,000多篇论文的参考文献和摘要。这些论文出自5,000多种工程类期刊、会议论文集和技术报告。EI收录的文献涵盖了所有的工程领域,其中大约22%为会…

聊聊零基础如何开始学习鸿蒙开发技术

鸿蒙系统是一款分布式操作系统,其适用范围非常广泛,从智能手机到家用电器,再到工业设备,都能找到应用场景。特别是在智能家居领域,鸿蒙系统可以实现不同设备之间的无缝连接和协同工作,提供更加智能和便利的…

建筑工程管理软件推荐,2024年最佳选择

建筑工程管理软件助力项目全周期管理,包括规划、监控、资源成本控制等。类型多样,选购需考虑需求匹配、便捷性、集成能力、灵活性和安全性。软件优化流程、提高效率、监控进展、优化资源配置、提升协作水平。 一、建筑工程管理软件到底是什么&#xff1f…

浮点数二进制制科学计数法理解

Owed by: 春夜喜雨 http://blog.csdn.net/chunyexiyu 1. 引言 对于浮点数,主要是单精度-float、双精度-double两种类型。 对于浮点类型,我们知道其采用科学计数法,准确来说应该是二进制科学计数法。 为什么准确说是是二进制科学计数法&…

机器学习笔记20241017

文章目录 torchvisiondataloadernn.module卷积非线性激活模型选择训练误差泛化误差 正则化权重衰退的基本概念数学表示权重衰退的效果物理解释 数值稳定性(Gradient Vanishing)梯度消失原因解决方法 梯度爆炸(Gradient Explosion)…

linux anconda下基础环境配置(torch、opencv等)

1、torch安装(GPU) 下载链接:https://pytorch.org/ 根据配置下载对应版本,CUDA11.4 可用11.3下的安装包 conda install pytorch1.12.0 torchvision0.13.0 torchaudio0.12.0 cudatoolkit11.3 -c pytorch错误解决: 安…

好用的python相关的AI工具Bito介绍

插件名称:Bito 好用的python相关的AI工具Bito介绍 step 1:点插件step 2:搜索bito并安装step3 :需要登录,要有真实邮箱,按步骤走就行,完后就可以使用 step 1:点插件 step 2:搜索bito并安装 step3…

基于PHP考研互助系统【附源码】

基于PHP考研互助系统 效果如下: 系统首页界面 用户注册界面 考研论坛页面 每日打卡页面 管理员登录主页面 管理员主界面 用户管理界面 备考经验界面 研究背景 近些年,随着中国经济发展,人民的生活质量逐渐提高,对网络的依赖性越…

Q2=10 and Q2=1--PLB(Fig.4)

(个人学习笔记,仅供参考) import numpy as np from scipy.special import kv, erfc from scipy.integrate import dblquad import matplotlib.pyplot as plt import scipy.integrate as spi# Constants w 0.6198 g0_sq 21.5989 rho 0.782…

【UML】一个UML学习的还不错的几个帖子

https://segmentfault.com/a/1190000042775634 寂然解读设计模式 - UML类图&类的六大关系-阿里云开发者社区

【工具变量】上市公司企业广告支出数据(2007-2023年)

一、测算方式:具体而言,参照 Lu 等(2022)的研究,本文通过上市公司财务报表附注获取每家上市公司每年销售费用明细项目,筛选出广告费、广告宣传费、广告推广费、广告策划费、广告展览费等与广告支出相关的项…

CodeActAgent :Executable Code Actions Elicit Better LLM Agents解读

论文地址 https://arxiv.org/pdf/2402.01030.pdf 项目地址 https://github.com/svjack/CodeActAgent-Gradio/blob/main/README.md 代码智能体的优势 选择代码智能体有以下几个关键原因,它们相较于使用类似JSON的字典输出具有显著优势: 1. 代码的高…