当前位置: 首页 > news >正文

新王炸:文生视频Sora模型发布,能否引爆AI芯片热潮

前言

前方高能预警,Sora来袭!

浅析Sora的技术亮点

语言模型中构建关键词联系

视频素材分解为时空碎片

扩散模型DiT

Not for play, But change world!

OpenAI的宏大目标

未来已来,只是尚未流行

Sora的成本与OpenAI的7万亿美金豪赌

算力,未来在何方?

最后

参考文献


前言

在人工智能的历史长河中,每一次技术的飞跃都伴随着社会生产力的巨大变革。自2015年以来,深度学习技术的突破性进展,尤其是在自然语言处理、图像识别和机器学习等领域的成功应用,已经彻底改变了我们对机器智能的认识和期待。这些技术的进步不仅仅是理论上的突破,更是实际应用的革命,它们正在逐步渗透到我们生活的方方面面,从自动驾驶到智能家居,从数据分析到内容创作。在这样的背景下,OPENAI最近发布的Sora模型无疑是又一次令人瞩目的里程碑。Sora模型基于扩散模型,能够将简单的文本描述转换成为高质量的视频内容。这种能力不仅仅是技术上的创新,更是对视频制作、媒体传播乃至整个娱乐产业的挑战和机遇。

前方高能预警,Sora来袭!

首先,让我们先来感受一下Sora的魔力。

一位戴着尖顶帽,身披绣有白色星星的蓝色长袍的巫师正在施法,他的一只手射出闪电,另一只手中拿着一本旧书。

在一间拥有电影级灯光设置的充满托斯卡纳乡村风情的厨房里,一位擅长利用社交媒体的奶奶,正在教你制作美味的自制诺奇面。

我们将带你进行一次未来城市的街头巡览,在这里,高科技与自然和谐共处,展现出一种独特的赛博朋克风格。
这座城市洁净无瑕,到处可见的是先进的未来式有轨电车、绚丽的喷泉、巨型的全息投影以及四处巡逻的机器人。
想象一下,一个来自未来的人类导游正带领一群好奇的外星访客,向他们展示人类极致创造力的结晶——这座无与伦比、充满魅力的未来城市。

此外,Sora还能在同一视频中设计出多个镜头,同时保持角色和视觉风格的一致性。

需要知道的是,以前的AI视频,都单镜头生成的。 

Prompt: A movie trailer featuring the adventures of the 30 year old space man wearing a red wool knitted motorcycle helmet, blue sky, salt desert, cinematic style, shot on 35mm film, vivid colors.
这是一部电影预告片,讲述了30岁的太空人戴着红色羊毛针织摩托车头盔的冒险经历,蓝天,盐沙漠,电影风格,用35毫米胶片拍摄,色彩鲜艳。

Prompt: Beautiful, snowy Tokyo city is bustling. The camera moves through the bustling city street, following several people enjoying the beautiful snowy weather and shopping at nearby stalls. Gorgeous sakura petals are flying through the wind along with snowflakes.
「雪后的东京熙熙攘攘。镜头穿过繁忙的街道,跟随着几位享受着美丽雪景和在附近摊位购物的人们。美丽的樱花瓣伴随着雪花在风中飘舞。」

Sora根据这个提示所呈现的,便是东京在冬日里梦幻的一幕。

无人机的镜头跟随一对悠闲散步的情侣穿梭在街道上,左侧是车辆在河岸路上行驶的声音,右侧是顾客在一排小店之间穿梭的景象。

Prompt: Animated scene features a close-up of a short fluffy monster kneeling beside a melting red candle. The art style is 3D and realistic, with a focus on lighting and texture. The mood of the painting is one of wonder and curiosity, as the monster gazes at the flame with wide eyes and open mouth. Its pose and expression convey a sense of innocence and playfulness, as if it is exploring the world around it for the first time. The use of warm colors and dramatic lighting further enhances the cozy atmosphere of the image.
动画场景特写了一个毛茸茸的矮个子怪物跪在融化的红烛旁。美术风格是3D和现实的,重点是照明和纹理。这幅画的气氛是一种惊奇和好奇,因为怪物睁大眼睛,张开嘴巴凝视着火焰。它的姿势和表情传达了一种天真和顽皮的感觉,好像它是第一次探索周围的世界。暖色和戏剧性灯光的使用进一步增强了图像的舒适氛围。

Prompt: A gorgeously rendered papercraft world of a coral reef, rife with colorful fish and sea creatures.
一个华丽的珊瑚礁纸工艺品世界,到处都是五颜六色的鱼和海洋生物。

Prompt: Reflections in the window of a train traveling through the Tokyo suburbs.
一列火车穿越东京郊区时,窗户上反射出的迷人景象。

Prompt: Several giant wooly mammoths approach treading through a snowy meadow, their long wooly fur lightly blows in the wind as they walk, snow covered trees and dramatic snow capped mountains in the distance, mid afternoon light with wispy clouds and a sun high in the distance creates a warm glow, the low camera view is stunning capturing the large furry mammal with beautiful photography, depth of field.
在雪地草原上,几只巨大的羊毛猛犸象缓缓前行,它们长长的毛皮在微风中轻轻飘扬。远处是雪覆盖的树木和雄伟的雪山,午后的阳光穿透薄云,给这个场景增添了一抹温暖的光彩。低角度的拍摄令这些庞大的毛茸茸动物显得尤为壮观,景深效果引人入胜。

Prompt: Drone view of waves crashing against the rugged cliffs along Big Sur’s garay point beach. The crashing blue waters create white-tipped waves, while the golden light of the setting sun illuminates the rocky shore. A small island with a lighthouse sits in the distance, and green shrubbery covers the cliff’s edge. The steep drop from the road down to the beach is a dramatic feat, with the cliff’s edges jutting out over the sea. This is a view that captures the raw beauty of the coast and the rugged landscape of the Pacific Coast Highway.
无人机从空中俯瞰大苏尔加雷角海滩附近的崎岖悬崖,海浪冲击着岩石,形成白色的浪尖,落日的金色光辉照亮了岩石海岸。远处有一个小岛上立着灯塔,悬崖边缘覆盖着绿色植被。从道路到海滩的陡峭下降和悬崖边缘凸出的景象,展现了海岸的原始美丽和太平洋海岸公路的崎岖风景。

Prompt: Aerial view of Santorini during the blue hour, showcasing the stunning architecture of white Cycladic buildings with blue domes. The caldera views are breathtaking, and the lighting creates a beautiful, serene atmosphere.
蓝色时刻下的圣托里尼岛航拍视图,展现了白色基克拉迪建筑和蓝色圆顶的绝美建筑。火山口的景色令人叹为观止,灯光营造出一种美丽而宁静的氛围。

Prompt: A young man at his 20s is sitting on a piece of cloud in the sky, reading a book.
一位20多岁的年轻人坐在天空中的一朵云上,沉浸在书本中。

Prompt: A litter of golden retriever puppies playing in the snow. Their heads pop out of the snow, covered in.
一群活泼的金毛寻回犬小狗在银白色的雪地上嬉戏,它们好奇的小脑袋时而从雪地中探出,被雪花点缀,萌态十足。

Prompt: The camera directly faces colorful buildings in burano italy. An adorable dalmation looks through a window on a building on the ground floor. Many people are walking and cycling along the canal streets in front of the buildings.
在意大利布拉诺一排排鲜艳的彩色建筑中,一只可爱的斑点狗正通过窗户好奇地望向外面。与此同时,街道上人来人往,有的步行,有的骑行。

Prompt: Tiltshift of a construction site filled with workers, equipment, and heavy machinery.
一幅充满工人、设备和重型机械的建筑工地的移轴摄影。

Prompt: A petri dish with a bamboo forest growing within it that has tiny red pandas running around
在一个培养皿中,生长着一片竹林,其中小熊猫们在欢快地奔跑。

Prompt: A cartoon kangaroo disco dances.
一只卡通袋鼠正在迪斯科舞池中跳舞。

Prompt: Photorealistic closeup video of two pirate ships battling each other as they sail inside a cup of coffee.
在一杯咖啡中,两艘海盗船展开了激烈的战斗,超写实的近景视频。

当然也有一些诡异的输出。

好在,它还并不完美。

否则,虚拟和现实的界限,还能区分得清吗?

浅析Sora的技术亮点

在Open AI给出的技术报告【1】中,笔者挖出了两点Sora的技术要点,分享如下:
1-视觉数据基建----时空碎片(Spacetime Patches)
以chatGPT为例,大语言模型首先通过Embedding将人类语言“编码”,然后通过注意力机制Attention提取各种丰富的知识和结构,以加权的形式学习并建立“关键词”之间的联系,最后再“反编码”,以人类的语言输出返回结果。

语言模型中构建关键词联系


语言模型中构建关键词联系

与LLM-NLP思路一致,Sora的第一步是针对视觉数据的建模:首先将视频压缩到一个低维的潜在空间,然后将其分解为时空碎片,这些“碎片”的集合作为Sora吃进的“语料”。这里的“碎片”-Patches,等同于语言模型中的Tokens,它帮助Sora获得了自然语言处理特性。

视频素材分解为时空碎片


视频素材分解为时空碎片

进一步,Sora团队构建了“智能字幕“模型DALL.E3,其建立起了Patches到Tokens之间的联系,实现了文本与视频的互译。使得GPT丰富的文本数据被有效的应用于Sora的训练,这极大地促进了Sora的诞生。


其次,由于Patches高度可扩展的表示特性,使得Sora能够应用于广泛的图像和视频编辑任务(图像就是厚度为1的视频,分辨率、形状等属性变换都可以体现为Patches的排列组合)。
2-反向学习----扩散模型(Diffusion Transformers--DiT)【2】


扩散模型是一种深度生成模型,其基本思想就是通过一个可逆的过程,将结构化数据(如图片)逐步转化为无结构的噪声数据,然后再逆向这个过程,从噪声中恢复出原始数据或生成新的数据实例。简而言之,就是让模型从图像的模糊还原中学习图像生成。

在这里插入图片描述

而DiT相对于传统的扩散模型做出了如下改进:
 使用Transformer替换U-Net,使得模型能够更好的处理长距离依赖性;
 验证了Transformer架构在扩散模型上的可扩展性,随着模型计算复杂度的上升,生成质量稳步提升。
 使用Latent diffusion取代pixel diffusion,降低了模型计算量。

扩散模型DiT


扩散模型DiT

在Sora的技术报告中,OpenAI 称Sora摒弃了“其他文生视频模型调整视频大小、裁剪或修剪到标准大小的通常做法”,以可变时长、分辨率与长宽比来训练视频生成,从而获得了重要优势。
从报告中展示的成果来看,Sora在视频生成上展现出了强大的涌现能力:人和景物在三维空间移动的一致性;长程时间相关性与对象持久性,如事物被遮挡后重现;事物与周边世界的互动性等等。

Not for play, But change world!

OpenAI在Sora的技术报告中毫不吝惜夸赞的言词,并对Sora的潜力充满期待。他们认为持续扩大视频模型的规模,将可以用来模拟整个物理和数字世界。这一愿景深深地震撼了笔者本人!

OpenAI的宏大目标


OpenAI的宏大目标

伴随着笔者对知乎、csdn、facebook的疯狂查阅,有另一种声音愈发强烈。原本笔者只是惊讶于Sora视频的丝滑,清晰与文本生成的简易。而更多的大佬,纷纷指出,Sora视频毫无违和感,没错!就是毫无违和感,它所展现的光影效果与碰撞遮挡,太真实了!Sora对于图像与视频的处理仅仅是其能力的表象,真相是,Sora是真的在理解地球物理世界的规律,而且取得了巨大的进展。

在这里插入图片描述


未来已来,只是尚未流行

“Sora 是一个数据驱动的物理引擎!“NVIDIA研究科学家Jim Fan在Twitter上发文。
“Sora不讲武德,一句话就有连续的视频,毁灭吧,计算机图形学!毁灭吧,游戏引擎!“计算机图形学学者谭剑如是说。
“去他喵的物理公式,宇宙的终极是概率!“
……
红衣教主周鸿祎曾表示:一旦人工智能接上摄像头,对世界的理解将远远超过文字学习,一幅图胜过千言万语,而视频传递的信息量又远远超过一幅图,这就离AGI(通用人工智能)真的不远了,不是10年、20年的问题,可能一两年很快就可以实现。
而当下,Sora突破了,它实现了机器对这个世界的感知、观察和交互的能力,也就是说真正的给人工智能补上了眼睛。不难想象,在AI如此尽力的发展下,元宇宙般的梦幻世界仿佛近在咫尺。

img

AI在疯狂汲取人类文明与客观世界的知识

Sora的成本与OpenAI的7万亿美金豪赌

“很少有人提到 Sora 视频生成的成本。用 Sora 生成 1 分钟的视频估计需要几十美金,比RunwayML的Gen2(大约一分钟10美金)还贵,而很多人会选择性的忽略成本。比如 GPT-4 支持128K上下文的时候,很少有人提到用一次128K上下文需要1.28美金。今天 Gemini 1.5说支持10M上下文了,却并没有人知道这10M上下文的成本是多少。视频生成如果成本高达一分钟几十美金,那就只能受限于专业的影片和游戏制作人,没法用来生成抖音短视频。这就是为什么OpenAI要搞7万亿美金来造芯片。很多人觉得Sam Altman疯了,但我觉得他看到了AI真正的瓶颈——算力。“ ----知乎作者-李博杰


这样的判断很快迎来了资本市场的认证。继2月15日Sora爆炸问世后一周,全世界的投资人,都把目光投向了全球芯片巨头——英伟达。截至当地时间2月22日收盘,英伟达报785.38美元,涨16.4%,创历史新高,市值逼近2万亿美元,成为微软、苹果之后第三高。其市值一夜增长2733亿美元(约合人民币2万亿元)。相当于增加了一整个Netflix或一整个Adobe,约等于一个茅台三个宁德时代!皮衣刀客黄仁勋身家超越中国首富、农夫山泉创始人钟睒睒,升至全球富豪榜第 21 位。


不得不说“淘金的还没起飞,但卖铲子的倒是真的起飞了,哈哈哈哈!”

在这里插入图片描述

黄仁勋眺望未来

算力,未来在何方?

正所谓:哪里有需求,哪里就有市场!Sora的火爆与NVIDIA的成功又再一次印证了人工智能的影响力及其发展的紧迫性,这促使着“国产算力替代”又再一次回到了发展舞台的中心。过去的时间里,在中美博弈,芯片法案的压力下,催生出了一系列AI芯片独角兽,大家也都在各自的技术路线上奋起直追。这包括全志科技多目异构视觉芯片“V853”,云天励飞多芯粒集成CV加速单元“DeepEdge10”,清华大学的智能驾驶计算芯片“惊蛰R1”,时识科技“感算一体”动态视觉SoC“Speck”,以及知存科技的“存算一体”AI视觉芯片“WTM8系列”。与此同时,芯片架构设计、芯片验证以及编译工具链开发等AI芯片岗也引发了新一轮的人才需求热潮。


值得一提的是,在新一轮算力攻坚赛中,突破传统冯·诺依曼架构的范式探索成为主要方向之一。而“存算一体”架构打破了存算分离的壁垒,减少了数据的搬运,它就如同“在家办公”的新型工作模式,消除了数据“往返通勤“的能量消耗、时间延迟,并且节约了“办公场所”的运营成本,因而具备高能效比。加上“存算一体”架构对于工艺制程的“弱依赖”性(14nm展现4nm数字电路表现性能),使其成为了AI算力的重要发展方向。

在这里插入图片描述

Intel Lab 的大规模存算核拓扑规则【3】

从存算一体技术发展来看:
规模正在几何扩增。上图是2024年英特尔实验室新鲜出炉的存算一体架构大规模扩展拓扑图,可以清晰的看到64核拓扑,笔者印象2023年底的时候,4核才刚进入使用。


精度正在更进一步。从4比特到8比特到10比特。最新消息,AI芯片公司TetraMem及其合作伙伴,继2023年3月突破11比特后,于今年2月23日又在《科学》上发表重大突破:以忆阻器为核心的全新架构,突破实现任意高精度模拟计算【4】。


按照存算架构相对于传统数字电路10倍的能效表现,只能说其作为超大模型的支持潜力在逐渐被挖掘,属于它的时代即将到来。

最后

可以预见的是,AI的成长会以不可思议的速度多向发展,AI的成长基石:数据、算力、能源将会成为社会发展的重要引擎。笔者在此热烈邀请大家共同关注,共同学习,共同迎接美好的明天!

参考文献

【1】Technical report of Sora: Video generation models as world simulators (openai.com)
【2】Scalable Diffusion Models with Transformers:https://doi.org/10.48550/arXiv.2212.09748
【3】Towards Joint Modeling of Dialogue Response and Speech Synthesis based on Large Language Model:https://doi.org/10.48550/arXiv.2309.11000
【4】Programming memristor arrays with arbitrarily high precision for analog computing:https://www.science.org/doi/10.1126/science.adi9405

【5】另外,找到了一篇Sora的技术详解,有兴趣的朋友请见:最强文生视频模型 SORA 技术路线解读 (yuque.com)  

https://bbs.csdn.net/topics/618126472

【6】存内计算社区·文生视频Sora模型发布,是否引爆AI芯片热潮 :https://bbs.csdn.net/topics/618126472

相关文章:

新王炸:文生视频Sora模型发布,能否引爆AI芯片热潮

前言 前方高能预警,Sora来袭! 浅析Sora的技术亮点 语言模型中构建关键词联系 视频素材分解为时空碎片 扩散模型DiT Not for play, But change world! OpenAI的宏大目标 未来已来,只是尚未流行 Sora的成本与OpenAI的7万亿美金豪赌 算…...

代码随想录算法训练营|day48

第九章 动态规划 121.买卖股票的最佳时机122.买卖股票的最佳时机II代码随想录文章详解 121.买卖股票的最佳时机 本题中股票只能买卖一次 dp[i][0] 表示第i天不买入股票持有的最大现金;dp[i][1] 表示第i天买入股票持有的最大现金。 不买股票持有的最大现金买入股票…...

架构面试题汇总:并发和锁(三)

在现代软件开发中,并发编程和多线程处理已成为不可或缺的技能。Java作为一种广泛使用的编程语言,提供了丰富的并发和多线程工具,如锁、同步器、并发容器等。因此,对于Java开发者来说,掌握并发编程和多线程处理的知识至…...

蓝桥杯(3.2)

1209. 带分数 import java.io.*;public class Main {static BufferedReader br new BufferedReader(new InputStreamReader(System.in));static PrintWriter pw new PrintWriter(new OutputStreamWriter(System.out));static final int N 10;static int n, cnt;static int[…...

[数据集][目标检测]鸟类检测数据集VOC+YOLO格式11758张200类别

数据集格式:Pascal VOC格式YOLO格式(不包含分割路径的txt文件,仅仅包含jpg图片以及对应的VOC格式xml文件和yolo格式txt文件) 图片数量(jpg文件个数):11758 标注数量(xml文件个数):11758 标注数量(txt文件个数):11758 标…...

YOLOv9:使用可编程梯度信息学习您想学习的内容

摘要 arxiv.org/pdf/2402.13616.pdf 当今的深度学习方法侧重于如何设计最合适的目标函数,以便模型的预测结果能最接近于实际结果。同时,还必须设计一个适当的架构,以便于获取足够的预测信息。现有的方法忽略了一个事实,即当输入数据经历层层特征提取和空间变换时,会损失…...

uniapp:使用DCloud的uni-push推送消息通知(在线模式)java实现

uniapp:使用DCloud的uni-push推送消息通知(在线模式)java实现 1.背景 今天开发app的时候遇到一个需求: 业务在出发特定条件的时候向对应的客户端推送消息通知。 为什么选择在线模式,因为我们使用的是德邦类似的手持终端&#xf…...

【简说八股】面试官:你知道什么是AOP么?

回答 AOP(Aspect-Oriented Programming),即面向切面编程,是一种编程范式,它的主要思想是将应用程序中的横切关注点(如日志记录、性能统计、安全控制等)从业务逻辑中剥离出来,然后通过特殊的方式将这些横切…...

ASUS华硕天选5笔记本电脑FX607JV原装出厂Win11系统下载

ASUS TUF Gaming F16 FX607JV天选五原厂Windows11系统 适用型号: FX607JU、FX607JI、FX607JV、 FX607JIR、FX607JVR、FX607JUR 下载链接:https://pan.baidu.com/s/1l963wqxT0q1Idr98ACzynQ?pwd0d46 提取码:0d46 原厂系统自带所有驱动、…...

Unity(第二十一部)动画的基础了解(感觉不了解其实也行)

1、动画组件老的是Animations 动画视频Play Automatically 是否自动播放Animate Physics 驱动方式,勾选后是物理驱动Culling Type 剔除方式 默认总是动画化就会一直执行下去,第二个是基于渲染播放(离开镜头后不执行), …...

写时复制简介

写时复制技术(Copy on Write)是比较常用的一种技术,它的主要目的是延迟减少以及延迟内存的分配,增加执行效率,只有在真正进行写操作的过程中才会真正分配物理资源。同时,也可以保护数据在系统崩溃时出现的丢失。比如,我…...

运行Python文件时出现‘utf-8’code can‘t decode byte 如何解决?(如图)

如图 亦或者出现“SyntaxError: Non-UTF-8 code starting with \xbb ” 出现这种问题往往是编码格式导致的,我们可以在py文件中的第一行加入以下代码: # codingutf-8或者 # codinggdk优先使用gbk编码 解释一下常用的两种编码格式: utf-…...

行为树入门:BehaviorTree.CPP Groot2练习(叶子节点)(2)

以《行为树BehaviorTree学习记录1_基本概念》练习。 1 SequenceNode顺序控制节点 代码下载 git clone https://gitee.com/Luweizhiyuan2020/ros2_bt.git例程 1.1 sequence 顺序执行 下载版本SequenceNode1。 1.2 ReactiveSequence 异步执行 注意: ①only a…...

leetcode-字符串中的单词数

434. 字符串中的单词数 题解: 这个问题可以通过遍历字符串,当遇到非空格字符时,判断其前一个字符是否为空格,如果是,则说明这是一个新的单词的开始,计数器加一。最后返回计数器的值即可。 class Solutio…...

一些C语言题目

求10个整数中最大值 #include <stdio.h>//求10个整数中最大值 int main() {int arr[10]{2,5,8,6,19,1,7,3,11,3};int i 0;int max 0;/*for(i 0;i < 10;i){scanf("%d",&arr[i]);}*/for(i 0;i < 10;i){if(arr[i] > max)max arr[i];}printf(&q…...

JVM相关问题

JVM相关问题 一、Java继承时父子类的初始化顺序是怎样的&#xff1f;二、JVM类加载的双亲委派模型&#xff1f;三、JDK为什么要设计双亲委派模型&#xff0c;有什么好处&#xff1f;四、可以打破JVM双亲委派模型吗&#xff1f;如何打破JVM双亲委派模型&#xff1f;五、什么是内…...

32单片机基础:旋转编码器计次

接线图如上图所示。 我们初始化一下PB0和PB1两个GPIO口外设中断&#xff0c;当然&#xff0c;这里只初始化一个外部中断也能完成功能的对于编码器而言&#xff0c;下图所示为正转的波形。如果把一相的下降沿用作触发中断&#xff0c;在中断时刻读取另一相的电平&#xff0c;正…...

【C++】vector的使用和模拟实现(超级详解!!!!)

文章目录 前言1.vector的介绍及使用1.1 vector的介绍1.2 vector的使用1.2.1 vector的定义1.2.2 vector iterator 的使用1.2.3 vector 空间增长问题1.2.3 vector 增删查改1.2.4 vector 迭代器失效问题。&#xff08;重点!!!!!!&#xff09;1.2.5 vector 在OJ中有关的练习题 2.ve…...

GO学习记录

这里写目录标题 00 环境01 语言基础二级目录三级目录 00 环境 参考的&#xff1a;https://www.liwenzhou.com/posts/Go/install/ 编译运行&#xff1a; go mod init <项目名> // 在目录下创建项目 go mod init <项目名> // 编译go run <文件名>.go …...

迭代器模式(Iterator Pattern)

定义 迭代器模式&#xff08;Iterator Pattern&#xff09;是一种行为型设计模式&#xff0c;它提供了一种方法来顺序访问聚合对象中的各个元素&#xff0c;而不需要暴露该对象的内部表示。迭代器模式使得客户端代码能够独立于聚合对象的具体实现进行遍历操作。 在迭代器模式…...

利用ngx_stream_return_module构建简易 TCP/UDP 响应网关

一、模块概述 ngx_stream_return_module 提供了一个极简的指令&#xff1a; return <value>;在收到客户端连接后&#xff0c;立即将 <value> 写回并关闭连接。<value> 支持内嵌文本和内置变量&#xff08;如 $time_iso8601、$remote_addr 等&#xff09;&a…...

【人工智能】神经网络的优化器optimizer(二):Adagrad自适应学习率优化器

一.自适应梯度算法Adagrad概述 Adagrad&#xff08;Adaptive Gradient Algorithm&#xff09;是一种自适应学习率的优化算法&#xff0c;由Duchi等人在2011年提出。其核心思想是针对不同参数自动调整学习率&#xff0c;适合处理稀疏数据和不同参数梯度差异较大的场景。Adagrad通…...

MySQL 隔离级别:脏读、幻读及不可重复读的原理与示例

一、MySQL 隔离级别 MySQL 提供了四种隔离级别,用于控制事务之间的并发访问以及数据的可见性,不同隔离级别对脏读、幻读、不可重复读这几种并发数据问题有着不同的处理方式,具体如下: 隔离级别脏读不可重复读幻读性能特点及锁机制读未提交(READ UNCOMMITTED)允许出现允许…...

【JVM】- 内存结构

引言 JVM&#xff1a;Java Virtual Machine 定义&#xff1a;Java虚拟机&#xff0c;Java二进制字节码的运行环境好处&#xff1a; 一次编写&#xff0c;到处运行自动内存管理&#xff0c;垃圾回收的功能数组下标越界检查&#xff08;会抛异常&#xff0c;不会覆盖到其他代码…...

现代密码学 | 椭圆曲线密码学—附py代码

Elliptic Curve Cryptography 椭圆曲线密码学&#xff08;ECC&#xff09;是一种基于有限域上椭圆曲线数学特性的公钥加密技术。其核心原理涉及椭圆曲线的代数性质、离散对数问题以及有限域上的运算。 椭圆曲线密码学是多种数字签名算法的基础&#xff0c;例如椭圆曲线数字签…...

2025盘古石杯决赛【手机取证】

前言 第三届盘古石杯国际电子数据取证大赛决赛 最后一题没有解出来&#xff0c;实在找不到&#xff0c;希望有大佬教一下我。 还有就会议时间&#xff0c;我感觉不是图片时间&#xff0c;因为在电脑看到是其他时间用老会议系统开的会。 手机取证 1、分析鸿蒙手机检材&#x…...

AI病理诊断七剑下天山,医疗未来触手可及

一、病理诊断困局&#xff1a;刀尖上的医学艺术 1.1 金标准背后的隐痛 病理诊断被誉为"诊断的诊断"&#xff0c;医生需通过显微镜观察组织切片&#xff0c;在细胞迷宫中捕捉癌变信号。某省病理质控报告显示&#xff0c;基层医院误诊率达12%-15%&#xff0c;专家会诊…...

在QWebEngineView上实现鼠标、触摸等事件捕获的解决方案

这个问题我看其他博主也写了&#xff0c;要么要会员、要么写的乱七八糟。这里我整理一下&#xff0c;把问题说清楚并且给出代码&#xff0c;拿去用就行&#xff0c;照着葫芦画瓢。 问题 在继承QWebEngineView后&#xff0c;重写mousePressEvent或event函数无法捕获鼠标按下事…...

基于TurtleBot3在Gazebo地图实现机器人远程控制

1. TurtleBot3环境配置 # 下载TurtleBot3核心包 mkdir -p ~/catkin_ws/src cd ~/catkin_ws/src git clone -b noetic-devel https://github.com/ROBOTIS-GIT/turtlebot3.git git clone -b noetic https://github.com/ROBOTIS-GIT/turtlebot3_msgs.git git clone -b noetic-dev…...

Mysql8 忘记密码重置,以及问题解决

1.使用免密登录 找到配置MySQL文件&#xff0c;我的文件路径是/etc/mysql/my.cnf&#xff0c;有的人的是/etc/mysql/mysql.cnf 在里最后加入 skip-grant-tables重启MySQL服务 service mysql restartShutting down MySQL… SUCCESS! Starting MySQL… SUCCESS! 重启成功 2.登…...