当前位置: 首页 > news >正文

读十堂极简人工智能课笔记06_自然语言处理

1. 聊天机器人

1.1. 人工智能往往掌握不了跨越几段对话语境的讨论

1.1.1. 抓不住连贯的主题,只能单独处理每个句子

1.1.2. 不能将其答案与现实联系起来

1.1.3. 可能会遵循语言规则、统计相关性,甚至查找有关事实来为每个新句子提供答复

1.2. 聊天机器人只是在模拟对话

1.2.1. 操纵着符号,却不了解这些符号的含义

1.2.2. 约翰·塞尔的中文房间论证

1.3. 哲学家深刻地关心真实性的问题,但商业世界并不关心

1.3.1. 对商界来说,重要的是结果,而不是产生这个结果的过程

1.4. 在现实世界的应用中

1.4.1. 一个能自动提供在线客户服务的聊天机器人

1.4.2. 一个能利用产品知识数据库回答客户问题的聊天机器人

1.4.3. 企业必不可少的工具

1.4.3.1. 能让真人腾出手来处理难度更大的咨询

2. 语言规则

2.1. 在自然语言处理领域,诺姆·乔姆斯基是其发展史上的关键人物

2.1.1. 美国语言学家、哲学家

2.1.2. 认知科学领域(关于思维及其能力的科学研究)的创始人之一

2.1.3. 最著名的一大成果是通用语法

2.1.3.1. 在研究儿童的语言能力发展后总结出来的理论
2.1.3.2. 儿童虽然能够学会流利地说话,但他们在学习过程里其实根本没有接收到足够的信息
2.1.3.2.1. 所谓的“刺激的贫乏”
2.1.3.3. 儿童能够发展语言技能的唯一途径是他们拥有先天的沟通能力,在他们的大脑中本来就有相关的连接
2.1.3.4. 先天的语言能力可以被认为是一套语言规则,即一套通用语法
2.1.3.5. 这一想法发展为转换——生成语法的理论,也就是使用“形式语法”来描述嵌入不同语言中的规则,让人们能够比较这些语言
2.1.3.6. 这一思想在20世纪50至70年代主导了语言学,而这正是人工智能研究者开始尝试让计算机处理文字的时候

2.2. 乔姆斯基的层级结构

2.2.1. 所有形式化语法都是第0型,或无限制型(最一般的类型)

2.2.2. 只有一部分第0型语法同时也是第1型

2.2.2.1. 上下文敏感型
2.2.2.2. 这类词根据上下文可能只适合放在某个地方

2.2.3. 只有一部分第1型语法同时也是第2型

2.2.3.1. 上下文自由型
2.2.3.2. 大多数计算机编程语言的设计方式
2.2.3.3. 语句中不能有任何歧义

2.2.4. 只有一部分第2型语法同时也是第3型

2.2.4.1. 其定义的规则语言是如此简单和狭窄,以至于有限状态机都可以理解它们

2.3. 自然语言处理就是聊天机器人内部的符号人工智能

2.3.1. 目的是弄清怎么处理书面文字

2.4. 早期的聊天机器人广泛使用了乔姆斯基的理论,人们可以据此开发出清晰而精确的语言规则

2.5. 正是通过自然语言处理,研究人员现在可以将成千上万互相独立的科学论文整合对照,得出人类无法实现的新发现

3. 语料库语言学

3.1. 随着世界上越来越多的知识、商业活动和社交互动转移到互联网上,人类之间对话的数据量也有了指数级增长

3.2. 这些数据的第一个用途,是通过一种叫作决策树的人工智能方法,自动生成语言规则

3.3. 决策树流行的原因是,它们很容易理解

3.3.1. 与神经网络方法不同的是,神经网络像“黑箱”

3.3.1.1. 你不知道信息是如何存储的,也不知道决策是如何做出的

3.3.2. 在决策树中,你可以看清整个过程

3.3.2.1. 决策树就像用于机器人控制的行为树

3.4. 过度拟合

3.4.1. 人工智能学到的模型过于贴合训练数据,而不能泛化应用到新数据上

3.5. 随机森林就是把一组决策树结合在一起使用,每一个决策树都是在较小的数据子集上训练出来的,以防止过度拟合

3.6. Word2Vec

3.6.1. 目前最受欢迎的方法之一

3.6.2. 使用简单的神经网络与大量的数据来学习哪些词语的组合倾向于出现在彼此靠近的地方

3.6.3. 可以从一组上下文词汇中预测中间的词可能是什么

3.6.4. 从一个中间的词预测一组可能的上下文词汇

3.7. 卷积神经网络、强化学习和其他类型的循环神经网络、递归神经网络、注意力机制和生成模型,这都有助于计算机理解跨越多个句子的概念,并生成更好的回复

4. 交流

4.1. 人类毕竟是社会动物,我们喜欢交谈

4.1.1. 我们喜欢把字眼安排在无限变化的句子中,每个句子的含义都略有不同

4.2. 人工智能能理解文字已经难能可贵

4.2.1. 苹果的Siri、微软的Cortana、亚马逊的Echo和谷歌的Assistant都是人类现有的最复杂算法的组合

4.3. 用于交流的人工智能并不总是特别可靠

4.3.1. 只要问它们一些意想不到的问题,或者用系统没有训练过的口音提问,即使是精巧的技术也会失败

4.4. 机器不可能总是听清每个声音

4.4.1. 人工智能会将初始的理解修正为人们更有可能说出来的话语

4.4.2. 毕竟大多数人每天都会说很多相同的话

4.5. 除了几百万美元的云计算成本外,它们的碳足迹可能与五辆汽车的整个生命周期一样高

4.6. 虽然人工智能技术在训练结束后的应用可能会很高效,但创造人工智能的过程并不高效或便宜

4.7. 人工智能的许多最新研究都忽视了效率问题

4.7.1. 因为人们发现规模极大的神经网络对多种多样的任务都很有用,那些拥有丰富计算资源的公司和机构可以利用这一点来获得竞争优势

4.8. Tay

4.8.1. 2016年3月23日推出

4.8.2. 微软在2016年探索过一个方案:利用众包来提供数据,帮助他们的推特聊天机器人学习

4.8.3. 仅仅16个小时后就被匆忙关闭

4.8.4. 网友教给Tay各种粗话和与毒品相关的语句,然后它顺理成章地把这些语句推送给了众多关注者

4.9. 伪装成人类的聊天机器人可以给我们发送一些具有针对性的广告或政治信息

4.10. 舆论意见可以由此被监测和管理

4.11. 我们获取信息的方式也是由人工智能策划的

4.12. 推荐系统会监测我们在移动设备上喜欢阅读哪些内容,并向我们推送更多类似的内容,让我们看到的世界变得更加狭窄,由此进一步加强我们的偏见

4.12.1. 那些不受欢迎的政权更容易控制人民,民粹领袖也更容易赢得权力

4.13. 通过人工智能,才可以真正了解千百万人民的意见和看法,并帮助政治家和机构更好地满足人民的需求

4.14. 所有的新技术都可能被用于为善或作恶

4.14.1. 我们需要意识到人工智能的影响,并确保它得到恰当的应用

相关文章:

读十堂极简人工智能课笔记06_自然语言处理

1. 聊天机器人 1.1. 人工智能往往掌握不了跨越几段对话语境的讨论 1.1.1. 抓不住连贯的主题,只能单独处理每个句子 1.1.2. 不能将其答案与现实联系起来 1.1.3. 可能会遵循语言规则、统计相关性,甚至查找有关事实来为每个新句子提供答复 1.2. 聊天机…...

Linux文件信息,drwxr-xr-x. 2 root root 6 Jan 30 17:42 Desktop

drwxr-xr-x. 2 root root 6 Jan 30 17:42 Desktop drwxr-xr-x. drwxr-xr-x.d是文件类型rwx r-x r-x9位,每3位一组,一共3组,代表基本权限第一组 文件的创建者 | 拥有者第二组 和拥有者在一个组中第三组 其他用户rread,读的权限ww…...

深入理解Promise:用法和面试问题解析

引言 在现代的异步JavaScript编程中,Promise是一个强大的工具,用于更优雅地处理异步操作。本文将深入探讨Promise的具体用法,并提供一些在面试中可能遇到的问题及其答案。 Promise的基本用法 Promise是一个代表异步操作最终完成或失败的对…...

css2背景

css2背景 一.背景颜色二.背景图片三.背景平铺四.背景图片位置五.背景图像固定六.复合型写法七.背景颜色半透明八.总结 一.背景颜色 默认是transparent(透明) 二.背景图片 默认是none 三.背景平铺 默认是background-repeat(平铺) 四.背景图片位置…...

KUKA库卡机器人编程语言是什么?

KUKA库卡机器人的编程语言主要是KUKA Robot Language(简称KRL)。KRL是库卡机器人专门为其机器人系统设计的编程语言,用于编写和控制KUKA工业机器人的运动和操作。KRL结合了指令式编程和结构化编程的特点,具有一定的易学性和灵活性…...

Django学习全纪录:Django视图和路由的配置,应用的创建以及注册

导言 在之前的文章中,我们已经将Django的环境部署完成,包括一些注意事项以及前期工作,都已经完成。这篇文章,我们就可以正式开始干活了。 学习目标 1、学习创建应用以及注册APP 2、初步认识视图和路由,以及编写简单的代码 3、启动应用观察变化 创建第一个应用(APP) …...

LabVIEW卫星电视接收仿真系统

LabVIEW卫星电视接收仿真系统 随着卫星电视数字化的加速,传统模拟信号接收系统已无法满足需求。设计一套船载数字卫星电视接收系统,通过LabVIEW环境进行仿真实验,验证系统设计的可行性与有效性,满足数字信号接收的高精度要求&…...

docker修改工作目录

开始之前请务必给服务器打快照!!! 开始之前请务必给服务器打快照!!! 开始之前请务必给服务器打快照!!! docker 默认安装在 /var/lib/docker 目录下 $ docker info | g…...

Ps:统计

Ps菜单:文件/脚本/统计 Scripts/Statistics 统计 Statistics脚本命令提供了一种高效的方法来处理和分析大量图像,使用户能够自动执行复杂的图像分析任务,并在多个图像间应用统计学方法。这个功能极大地扩展了 Photoshop 在科学研究、图像编辑…...

java生成pdf

1.pdf预览 2.maven <!--pdf--><dependency><groupId>com.itextpdf</groupId><artifactId>itextpdf</artifactId><version>5.5.9</version></dependency><dependency><groupId>com.itextpdf</groupId>…...

鸿蒙应用/元服务开发-窗口概述

一、窗口模块的定义 窗口模块用于在同一块物理屏幕上&#xff0c;提供多个应用界面显示、交互的机制。 对应用开发者而言&#xff0c;窗口模块提供了界面显示和交互能力。 对终端用户而言&#xff0c;窗口模块提供了控制应用界面的方式。 对整个操作系统而言&#xff0c;窗…...

引入成熟的Pytest自动化测试框架

虽然我们能使用脚本编写自动化测试框架&#xff0c;但没有必要重复找车轮子&#xff0c;引入成熟的自动化测试框架即可&#xff0c; Pytest是目前最成熟、功能最全面的Python测试框架之一&#xff0c;简单灵活、易于上手&#xff0c;可完全兼容其他测试框架如unitest&#xff…...

学习总结18

# 营救 ## 题目背景 “咚咚咚……”“查水表&#xff01;”原来是查水表来了&#xff0c;现在哪里找这么热心上门的查表员啊&#xff01;小明感动得热泪盈眶&#xff0c;开起了门…… ## 题目描述 妈妈下班回家&#xff0c;街坊邻居说小明被一群陌生人强行押上了警车&#…...

SpringMVC的执行流程

过去的开发中,视图阶段&#xff08;老旧JSP等&#xff09; 1.首先用户发送请求到前端控制器DispatcherServlet(这是一个调度中心) 2.前端控制器DispatcherServlet收到请求后调用处理器映射器HandlerMapping 3.处理器映射器HandlerMapping找到具体的处理器,可查找xml配置或注…...

Vue项目启动过程全记录(node.js运行环境搭建)

一、安装node.js并配置环境变量 1、安装node.js 从Node.js官网下载安装包并安装。然后在安装后的目录&#xff08;如果是下载的压缩文件&#xff0c;则是解压缩的目录&#xff09;下新建node_global和node_cache这两个文件夹。 node_global&#xff1a;npm全局安装位置 node_…...

Linux下如何配置环境变量

在Linux下配置环境变量通常有几种方法&#xff0c;具体取决于你希望将环境变量设置为全局还是仅对当前会话有效。以下是一些常见的方法&#xff1a; 永久性全局配置&#xff1a;要使环境变量在所有用户和会话中永久生效&#xff0c;可以编辑 /etc/environment 文件。在文件中添…...

PyCharm 主题和字体 (Scheme Editor Font)

PyCharm 主题和字体 [Scheme & Editor Font] References Scheme & Editor Font File -> Settings -> Editor -> Colors & Fonts -> Font Show only monospaced fonts&#xff1a; 只显示等宽字体。编程时使用等宽字体效果较好。 References [1] Yon…...

二叉树相关OJ题

创作不易&#xff0c;感谢三连&#xff01;&#xff01; 一、选择题 1、某二叉树共有 399 个结点&#xff0c;其中有 199 个度为 2 的结点&#xff0c;则该二叉树中的叶子结点数为&#xff08; &#xff09; A.不存在这样的二叉树 B.200 C.198 D.199解析&#xff1a;选B&…...

文物保护系统守护历史岁月,成都青铜展科技闪耀

一、“吉金万里-中国西南青铜文明展”隆重开幕 1月27日&#xff0c;“吉金万里-中国西南青铜文明展”在成都金沙遗址博物馆向公众开放&#xff0c;奉上一场精彩的青铜文明“盛宴”。本次展览汇集了中国西南地区32家文博单位&#xff0c;以青铜器为代表的294件经典文物&#xf…...

[计算机网络]---Http协议

前言 作者&#xff1a;小蜗牛向前冲 名言&#xff1a;我可以接受失败&#xff0c;但我不能接受放弃 如果觉的博主的文章还不错的话&#xff0c;还请点赞&#xff0c;收藏&#xff0c;关注&#x1f440;支持博主。如果发现有问题的地方欢迎❀大家在评论区指正 本期学习&#xf…...

Ubuntu系统下交叉编译openssl

一、参考资料 OpenSSL&&libcurl库的交叉编译 - hesetone - 博客园 二、准备工作 1. 编译环境 宿主机&#xff1a;Ubuntu 20.04.6 LTSHost&#xff1a;ARM32位交叉编译器&#xff1a;arm-linux-gnueabihf-gcc-11.1.0 2. 设置交叉编译工具链 在交叉编译之前&#x…...

逻辑回归:给不确定性划界的分类大师

想象你是一名医生。面对患者的检查报告&#xff08;肿瘤大小、血液指标&#xff09;&#xff0c;你需要做出一个**决定性判断**&#xff1a;恶性还是良性&#xff1f;这种“非黑即白”的抉择&#xff0c;正是**逻辑回归&#xff08;Logistic Regression&#xff09;** 的战场&a…...

UE5 学习系列(三)创建和移动物体

这篇博客是该系列的第三篇&#xff0c;是在之前两篇博客的基础上展开&#xff0c;主要介绍如何在操作界面中创建和拖动物体&#xff0c;这篇博客跟随的视频链接如下&#xff1a; B 站视频&#xff1a;s03-创建和移动物体 如果你不打算开之前的博客并且对UE5 比较熟的话按照以…...

Keil 中设置 STM32 Flash 和 RAM 地址详解

文章目录 Keil 中设置 STM32 Flash 和 RAM 地址详解一、Flash 和 RAM 配置界面(Target 选项卡)1. IROM1(用于配置 Flash)2. IRAM1(用于配置 RAM)二、链接器设置界面(Linker 选项卡)1. 勾选“Use Memory Layout from Target Dialog”2. 查看链接器参数(如果没有勾选上面…...

【论文阅读28】-CNN-BiLSTM-Attention-(2024)

本文把滑坡位移序列拆开、筛优质因子&#xff0c;再用 CNN-BiLSTM-Attention 来动态预测每个子序列&#xff0c;最后重构出总位移&#xff0c;预测效果超越传统模型。 文章目录 1 引言2 方法2.1 位移时间序列加性模型2.2 变分模态分解 (VMD) 具体步骤2.3.1 样本熵&#xff08;S…...

如何在网页里填写 PDF 表格?

有时候&#xff0c;你可能希望用户能在你的网站上填写 PDF 表单。然而&#xff0c;这件事并不简单&#xff0c;因为 PDF 并不是一种原生的网页格式。虽然浏览器可以显示 PDF 文件&#xff0c;但原生并不支持编辑或填写它们。更糟的是&#xff0c;如果你想收集表单数据&#xff…...

【Java学习笔记】BigInteger 和 BigDecimal 类

BigInteger 和 BigDecimal 类 二者共有的常见方法 方法功能add加subtract减multiply乘divide除 注意点&#xff1a;传参类型必须是类对象 一、BigInteger 1. 作用&#xff1a;适合保存比较大的整型数 2. 使用说明 创建BigInteger对象 传入字符串 3. 代码示例 import j…...

PAN/FPN

import torch import torch.nn as nn import torch.nn.functional as F import mathclass LowResQueryHighResKVAttention(nn.Module):"""方案 1: 低分辨率特征 (Query) 查询高分辨率特征 (Key, Value).输出分辨率与低分辨率输入相同。"""def __…...

Golang——6、指针和结构体

指针和结构体 1、指针1.1、指针地址和指针类型1.2、指针取值1.3、new和make 2、结构体2.1、type关键字的使用2.2、结构体的定义和初始化2.3、结构体方法和接收者2.4、给任意类型添加方法2.5、结构体的匿名字段2.6、嵌套结构体2.7、嵌套匿名结构体2.8、结构体的继承 3、结构体与…...

NPOI Excel用OLE对象的形式插入文件附件以及插入图片

static void Main(string[] args) {XlsWithObjData();Console.WriteLine("输出完成"); }static void XlsWithObjData() {// 创建工作簿和单元格,只有HSSFWorkbook,XSSFWorkbook不可以HSSFWorkbook workbook new HSSFWorkbook();HSSFSheet sheet (HSSFSheet)workboo…...