大家好,今天的话开始学习AI运维。还是继续听黑马程序员的课程:BiliBili,我有点基础了,博客内容不会和视频授课内容一样。还请大家原谅
一、IT运维基础概念
IT运维一共分为这六个方向:

总结:

六个运维的方向都是围绕着:部署、监控、告警、故障快速恢复来展开
二、软件开发流程与三大环境
1、软件开发流程

项目的上线到后期运行,维护工作,都是由运维工程师完成的
2、三大环境

我们运维工程师一定要保障生产环境正常运行
总结:

三、工单系统
什么是工单系统?


总结:

四、网络通信的“三要素”
什么叫做网络通信,网络通信是指在不同设备间通过网络连接进行数据传输与交换的过程。
下面是主要的三要素:
1、协议

2、IP

3、端口

总结

五、常见的操作系统

六、Linux操作系统介绍




总结:

七、云服务器基本介绍

就是一台服务器可以开多少虚拟机,虚拟机需要多少资源 就给多少资源

总结:

八、Linux目录结构


总结:

九、基础命令

1、基本导航命令
之前有做过教程,这边就大概快速跳过一下,老文章:本站
1️⃣定位与查看

2️⃣切换与目录结构

2、目录管理命令
1️⃣删减目录

总结:

3、文件操作命令
1️⃣文件操作命令

总结:

4、文件查找命令

总结:

5、文件操作和查找综合命令

首先的话 先创建文件夹:

然后找一下三天前的文件,并复制到指定目录:
find /var/logs/app -mtime +3 -type f -exec cp {} /home/old_logs/ \;接下来删除五天前的日志文件:
find /var/logs/app -mtime +5 -type f -exec rm -rf {} \;6、文件编辑命令

1️⃣打开文件

2️⃣三种工作模式

命令模式:

插入模式(编辑模式):

底行模式:

然后还有一个:x和:wq的一个区别:

总结:

3️⃣常见错误

7、文件查看命令
1️⃣文件查看命令

总结:

2️⃣文件解压缩


总结:

十、运维部署上线
1、项目介绍


原型的访问地址:https://codesign.qq.com/s/459277624064324 密码:FSTI
总结:

2、项目部署架构及节点规划

节点规划:

不过一般就一个节点就差不多了,我们只是测试学习而已
总结:

3、项目各节点初始化
黑马是去阿里云直接买三台服务器 有点奢侈了,可以自己本地直接开虚拟机来搞。

总结:

4、MySQL数据库部署
这边黑马是教部署MySQL的,但是我个人比较倾向于MariaDB。本站有教程,可以去看看(虽然文章也有一段时间了):https://blog.mclzyun.com/2025/01/23/1039

这是黑马程序员给的一个安装教程:飞书
总结:

5、项目业务基础数据导入
搭建好数据库之后就需要导入数据,课程资料:百度云盘 密码1234

接下来就是导入sql文件到数据库

如果会用导航猫(navicat)的话,可以直接连接数据库后直接导入。基于图形化页面操作确实简单很多。

6、Redis部署
黑马程序员依旧丢了一个教程链接:飞书

总结:

7、阿里云对象OSS存储开通

以下是操作流程:

直达链接:https://www.aliyun.com/product/oss

或者直接进入OSS控制台:https://oss.console.aliyun.com/overview
创建桶:

将桶设置为公有访问:

生成accessKey,授权访问OSS服务:




这样的话就搞定了,上总结:

8、项目接入阿里云OSS
还是刚刚那个百度云盘,现下载项目后端。

修改这个文件,填入对应的信息:

9、开通百度千帆大模型授权

百度千帆主页面:点击跳转


直达链接创建Key:https://console.bce.baidu.com/iam/#/iam/accesslist
保存下生成的Key。然后上总结:

把刚刚的Key给填进配置文件:

10、项目后端部署
后端部署之前呢,首先我们要先配置一下 MySQL和Redis的链接信息

IP地址更改成你签名部署MySQL和Redis的服务器地址(如果是本地的话就改成127.0.0.1)
然后填写正确的用户名和密码。之后保存配置文件,拖回Jar包里。

接下来的话我们就要开始正式配置后端环境了。看见Jar包,你能联想到的是Java环境。这边黑马给大家贴了一个教程:飞书
Java环境配置完 输入以下命令就可以启动后端了:
java -jar zzyl-admin.jar
但是你会发现一个问题,就是你退出SSH会话后这个后端程序就会崩溃。怎么处理?

黑马推荐了个screen的命令,但是的话我个人比较喜欢 zellij,之前的教程也有提过:直接Ctrl+F搜索Zellij就行了
总结:

11、Nginx组件部署



关于如何安装 Nginx,黑马程序员还是丢了个教程:飞书
总结:

12、前端服务部署实施







总结:

我直接贴一下改完的配置文件:
user nginx;
worker_processes auto;
error_log /var/log/nginx/error.log;
pid /run/nginx.pid;
# Load dynamic modules. See /usr/share/doc/nginx/README.dynamic.
include /usr/share/nginx/modules/*.conf;
events {
worker_connections 1024;
}
http {
log_format main '$remote_addr - $remote_user [$time_local] "$request" '
'$status $body_bytes_sent "$http_referer" '
'"$http_user_agent" "$http_x_forwarded_for"';
access_log /var/log/nginx/access.log main;
sendfile on;
tcp_nopush on;
tcp_nodelay on;
keepalive_timeout 65;
types_hash_max_size 4096;
include /etc/nginx/mime.types;
default_type application/octet-stream;
include /etc/nginx/conf.d/*.conf;
# 在HTTP的目录下, 添加以下三个add_header CORS 配置
# 这几行配置用于设置 跨域资源共享(CORS),它们在 Nginx 中用来允许其他域名访问你的资源。CORS 是一种机制,允许通过浏览器发起跨域 HTTP 请求,常用于 Web 应用与不同域名的 API 交互时,解决浏览器的同源策略限制。
add_header Access-Control-Allow-Origin *;
add_header Access-Control-Allow-Methods "GET, POST, OPTIONS, PUT, DELETE";
add_header Access-Control-Allow-Headers "Origin, X-Requested-With, Content-Type, Accept, Authorization";
server {
listen 80;
listen [::]:80;
# 这些配置项与 Nginx 处理客户端请求的请求体大小、请求头缓冲区等相关,主要用于控制 Nginx 在处理上传文件、请求体内容和请求头时的行为
client_max_body_size 60m; # 限制客户端请求体的最大大小。
client_body_buffer_size 512k; # 设置 Nginx 用于缓冲客户端请求体的内存大小。
client_header_buffer_size 2k; # 设置 Nginx 用于缓冲请求头的内存大小。
# Load configuration files for the default server block.
include /etc/nginx/default.d/*.conf;
error_page 404 /404.html;
location = /404.html {
}
error_page 500 502 503 504 /50x.html;
location = /50x.html {
}
# 处理 静态页面
location / {
root /var/www/dist;
index index.html index.htm;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
try_files $uri $uri/ /index.html;
}
# 处理反向代理
location /prod-api/ {
proxy_pass http://127.0.0.1:9000/;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
}
}
}
十一、智能客服私有化大模型部署
1、介绍
我们主要想做的是什么呢?

就像我们小程序这边可以咨询客服,但是我们打算接入大模型来进行对话,就像DeepSeek 啊 之类的。前端展示给客户,我们只需要在后端设置好大模型即可。

这个服务器哪里来呢,黑马主要让我们去阿里云去申领一台GPU服务器来进行部署大模型。



2、安装GPU驱动


驱动下载地址:https://developer.nvidia.com/cuda-downloads




3、基础环境安装



4、模型部署上线与测试





十二、运维监控告警
1、介绍与开通

不过黑马要开通的是阿里云的云监控:


如果你找不到页面,也可以通过我给的URL进入:https://cloudmonitornext.console.aliyun.com/newOverview
总结:

2、如何开通云主机监控策略

3、系统报警服务配置







不过这种监控类的,市面上也有很多可以自行部署的产品,比如说:ServerStatus、Nezha、Komari、UpTime等,甚至本站都有相关教程哦!感兴趣的可以去看看
总结:

4、系统运维常见问题
1️⃣CPU负载

htop的相关教程,或者其他运维工具的教程都在博客体现出来了:https://blog.mclzyun.com/2025/12/14/2829

2️⃣内存爆满


总结:

5、ECS服务器巡检报告介绍

总结:

6、云服务器监控可视化大屏






好长的一篇文章啊
![image]()
查看图片
细细一读,都是水分
