版权声明
感谢您下载平台上提供的PPT作品,为了您和熊猫办公以及原创作者的利益,请勿复制、传播、销售,否则将承担法律责任!熊猫办公将对作品进行维权,按照传播下载次数进行十倍的索取赔偿!
1.在熊猫办公出售的PPT模板是免版税类(RF:Royalty-Free)正版受《中国人民共和国著作法》和《世界版权公约》的保护,作品的所有权、版权和著作权归熊猫办公所有,您下载的是PPT模板素材的使用权。
2.不得将熊猫办公的PPT模板、PPT 素材,本身用于再出售,或者出租、出借、转让、分销、发布或者作为礼物供他人使用,不得转授权、出卖、转让本协议或者本协议中的权利。
DeepSeek赋能数据分析
日期:2025年3月20日
武艳军
1 DeepSeek大模型初步
2 DeepSeek本地部署
3
使用DeepSeek+提示词
进行数据处理
目录
C
O
M
E
N
T
S
4
使用DeepSeek+Excel
进行数据处理
版权声明
感谢您下载平台上提供的PPT作品,为了您和熊猫办公以及原创作者的利益,请勿复制、传播、销售,否则将承担法律责任!熊猫办公将对作品进行维权,按照传播下载次数进行十倍的索取赔偿!
1.在熊猫办公出售的PPT模板是免版税类(RF:Royalty-Free)正版受《中国人民共和国著作法》和《世界版权公约》的保护,作品的所有权、版权和著作权归熊猫办公所有,您下载的是PPT模板素材的使用权。
2.不得将熊猫办公的PPT模板、PPT 素材,本身用于再出售,或者出租、出借、转让、分销、发布或者作为礼物供他人使用,不得转授权、出卖、转让本协议或者本协议中的权利。
01
DeepSeek大模型初步
大语言模型LLM引发AI新热潮
大语言模型(Large Language Mode,LLM),也称预训练模型(Pre-Trained Model,PTM),是一种人工智能模型,旨在理
解和生成人类语言。它们在大量的文本数据上进行训练,拥有几十亿的参数,可执行广泛的任务,包括文本总结、翻译、情感分析
等等。
通用人工智能AGI技术发展趋势
Chatbot
• 自然语言对话
Reasoner
• 基本的推理和
问题解决能力
Agent
• 代表用户执行基
本任务,具备自
主行动能力
Innovator
• 参与发明和创造,
增强人类的创造
力和创新能力
Organization
• 承担整个组织的
功能,独立管理
并执行复杂的操
作
Sam Altman:AGI发展的五个阶段
当前处于推理者阶段,正在向智能体阶段发展
DeepSeek R1推理模型开辟了中国低成本开源路径,引爆市场
生成模型 推理模型
• DeepSeek R1
• OpenAI o1
• OpenAI o3-mini
• Gemini
• Grok3
• Kimi
• OpenAI GPT4o
• DeepSeek V3
• BERT
• Gemini
•
• 自动驾驶机器人
(当前L3)
• 具身智能机器人
• Manus
• MetaGPT
智能体
DeepSeek公司
DeepSeek,全称杭州深度求索人工智能基础技术研究有限公司。DeepSeek是一家
创新型科技公司,成立于2023年7月17日,使用数据蒸馏技术,得到更为精炼、有用
的数据。由知名私募巨头幻方量化孕育而生,专注于开发先进的大语言模型(LLM)
和相关技术。
DeepSeek:来自东方的神秘力量
• 2015年,幻方量化正式成立。2016年,幻方量化推出第一个AI模型,实现了所有量化策略的AI化转型。
2019年,其资金管理规模突破百亿元。2020年开始,幻方的AI超级计算机“萤火一号”正式投入运作。
2021年,幻方投入十亿建设“萤火二号”,搭载了一万张英伟达A100显卡,资产管理规模突破1000亿元。
• 2023年7月,幻方量化宣布成立大模型公司DeepSeek,正式进军通用人工智能领域。2024年5月,
DeepSeek发布了DeepSeek-V2;同年12月27日,DeepSeek-V3面世。这款性能优越且性价比极高的大语
言模型,被硅谷同行誉为“来自东方的神秘力量”。
• 2025年1月20日,DeepSeek正式发布DeepSeek-R1模型;同日,梁文锋参加了总理座谈会。2月17日,
梁文锋参加了总书记主持的民营企业家座谈会。梁文锋凭借约1260亿美元(约合人民币9000亿元)的个人
财富估值问鼎中国首富。
• 梁文锋,男,1985年出生,广东省湛江市吴川市覃巴镇米历
岭村人,浙江大学毕业,拥有信息与电子工程学系学士和硕
士学位,杭州幻方科技有限公司、DeepSeek创始人。
• 2008年起,梁文锋开始带领团队使用机器学习等技术探索全
自动量化交易,在七年当中资金规模从8万元增长到5亿元。
DeepSeek大模型发展历程
DeepSeek成
立
2023年7月
2024年1月
2024年5月
2024年9月 2024年12月 2025年2月
2024年11月 2025年1月
发布首个大模
型DeepSeek
LLM
宣布开源第二代
MOE大模型
DeepSeek V2
推理模型
DeepSeek R1-
Lite预览版上线
正式发布
DeepSeek R1模型,
在大模型排名
Arena中列第三名
推出DeepSeek
DeepSeek V3
发布,并同步
开源模型权重
DeepSeek开
源GEMM等核
心代码
DeepSeek 7天实现1亿用户,成为增长最快的超级产品
DeepSeek大火的原因:核心能力突破、开源、超低成本、国产化
DeepSeek大模型核心技术突破,实现复杂推理任务的精准
处理与高效执行,覆盖多模态场景应用。模型综合性能跃
居世界第一梯队,技术指标与顶尖大模型相比不相上下。
• DeepSeek V3可以对标GPT-4o,但训练成本只有558万
美元,不到后者的二十分之一。
• DeepSeek R1在数据、代码和推理任务上课对标
OpenAI o1。
相比于OpenAI的闭源策略,
DeepSeek全量开源训练代码、数据
清洗工具及微调框架,开发者可以快
速构建教育、金融、医疗等垂直领域
应用,推动协同创新。
开展大量模型架构优化和系统工程优
化,训练成本显著低于行业同类模型,
打破高价壁垒;推理成本降低83%,
API定价为行业平均价格的1/10,千
亿参数模型适配中小企业需求,加速
商业化落地。
将国产模型与美国的代际差距从3-5年
缩短至3-5个月,突破卡脖子技术瓶颈,
全面支持国内产业智能化升级。
核心能力突破
开源 超低成本 国产化
DeepSeek通过核心能力突破+开源、低成本、国产化三大优势,推动AI技术平权和国产AI生态繁荣,成功
进入全球大模型第一梯队,促使行业从唯规模论向性价比、高效能、工程化方向转变。
版权声明
感谢您下载平台上提供的PPT作品,为了您和熊猫办公以及原创作者的利益,请勿复制、传播、销售,否则将承担法律责任!熊猫办公将对作品进行维权,按照传播下载次数进行十倍的索取赔偿!
1.在熊猫办公出售的PPT模板是免版税类(RF:Royalty-Free)正版受《中国人民共和国著作法》和《世界版权公约》的保护,作品的所有权、版权和著作权归熊猫办公所有,您下载的是PPT模板素材的使用权。
2.不得将熊猫办公的PPT模板、PPT 素材,本身用于再出售,或者出租、出借、转让、分销、发布或者作为礼物供他人使用,不得转授权、出卖、转让本协议或者本协议中的权利。
02
DeepSeek使用
方式
DeepSeek使用方式
API调用
API调用:DeepSeek、硅
基流动、阿里百炼、火山引
擎等。获取API秘钥调用,
适合开发者集成。
直接使用
• 电脑端访问官网
(
)或第三方百度
搜索、腾讯元宝等
• 手机端下载DeepSeek
App
本地部署
个人部署:个人在本地设备
运行应用,依赖自身资源。
企业部署:企业内网搭建私
有化系统,支持多用户协作,
数据更加安全。
一体机:直接购买部署了
DeepSeek模型的具备一定
算力的一体机。
DeepSeek私有化部署
大模型私有化部署方式:
• Ollama部署:个人本地部署,方便快速,适用于蒸馏模型
• vLLM部署:生产、开发、垂直领域私有化部署,精度可控,更专业
• 其他
推理模型 基座模型 特点
蒸馏模型,能力稍弱
实际上是增加了推理能力的Qwen模型和
Llama模型
DeepSeek-R1-Distill-Qwen-7B -Math-7B
DeepSeek-R1-Distill-Llama-8B -8B
DeepSeek-R1-Distill-Qwen-14B -14B
DeepSeek-R1-Distill-Qwen-32B -32B
DeepSeek-R1-Distill-Llama-70B -70B-Intruct
DeepSeek-R1-671B DeepSeek-V3-Base 满血版,能力最强
硬件配置最低要求
模型简称 CPU要求 内存要求 GPU要求 硬盘空间 适用场景
4核(Intel/AMD) 8GB
无(纯CPU)或
2GB(GPU加速)
3GB+ 旧笔记本电脑,简单文本生成
7B 4核(多线程支持) 16GB 4GB 8GB+ 本地开发测试,轻量级NLP任务
8B 6核 16GB 6GB 8GB+ 代码生成,逻辑推理
14B 8核 32GB 8GB 15GB+ 企业级文本分析,长文本生成
32B 12核 48GB 16GB 19GB+ 复杂场景对话,深度思考任务
70B 16核(服务器级) 64GB 24GB(多卡) 70GB+ 创意写作、算法设计
671B 32核(服务器集群) 128GB 80GB(4张A100) 300GB+ 科研级任务,AGI探索
最低配置指模型可以运行,但流畅度稍差。
硬件配置推荐要求
模型简称 CPU要求 内存要求 GPU要求 硬盘空间 适用场景
6核(现代多核) 16GB 4GB(如GTX1650) 5GB+ 实时聊天机器人、物联网设备
7B 8核(现代多核) 32GB 8GB(如RTX3070) 10GB+ 文本摘要、多轮对话系统
8B 10核(多线程) 32GB 10GB 12GB+ 高精度轻量级任务
14B 12核 64GB 16GB(如RTX4090) 20GB+ 合同分析、论文辅助写作
32B 16核(如i9/Ryzen
9)
128GB 24GB(如RTX4090) 30GB+ 法律/医疗咨询、多模态预处理
70B 32核(服务器级) 256GB 40GB(如2张A100) 100GB+ 金融预测、大规模数据分析
671B 64核(服务器集群) 512GB 160GB(8张A100) 500GB+ 国家级AI研究、气候建模
推荐配置指模型可以流畅运行。
个人推荐使用方式
1. 入门级:直接使用方式对于个人来说最为方便,需要联网。
2. 进阶级:个人可以在本地部署小规模蒸馏模型,比如、7B,建议使用Ollama来部署。
3. 进阶级:个人可以在部分工具(比如Excel)中调用API。
版权声明
感谢您下载平台上提供的PPT作品,为了您和熊猫办公以及原创作者的利益,请勿复制、传播、销售,否则将承担法律责任!熊猫办公将对作品进行维权,按照传播下载次数进行十倍的索取赔偿!
1.在熊猫办公出售的PPT模板是免版税类(RF:Royalty-Free)正版受《中国人民共和国著作法》和《世界版权公约》的保护,作品的所有权、版权和著作权归熊猫办公所有,您下载的是PPT模板素材的使用权。
2.不得将熊猫办公的PPT模板、PPT 素材,本身用于再出售,或者出租、出借、转让、分销、发布或者作为礼物供他人使用,不得转授权、出卖、转让本协议或者本协议中的权利。
03
使用DeepSeek+提示
词进行数据处理
DeepSeek提示词技巧:通用公式
任务 背景
目标 负面限定
M1 M2
M4 M3
做什么
给谁用
期望效果 担心的问题
内心戏很多
DeepSeek提示词技巧:通用公式
我要做XXX,要给XXX用,希望达到XXX效果,但担心XXX问题
例如:我要做一个山东三日游攻略,给大学生用,希望行程充实有趣,但担心预算不够影响体验。
深
度
思
考
正
式
回
答
DeepSeek赋能数据分析过程
问题
定义
数据
收集
数据
预处理
数据
分析
数据
可视化
报告
撰写
01 02 03 04 05 06
• DeepSeek提供强大的
数据诊断功能,帮助用
户识别缺失值、异常值
和重复数据等问题,提
供数据质量报告。
• DeepSeek可以开展标
准化、归一化处理,自
动填充缺失值和标注关
键变量影响因子。
• DeepSeek可以帮助用
户快速收集和处理大量
数据,生成数据提取脚
本,支持从各种来源导
入数据,包括Excel文
件等
• DeepSeek 提供了丰富的
统计分析功能,包括描述
性统计、回归分析、聚类
分析等。用户只需输入相
关数据,DeepSeek 即可
自动进行分析,并生成详
细的统计报告
• 用户可以将DeepSeek
的分析结果与Power
BI等工具结合,进行数
据可视化,从而更直观
地展示分析结果
• 自动生成专业的分析报
告。报告中包含数据概
览、分析结果、可视化
图表等
DeepSeek赋能数据分析的四种方式
提示词工程
Excel、
PowerBI
嵌入DS模型
Data Agent
ChatBI
场景1:数据清洗
核心价值:清洗耗时从3小时→1分钟,准确率100%
。
核心痛点:用户行为日志中30%字段缺失,且存在异常值,例如:异常时间戳(如:2999-01-01)。
传统方式:手动写Python逐行排查,耗时易错。
DeepSeek操作
步骤一:输入提示词。
请修复以下数据的质量问题:
1.缺失值:用前向填充补全user_id, device_type用“未知”填充
2.异常值:删除timestamp超过当前时间的数据行
3.格式统一:将price从字符串“$”转为数值“”
步骤二:生成代码。
# DeepSeek生成代码
df['user_id'].fillna(method='ffill', inplace=True)
df['device_type'].fillna('未知', inplace=True)
df = df[df['timestamp'] <= ()]
df['price'] = df['price'].('$', '').astype(float)
场景2:数据分析洞察
DeepSeek操作
步骤一:上传数据集。包含流量、转化率、客单价等指标。
步骤二:提出问题。“请分析GMV下降的核心因素,并量化贡献度”。
步骤三:输出结果。
案例说明:某电商Q2销售额环比下降15%,业务方归咎「流量不足」。
核心价值:避免被错误归因,节省1-2天手动拆解时间。
根本原因:转化率从%下降到%(贡献下降70%)
细分洞察:
- 搜索页->详情页流失率上升25%(页面加载时长增加3秒)
- 加购->支付失败率上升18%(因优惠券校验接口超时)
为什么你的提问总得不到答案?
数据分析DeepSeek提问技巧
1.问题要具体:女装9月销售额同比下跌37%的核心动因是什么?
2.提供数据要具体完整:周维度经营数据、竞品活动日历、行业大盘
3.明确数据计算方法:要求用三层归因模型+贝叶斯验证+库存衰减曲线分析
DeepSeek提问正确公式
DeepSeek提问错误示范:“分析下销售数据”——AI会陷入迷茫
该提问违反了AI分析三要素:
目标不明确:未说明是诊断问题/预测趋势/制定策略
范围缺失:无时间范围、品类限定、指标定义
方法模糊:未指定分析框架或验证标准
场景3:数据可视化
核心需求:向管理层展示各地区销售占比及趋势。
DeepSeek操作
步骤一:输入指令。
步骤二:输出结果。
用渐变红色系绘制:
- 饼图显示华东/华南/华北占比
- 折线图叠加显示近12个月增长率
- 标注华东Q4异常值情况(疫情封控)
输出Matplotlib代码,执行
版权声明
感谢您下载平台上提供的PPT作品,为了您和熊猫办公以及原创作者的利益,请勿复制、传播、销售,否则将承担法律责任!熊猫办公将对作品进行维权,按照传播下载次数进行十倍的索取赔偿!
1.在熊猫办公出售的PPT模板是免版税类(RF:Royalty-Free)正版受《中国人民共和国著作法》和《世界版权公约》的保护,作品的所有权、版权和著作权归熊猫办公所有,您下载的是PPT模板素材的使用权。
2.不得将熊猫办公的PPT模板、PPT 素材,本身用于再出售,或者出租、出借、转让、分销、发布或者作为礼物供他人使用,不得转授权、出卖、转让本协议或者本协议中的权利。
04
使用DeepSeek+Excel
进行数据处理
ChatExcel:在线完成Excel表格和数据处理
ChatExcel(北大团队开发),用简单的对话聊天交互来完成Excel表格和数据的处理
官网:
在Excel中安装OfficeAI插件
OfficeAI插件访问 OfficeAI官网 → 下载对应版本(支持Office 2016及以上)
双击安装包 → 勾选“我接受协议” → 安装路径保持默认 → 完成
重启Excel → 顶部菜单栏出现 “OfficeAI” 按钮
请计算销售额环比百分比并更新到F列
请计算销售额的中位数
请计算客单价的中位数
幻灯片 1
幻灯片 2
幻灯片 3
幻灯片 4
幻灯片 5: 大语言模型LLM引发AI新热潮
幻灯片 6: 通用人工智能AGI技术发展趋势
幻灯片 7: DeepSeek公司
幻灯片 8: DeepSeek:来自东方的神秘力量
幻灯片 9: DeepSeek大模型发展历程
幻灯片 10: DeepSeek 7天实现1亿用户,成为增长最快的超级产品
幻灯片 11: DeepSeek大火的原因:核心能力突破、开源、超低成本、国产化
幻灯片 12
幻灯片 13: DeepSeek使用方式
幻灯片 14: DeepSeek私有化部署
幻灯片 15: 硬件配置最低要求
幻灯片 16: 硬件配置推荐要求
幻灯片 17: 个人推荐使用方式
幻灯片 18
幻灯片 19: DeepSeek提示词技巧:通用公式
幻灯片 20: DeepSeek提示词技巧:通用公式
幻灯片 21: DeepSeek赋能数据分析过程
幻灯片 22: DeepSeek赋能数据分析的四种方式
幻灯片 23: 场景1:数据清洗
幻灯片 24: 场景2:数据分析洞察
幻灯片 25: 数据分析DeepSeek提问技巧
幻灯片 26: 场景3:数据可视化
幻灯片 27
幻灯片 28: ChatExcel:在线完成Excel表格和数据处理
幻灯片 29: 在Excel中安装OfficeAI插件
幻灯片 30