第四章 大模型辅助工作
概述
大模型辅助检索
大模型辅助办公
大模型辅助创作
讨论
目录
概述
大模型辅助检索
大模型辅助办公
大模型辅助创作
讨论
目录
大模型辅助检索
在使用大模型辅助检索的时候,你可以在对话框里将联网搜索这一功能打开,
现在很多大模型对话平台都具备该功能,大模型的联网搜索功能是指人工智能
模型能够访问互联网上的信息,以获取最新的数据、新闻、知识和其他相关内
容,并将这些浏览过的页面返回整合到其回答中。这种能力使得 AI 能够提供
更加准确、及时和丰富的信息。
可以发现,大模型能够
将浏览过的网页信息进
行整合,并将结果直观
地返回给用户。
大模型辅助检索:检索示例
1. 论文信息补全
传统检索获取论文的信息使得用户需要自己动手搜索和点击查找,大模型则提供了直接获取的能力,省
去了用户的精力和时间。
大模型辅助检索:检索示例
2. 需要多轮对话的连续检索
大模型的连续多轮对话能力,使其在客户服务、交互式学习和个性化问答中具有显著的优势;而传统搜
索每一轮查询都是独立的,无法形成连续性对话。
大模型辅助检索:检索示例
3. 实时信息查询
对于实时信息查询的场景,传统检索只能返回一些参考网页,用户需自行点击进行查看,而大模型可以
直接给出用户需要的答案。
大模型辅助检索:对比优势
大模型辅助检索优势如下:
• 语义理解能力更强:大模型能够理解用户的意图,而不仅仅是匹配关键
词。它可以在输入信息不完整或存在模糊时,依靠语义上下文进行推理,
提供相关的答案。
• 生成式回答和总结能力:大模型不仅能直接返回搜索结果,还能基于多
个来源的信息生成总结性回答,帮助用户快速理解复杂的信息。
• 多样化的交互方式:大模型能与用户进行连续对话,动态调整回答的内
容和深度,从而满足用户在多轮对话中的变化需求。
• 对模糊查询的处理能力:即使用户输入的查询不明确,大模型也能通过
上下文理解其背后的潜在意图,提供与之相关的解释或信息补充
大模型辅助检索:检索平台
联网搜索功能并不是大模型自带的,而是一个额外的集成工具。大模型本身(比如 Kimi一些
或其他 AI 模型)是通过预先训练的海量数据学习得来的知识,它在生成回答时并不实时访问
互联网。因此,它的知识是静态的,通常只覆盖到某个时间点。
联网搜索功能的引入,弥补了这一局限性。它通过与搜索引擎或其他在线资源接口集成,实
时获取最新的内容。这使得智能助手不仅能回答基于模型训练知识的问题,还能解决需要最
新数据或实时信息的问题,比如新闻事件、天气预报或当前流行趋势。总的来说,联网搜索
是嵌入大模型的一项功能,两者结合后,智能助手才具备实时查询和动态更新的能力。
大模型辅助检索:检索平台
具有联网搜索功能的平台
其中的一些平台是默认打开联网搜索功能的,如文心一言、通
义千问、腾讯元宝和 Grok,一些平台具有开关联网搜索的按钮,
一般在输入框下面即可看见一个“地球”的按钮,如深度求索、
Kimi、ChatGPT、Gemini。
可以自行开关联网搜索功能的平台:
Deepseek:
Kimi:
Chatgpt:
大模型辅助检索:检索平台
默认打开联网搜索功能的平台:
文心一言:
通义千问:
大模型辅助检索:检索平台
Grok
:
概述
大模型辅助检索
大模型辅助办公
大模型辅助创作
讨论
目录
大模型辅助办公
大模型辅助办公是指利用大规模预训练语言模型来提升办公效率和质量的工
具。它能够处理多种任务,主要包括:Word、PDF、Excel、PPT等办公场
景。大模型辅助办公通过自动化、智能化手段,显著提升工作效率和质量,
广泛应用于文档处理、沟通、数据分析等领域。
大模型辅助办公:Word
秘塔写作猫:
大模型辅助办公:Word
如点击“全文写作”功能,就会出现以下界面,当你填入文章标题后,选择自己想要的文章长
度、是否自动配图和摘要条数,AI 工具便会生成你想要的摘要、大纲以及文章内容。
大模型辅助办公:Word
例如,当填入“新时代中国特色社会主义事业课程报告”的标题后,便会生成如下的摘要:
大模型辅助办公:Word
点击下一步,便会生成该文章的大纲,读者可以直接编辑大纲或者改变大纲的条数,也可以选择不需
要大纲。
点击下一步,便会按照每一条大纲生成相应的文章主
体内容,若选择了不需要大纲,便会生成一篇连续的
文章内容。
大模型辅助办公:PDF
ChatPDF允许用户与任何 PDF 文档聊天、提出问题、获取摘要以及直接从内容中提取特
定信息。
大模型辅助办公:PDF
例如,我上传了一篇名为《A comprehensive Examination of the potentialapplication of
Chat GPT in Higher Education Institutions》的文章并在对话框中输入“这项研究的主要发
现是什么?
大模型辅助办公:PDF
如果你想查找某一章节中引用了哪些论文,并把它们整理出来,你可以在对话框中输入“
第一节 introduction 中引用了哪些论文,请帮我整理出来。
大模型辅助办公:PDF
如果你想在此文章上进一步研究,但又没有什么较好的思路,你可以在对话框中输入“基
于文章内容,还有哪些值得进一步研究的问题?”或者“文章中提到的研究还有哪些可以扩
展的方向?”
大模型辅助办公:PDF
如果你想知道该文章在实际生活中的应用与实践或具体实施方法,你可以在对话框中输入
“如何将文章中的理论应用到实际工作中?
大模型辅助办公:Excel
ChatExcel5是由北大团队开发的 AI 工具,主要用于处理 Excel 表格。它通过自然语言处理技术,用
户只需通过聊天的方式描述需求,ChatExcel 就能自动执行相应的 Excel 操作,包括数据分析、图表
生成、多表处理等功能。
大模型辅助办公:Excel
如果 excel 表格里面存在不想要的空白单元格,可以使用数据清洗功能以删除空白单元格:
大模型辅助办公:Excel
空白格删除前后对比:
大模型辅助办公:Excel
根据所输入的学生成绩表进行逻辑运算,比如有一个年级的学生成绩表,共 6 门科目,每个科目 100
分,满分 600 分,你想根据每个学生的总分成绩批注 ABCDEF 等不同等级,这时候你可以在对话框
里输入你想达到的目的:
大模型辅助办公:Excel
前后结果对比:
大模型辅助办公:Excel
要想知道某种数据的增长是否与时间存在相关性,可以用到 chatExcel 的相关性分析功能,这里用
2014-2023 年各省的年度生产总值作为例子:
大模型辅助办公:Excel
结果分析:
大模型辅助办公:Excel
若想可视化数据的变化,可以用到 ChatExcel 的图标生成功能,这里使用2018 年到 2023 年浙江、
山东、北京的数据,横轴为“省份”,“纵轴为 GDP增速”绘制折线图作为例子:
大模型辅助办公:Excel
生成的折线图如下:
大模型辅助办公:PPT
讯飞智文是由科大讯飞推出的一款基于人工智能技术的文档创作平台,用户可以通过输入主题或内容,
讯飞智文能够快速自动生成 PPT,支持一句话主题、长文本、音视频等多种输入方式。
大模型辅助办公:PPT
“一句话创建”——用户可以输入想要生成的 PPT 的主题,语言,是否需要配图,甚至可以添加演讲
配图和打开联网搜索功能。例如用户输入“帮我生成一个介绍北京故宫的 ppt”并点击确认。
大模型辅助办公:PPT
随后 AI 工具会生成该 ppt 的大纲,用户可以选择修改大纲或者保持不变。
大模型辅助办公:PPT
点击下一步后,用户选择需要的模板:
大模型辅助办公:PPT
点击开始生成,就可以得到一个完整的 ppt:
大模型辅助办公:PPT
“文本创建”——使得用户可以通过输入或粘贴文本到系统中,AI 将自动整理和提炼这些内容,生成相
关的标题和大纲,为后续的内容创作提供基础。
大模型辅助办公:PPT
“文档创建”——用户可上传多个文档作为主题,系统即可基于此一键生成 PPT 的标题和大纲,极大
地简化了文档创建的初始步骤。用户可以自由编辑自动生成的大纲,选择不同的主题风格,确保生成
的 PPT 既符合个人需求又具有专业外观。
大模型辅助办公:PPT
高级创建”——提供给用户海量的 PPT 模板,用户可以自定义模板,通过调整布局、字体和元素,从
而可以创建符合自己风格和需求的幻灯片模板,实现个性化展示。
概述
大模型辅助检索
大模型辅助办公
大模型辅助创作
讨论
目录
大模型辅助创作
大模型生成图片 大模型生成视频 大模型生成音乐
大模型在图像生成领
域的应用已经取得了显著
成果。通过输入文本描述,
模型能够生成高质量、多
样化的图像,涵盖从写实
风格到抽象艺术的多种表
现形式。这种技术不仅为
艺术家提供了新的创作工
具,也为设计、广告、游
戏等行业带来了革命性的
变化。
视频生成是大模型
应用的另一个重要领域。
通过结合文本、图像和
时序数据,大模型能够
生成连贯、生动的视频
内容。这种技术在影视
制作、广告宣传、教育
培训等领域具有广泛的
应用前景。
音乐生成是大模型
在创意领域的又一重要
应用。通过分析大量的
音乐数据,大模型能够
生成旋律、和声和节奏,
甚至可以模仿特定音乐
风格或作曲家的作品。
这种技术为音乐创作、
影视配乐和游戏音效提
供了新的可能性。
大模型辅助创作:图片生成
国内图片生成模型:
可灵AI():支持不同风格高清画作和不同画幅选择
即梦AI():生成高分辨率、细节丰富的图像
海螺AI():能生成表情丰富的人物或背景
无界AI():生成中国式多种风格的图片
国外图片生成模型:
Midjourney():生成的图像具有独特的艺术风格
DALL·E2(
Ideogram():支持多种图像风格和高质量的图片
大模型辅助创作:图片生成
即梦 AI 是字节跳动旗下剪映团队开发的一款 AI 创作工具和社区,得益于字节跳动在短视频平台上
的海量高质量数据支持,即梦 AI 在生成高质量的内容方面具有显著优势。
大模型辅助创作:图片生成
提示词
模型、图片参数
生成的图片
大模型辅助创作:视频生成
国内视频生成模型:
可灵AI():生成高品质的视频,短视频效果好
即梦AI():在短视频制作和广告创意方面表现出色
海螺AI():将文本信息有效地转化为生动的视频内容
无界AI():在广告、创意设计和社交媒体内容表现好
国外视频生成模型:
sora (
Runway ML ():支持视频生成、编辑和特效处理
Synthesia ():擅长通过文本生成带有虚拟人物的视频
大模型辅助创作:视频生成
海螺 AI 拥有目前 AI 视频领域中第一梯队的表情表现能力,能够根据情绪类提
示词输出多样且生动的表情,也能够便捷制作出影视级别的爆炸特效。
大模型辅助创作:文本生成视频
提示词
生成结果
大模型辅助创作:图片生成视频
原始图片
提示词
生成结果
大模型辅助创作:视频生成结果
文本生成视频结果 图片生成视频结果
大模型辅助创作:音乐生成
国内视频生成模型:
天谱乐():支持实时生成音乐,支持多种乐器的模拟
天 工 Sky-Music(
海绵音乐():支持情感驱动,自动调整音乐的节奏和风格
国外视频生成模型:
suno():支持个性化音乐生成,语音合成与音乐结合
AIVA():擅长生成古典音乐,支持情感驱动
大模型辅助创作:音乐生成
天谱乐是由趣丸科技旗下的唱鸭团队自主研发的全球首个多模态音乐生成大模型,与昆仑天工的SkyMusic、
字节旗下的海绵音乐,被看作“国产 AI 音乐三巨头”,天谱乐不仅支持传统的文本生音乐和音频生音乐,
还首创了图片或视频生音乐功能,允许用户上传图片或视频来生成音乐。
大模型辅助创作:文本生成音乐
开启专家模式
可自定义歌词
提示词
生成结果
大模型辅助创作:图片 /视频生成音乐
上传图片
或视频
生成结果
大模型辅助创作:音乐生成结果
文本生成音乐 图片生成音乐
概述
大模型辅助检索
大模型辅助办公
大模型辅助创作
讨论
目录
讨论
讨论:
分析集成大模型的办公工具如何改变传统办公方式,提高工作效率。
讨论:
分析AI创作的作品对人类情感的影响,并与人类作品进行对比。