首页 > 其他分享 >大模型学习成长五阶路径:自我评估,你正处于哪个阶段?

大模型学习成长五阶路径:自我评估,你正处于哪个阶段?

时间:2024-08-19 11:51:32浏览次数:14  
标签:五阶 模型 路径 自我 langchain 学习 AI 应用 推理

第一阶段 不知道概念

第一阶段,「不知道大模型是什么意思」,不知道langchain是什么,不知道llm是什么,不知道文心一言,不知道openAI,不知道prompt是什么?

这个阶段就是疯狂百度,像一只无头苍蝇,吸收各种概念,记住,只是概念,这个阶段会让自己开始接受AI大模型领域。

第二阶段 搭建模型走弯路

第二阶段,开始想着「怎么搭建大模型」,由于没有服务器,所以开始寻找怎么在本地搭建大模型。开始知道服务器上用GPU才能带的动大模型,本地如果要跑就要找CPU带动大模型。疯狂找!!

找啊找!!

内容非常杂,这期间出现国内大模型,国外大模型,国外的就需要科学上网。

这个阶段,依然不知道跑起一个大模型需要做什么工作,不知道需要选什么模型,不知道需要用什么大模型框架运行大模型。

其实一开始就找到了,需要用langchain来跑大模型,但是还需要用一个很坑很坑的东西:Anaconda,这玩意儿简直是个坑,这工具是为了给我们在windows上创建python环境,然后安装pytorch,下载几个G的大模型,然后安装依赖,搞了半天,搭起来了,但是对话的时候却报错了。

第三阶段 会用langchain调API,用上Agents和Tools

第三阶段,「回到langchain调用SDK或API,用上了Agents和Tools」,发现其实是在调API。

虽然在尝试搭建本地大模型的时候,搭建起了localAI+GPT4ALL,但是效果并不好,太慢了,而且不好拓展。

后来经过指点,打开langchain官网,开始了学习之路,用上了zhipuAI,还用了langchain的Tools和Agents,算是打开了新世界的大门吧。已经能够在控制台进行对话,并且能够运用工具,比如在本地新建一个文件,比如调用一个计算字符长度的工具,后来又加上Memory,实现上下文记忆功能,虽然说是langchain自带的Memory但是勉强能用。

基本上能达到下面的效果 :

prompt: 请帮我介绍一下电影《热辣滚烫》并写入文件中   ...生成文件成功   

本地就会生成一个文件 doc.txt,内容是《热辣滚烫》的电影介绍。

满满的成就感!!!

感受:

1、AI大模型的迭代非常快,因此不要在博客里找教程,真的走了不少弯路。

2、开头难,我们无非是大模型的使用者,不用畏惧,又不是让我们开发大模型,而是使用!!使用!!!

3、技术大部分都是国外的,可是我们的网络是封闭的,学习难度加大,信息不对等。

4、直接去官网学!!

第四阶段 在服务器上应用到实际业务

第四阶段,看到大神已经在整合各种大模型,并能够熟练训练成更加贴合自己的模型,整合到实际的业务场景中,并且实现多个模型进行同时回答,并且还有专门的校验模型,如果发现几个模型的答案不一致,给出提示,后续进行人工校正。

第五阶段 天花板

更大的大神,别人看不到的存在!

拓展

现在Java也已经有支持openAI的集成了,就是Spring-AI,不过目前只支持一些主流的大模型,比如openAI,对国内的大模型还不支持。另外还有Spring Cloud Alibaba AI正在发展中,大家可以关注一下。

大模型学习路线

大模型学习路线,大致是这样的:了解大模型的基本概念、选择合适的大模型、大模型的使用与部署、数据准备与预处理、模型推理与结果解析、实践应用与项目实战、持续学习与优化。

一、了解大模型的基本概念

大模型定义:明确大模型的定义和特性,了解大模型相较于传统模型的优势和挑战。

应用场景:研究大模型在不同领域的应用场景,如自然语言处理、计算机视觉、智能推荐等,为后续的实践应用提供指导。

二、选择合适的大模型

模型种类调研:了解目前主流的大模型种类,如BERT、GPT、ERNIE等,掌握它们的基本原理和适用场景。

需求分析:根据具体任务需求,分析所需模型的能力,如文本生成、语义理解、图像识别等。

模型对比与选择:对比不同大模型的性能、资源消耗、训练难度等因素,选择最适合当前任务的大模型。

三、大模型的使用与部署

模型下载与加载:从官方渠道或相关平台下载所需的大模型,并学习如何在代码中加载和使用这些模型。

API调用:了解并熟悉大模型提供的API接口,通过调用API实现模型的推理和预测功能。

模型部署:学习将大模型部署到实际环境中,如服务器、云平台等,以满足实际应用需求。

四、数据准备与预处理

数据集收集:根据任务需求收集合适的数据集,确保数据的质量和数量满足模型推理的要求。

数据预处理:学习并掌握数据预处理技术,如数据清洗、格式转换、特征提取等,以提高模型的推理效果。

五、模型推理与结果解析

模型推理:使用准备好的数据输入大模型进行推理,获取模型输出的结果。

结果解析:学习如何解析模型输出的结果,理解其含义和背后的逻辑,以便进行后续的应用和决策。

六、实践应用与项目实战

应用场景选择:结合兴趣和需求,选择具体的大模型应用场景进行实践,如文本分类、情感分析、图像识别等。

项目实战:将所学知识和技能应用于实际项目中,完成从数据准备、模型使用、推理结果解析到实际应用的全过程。通过实践,加深对大模型使用的理解和掌握。

七、持续学习与优化

跟踪最新技术:关注大模型领域的最新技术和研究成果,了解模型优化和性能提升的方法。

模型优化实践:尝试使用不同的优化策略和技术,如超参数调整、模型剪枝等,提高大模型的推理性能和效率。

经验总结与分享:总结在实际应用中遇到的问题和解决方案,与其他学习者分享经验和技巧,共同进步。

大模型现在正在风口上,一起学习进步吧!

零基础如何学习大模型 AI

领取方式在文末

为什么要学习大模型?

学习大模型课程的重要性在于它能够极大地促进个人在人工智能领域的专业发展。大模型技术,如自然语言处理和图像识别,正在推动着人工智能的新发展阶段。通过学习大模型课程,可以掌握设计和实现基于大模型的应用系统所需的基本原理和技术,从而提升自己在数据处理、分析和决策制定方面的能力。此外,大模型技术在多个行业中的应用日益增加,掌握这一技术将有助于提高就业竞争力,并为未来的创新创业提供坚实的基础。

大模型实际应用案例分享

①智能客服:某科技公司员工在学习了大模型课程后,成功开发了一套基于自然语言处理的大模型智能客服系统。该系统不仅提高了客户服务效率,还显著降低了人工成本。
②医疗影像分析:一位医学研究人员通过学习大模型课程,掌握了深度学习技术在医疗影像分析中的应用。他开发的算法能够准确识别肿瘤等病变,为医生提供了有力的诊断辅助。
③金融风险管理:一位金融分析师利用大模型课程中学到的知识,开发了一套信用评分模型。该模型帮助银行更准确地评估贷款申请者的信用风险,降低了不良贷款率。
④智能推荐系统:一位电商平台的工程师在学习大模型课程后,优化了平台的商品推荐算法。新算法提高了用户满意度和购买转化率,为公司带来了显著的增长。

这些案例表明,学习大模型课程不仅能够提升个人技能,还能为企业带来实际效益,推动行业创新发展。

学习资料领取

如果你对大模型感兴趣,可以看看我整合并且整理成了一份AI大模型资料包,需要的小伙伴文末免费领取哦,无偿分享!!!
vx扫描下方二维码即可
加上后会一个个给大家发

在这里插入图片描述

部分资料展示

一、 AI大模型学习路线图

整个学习分为7个阶段
在这里插入图片描述

二、AI大模型实战案例

涵盖AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,皆可用。
在这里插入图片描述

三、视频和书籍PDF合集

从入门到进阶这里都有,跟着老师学习事半功倍。
在这里插入图片描述

在这里插入图片描述

如果二维码失效,可以点击下方链接,一样的哦
【CSDN大礼包】最新AI大模型资源包,这里全都有!无偿分享!!!

标签:五阶,模型,路径,自我,langchain,学习,AI,应用,推理
From: https://blog.csdn.net/2401_85375186/article/details/141222665

相关文章

  • 代码随想录day34 || 62 不同路径,63 不同路径||,343整数拆分,96 不同搜索二叉树
    不同路径funcuniquePaths(mint,nint)int{ //dp五部曲 //dp数组以及下标的含义dp[i][j]代表从0,0走到i,j的不同路径条数 //递推公式 dp[i][j]=dp[i-1][j]+dp[i][j-1] //dp数组的初始化dp[i][0]==dp[0][j]=1 //遍历顺序 外层按照行,内层按照列遍历......
  • 传统园区转型升级智慧园区的路径探讨
    随着科技的快速发展和经济结构的转型升级,传统园区面临着转型的迫切需求。智慧园区以其高效、绿色、智能的特点,成为了未来园区发展的方向。本文将从几个关键方面探讨传统园区如何实现向智慧园区的转型升级。一、智慧园区的概念与特点智慧园区是基于物联网、大数据、云计算等新......
  • 数据分析师的自我修养
        方法论/经验论是一种工具价值,提升做事效率,而本文要分享的是价值论,一种终极价值。这部分内容本应该在第一篇文章中写,但是当时没有写这个的心境,因此趁现在心境在,抓紧写。也欢迎大家一起讨论,每个人在工作中体会总结的都是宝贵的。“满足业务的数据需求”是所有level......
  • 扫描切除-实体轮廓:方程式驱动曲线路径vs螺旋线路径
    最近,在使用solidworks2018的过程中,接触到扫描切除-实体轮廓命令,如图1-2所示。此命令可以使用一个实体来切除另一个实体,用来切除的实体可以按一定的轨迹运动。测试过程中发现,这个命令频繁出错,切除失败,体验实在是太差了。下面对比了在该命令下使用方程式驱动曲线和螺旋线命令构建......
  • 浏览器解析html文件src静态资源路径问题
    相对路径src资源引号内部不以/分割符开头,浏览器从当html文件前路径拼接url:场景a<imgsrc="static/1.jpeg"width="258"height="39"/>当前请求地址xxxx:80/html/1.html浏览器解析图片地址为xxxx:80/html/static/1.jpeg场景b<imgsrc="../static/1.jpeg"width="......
  • 结合isis、ospf、路由策略的实验;直连引入ospf中,解决路由环路以及次优路径问题
    192.168.1.1:缩写为192第一步:把直连引入ospf中[R5]ipip-prefixdirectindex10permit192.168.1.132[R5]route-policydirect1permitnode10[R5-route-policy]if-matchip-prefixdirect[R5-ospf-1]import-routedirectroute-policydirect1结果:R2或者R3的......
  • 西门子精致面板TP1200 历史数据(历史数据、审计追踪) 移存到网络路径
    1.网络共享1.1Window功能SMB安装1.2.共享文件夹1.3.触摸屏端需要设置电脑的用户、密码、网络信息2.如何安全移动归档数据---------------------------------------------------------------------------------------------------------------------------------如......
  • 以node / link文件表征的道路网络-----dijkstra算法yyds-----基于南京公路公开数据做
    前文已经基于公开数据,获得了南京的全域高速公路的路网数据,这些以node/link文件表征的道路网络不仅延续了osm地图中所包含的经纬度、名称、容量等信息,还包含了一个重要的道路等级字段“link_type_name”。交通部门一般以高速公路、国省干道、城市道路、乡道农路作为区分......
  • c语言计算二叉树的带权路径长度之和(WPL)
    1.WPL:树中全部叶节点的带权路径之和2.代码中所画的树为:3.求上述WPL:WPL=0*1+1*2+1*3+2*4+2*5=234.主要代码为:intwpl(Node*ROOT,inthigh){ intn=0; if(ROOT!=NULL){ n=ROOT->weight*high; n=n+wpl(ROOT->lchild,high+1); n=n+wpl(ROOT->rchild,high+1); } r......
  • Java中的图算法:如何实现高效的最短路径计算
    Java中的图算法:如何实现高效的最短路径计算大家好,我是微赚淘客系统3.0的小编,是个冬天不穿秋裤,天冷也要风度的程序猿!作为开头。最短路径算法是图论中的一个核心问题,广泛应用于网络路由、地图导航等领域。在Java中实现高效的最短路径计算通常涉及到Dijkstra算法和Floy......