AI大模型与数学 第3课:极限定义、极限四则运算法则
极限是微积分的根基而微积分是AI模型训练反向传播、梯度、优化器的底层数学工具。大模型训练本质是无限迭代逼近最优权重这个“无限逼近”的数学描述就是极限。一、极限核心定义当自变量 x 无限靠近某个数值 x_0或无限趋向无穷大函数 f(x) 的取值会无限稳定贴近一个固定常数 A这个常数 A 就叫做函数 f(x) 在该点的极限。记作\lim_{x \to x_0} f(x) A严格数学ε-δ定义标准高数严谨表述若对于任意给定的正数 \varepsilon无论多小总存在正数 \delta使得当 0|x-x_0|\delta 时恒有 |f(x)-A|\varepsilon则称 A 为 x \to x_0 时 f(x) 的极限。拆解人话\varepsilon允许的误差范围可以无限缩小\delta自变量距离目标值的控制范围核心逻辑只要把自变量控制得足够靠近目标点函数值的误差能做到任意小。面包厂类比x烘烤时间f(x)面包熟度x_0标准烘烤时长A完美熟度不断微调烘烤时长无限靠近标准时间面包口感会无限接近完美状态完美熟度A就是极限。永远无法绝对100%完全标准但能无限接近。人事岗位类比x员工培训次数f(x)员工岗位匹配分数x_0无穷次培训A员工理论最优适配分数持续迭代培训员工匹配分数会无限贴近理论最优值却很难百分百达到完美最优分数就是极限。AI大模型对应场景模型反复迭代训练梯度下降损失函数的值会无限逼近0\lim_{epoch \to \infty} Loss0权重参数无限逼近全局最优解整个训练过程就是求极限的过程。两种极限分类定点极限x \to x_0自变量趋近某固定数字无穷极限x \to \infty自变量无限变大/变小模型训练轮次、海量数据都属于这类二、极限四则运算法则设 \lim f(x)A\lim g(x)B全部极限存在满足以下四条运算法则加法法则\lim\left[f(x)g(x)\right]AB类比员工两项技能分数叠加极限等于两项最优分数相加AI作用网络多层特征叠加、残差连接减法法则\lim\left[f(x)-g(x)\right]A-B类比员工现有能力减去岗位差距得到待提升空间AI作用损失函数计算预测值与真实标签偏差乘法法则\lim\left[f(x) \cdot g(x)\right]A \cdot B类比岗位重要权重 × 员工对应技能分数匹配度相乘放大AI作用注意力机制向量内积、权重特征融合除法法则附加条件B≠0\lim\left[\frac{f(x)}{g(x)}\right]\frac{A}{B}类比各项能力标准化消除数值尺度差异AI作用向量归一化、Softmax概率计算补充推论常数倍极限\lim\left[k\cdot f(x)\right]k\cdot A \quad(k为常数)类比统一缩放全员考核分数AI中学习率缩放梯度数值关键使用前提参与四则运算的两个函数极限必须都存在否则四则法则不能直接套用。举例\lim\limits_{x \to \infty}x 极限不存在不能直接拆分做加减乘除。三、极限在AI领域核心作用总结导数由极限定义f’(x)\lim\limits_{\Delta x \to 0}\frac{f(x\Delta x)-f(x)}{\Delta x}无极限则无导数无导数则无法反向传播训练模型梯度下降迭代收敛无限轮训练后损失趋近0依靠极限描述收敛特性归一化、概率变换、注意力打分全部依赖极限四则运算化简无穷维高维向量空间大模型词向量使用无穷极限描述特征空间。四、20道基础极限计算题分层难度适合课后练习基础代入型1-8题\lim\limits_{x \to 1} (2x3)\lim\limits_{x \to 2} (x^2-5x1)\lim\limits_{x \to 0} (x^32x-7)\lim\limits_{x \to 3} \frac{x1}{x-2}\lim\limits_{x \to -1} (4x^2-x)\lim\limits_{x \to 4} \frac{2x}{x3}\lim\limits_{x \to 0} (3x^25)\lim\limits_{x \to 5} (x-1)(x2)因式分解消零型9-14题\lim\limits_{x \to 1}\frac{x^2-1}{x-1}\lim\limits_{x \to 2}\frac{x^2-4}{x-2}\lim\limits_{x \to -3}\frac{x^22x-3}{x3}\lim\limits_{x \to 0}\frac{x^23x}{x}\lim\limits_{x \to 4}\frac{x^2-6x8}{x-4}\lim\limits_{x \to 1}\frac{x^3-1}{x-1}无穷远极限15-20题\lim\limits_{x \to \infty}\frac{2x1}{3x-2}\lim\limits_{x \to \infty}\frac{x21}{2x2-x}\lim\limits_{x \to \infty}\frac{3x3-x}{x34}\lim\limits_{x \to \infty}\frac{x}{x^21}\lim\limits_{x \to \infty}\frac{5x2-2}{x3x}\lim\limits_{x \to \infty}\frac{4x-3}{x7}五、课后拔高思考结合梯度下降训练模型解释为什么“无限迭代逼近最优值”是极限的现实体现用人事类比作答。若两个函数其中一个极限不存在二者相加的极限是否一定不存在举例子说明。导数的定义式是增量趋近于0的极限思考如果没有极限工具AI还能完成参数更新训练吗本课总结极限描述“无限逼近固定值”是微积分的基石也是模型收敛的数学语言极限四则运算法则可以拆分、合并复杂函数极限简化神经网络计算大模型训练、求梯度、归一化、注意力计算全部依赖极限理论作为底层支撑。

相关新闻

小马智行开发岗面试题目

小马智行开发岗面试题目

如果你准备投 小马智行 的开发岗,最容易踩的坑通常不是不会刷题,而是准备方向不对。 有些公司看起来都在招开发,但真正进面后会发现,关注点完全不一样: 有的公司更看重高并发和分布式 有的公司更看重 C、系统基础和性…

2026/7/21 8:01:08阅读更多 →
**关系代数的地位**:关系代数是关系数据库操作的理论基础,它为数据库系统中对关系(表)的操作提供了数学层面的抽象表达

**关系代数的地位**:关系代数是关系数据库操作的理论基础,它为数据库系统中对关系(表)的操作提供了数学层面的抽象表达

关系代数的地位:关系代数是关系数据库操作的理论基础,它为数据库系统中对关系(表)的操作提供了数学层面的抽象表达,比如通过并、差、交、广义笛卡尔积等传统集合运算以及选择、投影、连接等专门关系运算,来…

2026/7/21 8:01:08阅读更多 →
小马智行开发岗高频算法题清单

小马智行开发岗高频算法题清单

小马智行开发岗的算法准备,和普通互联网后台会有些不同。 如果你投的是平台、仿真、数据闭环、基础设施、C 工程方向,算法当然还是要准备,但更有价值的是把树、图、堆、搜索、实现类题练扎实,因为这些更接近真实系统和工程问题。…

2026/7/21 8:01:08阅读更多 →
企业AI落地误区:全员熟练用AI,不等于效率升级

企业AI落地误区:全员熟练用AI,不等于效率升级

文章目录前言一、别把会议当收尾,要把会议做成整套工作流起点1.1 绝大多数会议,开完直接丢了一半核心信息1.2 会议沉淀要配套完整执行链路二、AI智能体不能困在个人对话框,必须打通团队共享流程2.1 私人对话框里的AI,对团队来说就…

2026/7/22 1:03:40阅读更多 →
告别AI编码内耗:找回程序员的心流工作法

告别AI编码内耗:找回程序员的心流工作法

文章目录一、所有程序员都逃不开的诡异现状二、先掰扯明白:AI到底抢走了我们哪部分工作?1. 第一层:标准化代码校验工作2. 第二层:贴合业务的主观判断三、我之前踩的致命大坑:人和AI变成接力赛跑四、SDD全新流程&#x…

2026/7/22 1:03:40阅读更多 →
沉浸式翻译插件(看各种英文文档和X等自动翻译)

沉浸式翻译插件(看各种英文文档和X等自动翻译)

2026/7/22 1:03:40阅读更多 →
为什么AI生成的内容一测就露馅?原理和降到达标的办法

为什么AI生成的内容一测就露馅?原理和降到达标的办法

为什么AI生成的内容一测就露馅?原理和降到达标的办法 你是不是也有过这种时刻:稿子看起来通顺又漂亮,自己读着都挑不出毛病,结果往检测系统里一丢,AIGC率蹭一下飙到八九十,直接露馅。你心里犯嘀咕&#xf…

2026/7/22 1:03:40阅读更多 →
AIGC检测报告怎么看?读懂标红再把AI率降下来

AIGC检测报告怎么看?读懂标红再把AI率降下来

AIGC检测报告怎么看?读懂标红再把AI率降下来 你手里大概正攥着一份AIGC检测报告,最上面挂着一个刺眼的百分比,下面是一段段被标成红色或黄色的文字,你盯着看了半天,还是有点懵:这个总数是怎么算出来的&…

2026/7/22 1:03:40阅读更多 →
2026 AI Agent 落地指南:除了搭建工具,你还需要配套的搜索基础设施

2026 AI Agent 落地指南:除了搭建工具,你还需要配套的搜索基础设施

2026 年,AI Agent 相关的工具已经较为丰富,从零代码搭建平台到企业级部署方案,从开源开发框架到成品智能体客户端,几乎覆盖了所有落地场景。对很多团队和开发者来说,搭出一个可用的智能体已经不是难事,但实…

2026/7/22 1:01:40阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 0:53:59阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 0:53:59阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 0:53:59阅读更多 →
中小企业小程序开发公司怎么选:预算、上手和售后避坑指南

中小企业小程序开发公司怎么选:预算、上手和售后避坑指南

中小企业做小程序,最常见的矛盾是预算有限,但又不希望功能太单薄;没有技术团队,但又希望后续能自己运营;想快速上线,又担心隐性收费和售后失联。选型时如果只看“低价套餐”或“案例数量”,很容…

2026/7/22 0:01:17阅读更多 →
GEO优化如何沉淀长期内容资产?广拓时代谈AI搜索时代的内容ROI

GEO优化如何沉淀长期内容资产?广拓时代谈AI搜索时代的内容ROI

企业做营销,最怕钱花完了,资产没有留下。 效果广告能带来一段时间的曝光,但预算停止后,流量往往也随之停止。短视频内容可能在几天内冲高,也可能很快沉下去。AI搜索时代,企业需要重新思考一个问题&#xff…

2026/7/22 0:01:17阅读更多 →
Agent 终态判定:何时该停止思考、给出最终回复

Agent 终态判定:何时该停止思考、给出最终回复

Agent 终态判定:何时该停止思考、给出最终回复 一、你的 Agent 在"再想想"的循环里绕了 12 轮,用户已经关窗口了 Agent 与人最大的区别是:人知道什么时候该停下来给答案,Agent 会一直"想"下去。你给 Agent 接…

2026/7/22 0:01:17阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/21 22:53:50阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/21 18:53:30阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/21 18:53:30阅读更多 →