API最佳实践-3 流式输出 + 并发控制
接着前两篇今天一次讲清流式输出 并发控制流式输出不改实际耗时但用户体感差几倍——第一个字出来就觉得在响应了。并发控制方面429不是服务不稳定是限流保护在工作客户端加个令牌桶就能解决。这篇讲流式输出的正确用法、中断重连的写法以及生产环境怎么控制并发。流式 vs 非流式| 指标 | 非流式 | 流 式 || 总耗时 | 5.2秒 | 5.2秒 || 首Token时间 | 0.8秒 | 0.8秒 || 用户感知 | 等5秒才看到内容 | 0.8秒开始出字 |实际耗时一样。流式让用户不焦虑。流式中断重连流式最大的坑输出一半连接断了。pythondef stream_with_reconnect(messages, max_retries2):collected for attempt in range(max_retries 1): try: stream client.chat.completions.create( modelglm-5.2, messagesmessages, streamTrue ) for chunk in stream: if chunk.choices[0].delta.content: collected chunk.choices[0].delta.content yield chunk.choices[0].delta.content return except Exception: if attempt max_retries: messages.append({role: assistant, content: collected}) messages.append({role: user, content: 继续}) else: raise并发控制429不是bug是限流保护。pythonimport timeimport asyncioclass TokenBucket:def __init__(self, rate, capacity): self.rate rate self.capacity capacity self.tokens capacity self.last_time time.monotonic() async def acquire(self): while True: now time.monotonic() self.tokens min(self.capacity, self.tokens (now - self.last_time) * self.rate) self.last_time now if self.tokens 1: self.tokens - 1 return await asyncio.sleep((1 - self.tokens) / self.rate)批处理控制并发数pythonasync def batch_process(tasks, max_concurrency5):sem asyncio.Semaphore(max_concurrency) async def bounded(task): async with sem: return await process(task) return await asyncio.gather(*[bounded(t) for t in tasks])##这篇解决两个常见问题用户觉得慢、并发一高就报429。流式输出部分对比stream开关的实际效果给Python和Node.js的代码示例以及流式中断后怎么自动重连。并发控制部分解释429的机制、各套餐的并发建议、手写令牌桶限流器、批处理任务怎么控制并发上限。

相关新闻

5分钟快速部署指南:PhotoGIMP如何让GIMP变身为Photoshop的终极免费替代方案

5分钟快速部署指南:PhotoGIMP如何让GIMP变身为Photoshop的终极免费替代方案

5分钟快速部署指南:PhotoGIMP如何让GIMP变身为Photoshop的终极免费替代方案 【免费下载链接】PhotoGIMP A Patch for GIMP 3 for Photoshop Users 项目地址: https://gitcode.com/GitHub_Trending/ph/PhotoGIMP 厌倦了Photoshop高昂的订阅费用却又无法适应GI…

2026/7/19 21:54:45阅读更多 →
Codex与DeepSeek API集成实战:从安装配置到AI编程助手应用

Codex与DeepSeek API集成实战:从安装配置到AI编程助手应用

最近在尝试AI编程助手时,发现很多开发者对Codex和DeepSeek的组合特别感兴趣,但网上的资料要么过于零散,要么配置步骤复杂。本文基于实际项目经验,整理一套完整的Codex安装使用教程,重点演示如何接入DeepSeek API&#…

2026/7/19 21:54:45阅读更多 →
AltSendme:告别网盘限速,一款让你彻底“忘“了文件的传输神器

AltSendme:告别网盘限速,一款让你彻底“忘“了文件的传输神器

你有没有遇到过这种崩溃时刻? 手机里拍了几段4K视频,想传给电脑剪,结果微信提示"文件过大"; 硬盘里10个G的工程文件,要发给同事,网盘上传半小时,网速卡在100KB不动; 甚…

2026/7/19 21:54:45阅读更多 →
RTL8188EU Linux驱动架构深度解析与实战应用

RTL8188EU Linux驱动架构深度解析与实战应用

RTL8188EU Linux驱动架构深度解析与实战应用 【免费下载链接】rtl8188eu Repository for stand-alone RTL8188EU driver. 项目地址: https://gitcode.com/gh_mirrors/rt/rtl8188eu RTL8188EU是一款广泛应用于USB无线网卡的Realtek芯片,其Linux独立驱动项目为…

2026/7/20 11:45:44阅读更多 →
【技术干货】大模型行业情报核验:基于 Claude 构建“主张—证据”分析流水线

【技术干货】大模型行业情报核验:基于 Claude 构建“主张—证据”分析流水线

摘要: 本文使用 Python 与 Claude API 构建 AI 行业情报核验工具,将新闻材料拆分为主张、证据、推断与风险等级,解决模型发布、定价调整和商业合作信息难以交叉验证的问题。目录 背景介绍核心原理实战演示工具/技术资源选型注意事项全文总结一…

2026/7/20 11:45:44阅读更多 →
【技术干货】大模型能力评测实战:Python构建可复现的模型选型流水线

【技术干货】大模型能力评测实战:Python构建可复现的模型选型流水线

摘要: 本文针对大模型发布信息失真、榜单与实际体验不一致的问题,拆解多维评测机制,并使用 Python 与 Claude API 构建可复现的自动评分工具,帮助开发者完成模型验证与技术选型。目录 背景介绍核心原理实战演示工具/技术资源选型注…

2026/7/20 11:45:44阅读更多 →
MASA模组全家桶汉化包:如何彻底解决Minecraft模组语言障碍

MASA模组全家桶汉化包:如何彻底解决Minecraft模组语言障碍

MASA模组全家桶汉化包:如何彻底解决Minecraft模组语言障碍 【免费下载链接】masa-mods-chinese 一个masa mods的汉化资源包 项目地址: https://gitcode.com/gh_mirrors/ma/masa-mods-chinese 对于众多中文Minecraft玩家来说,英文界面一直是使用模…

2026/7/20 11:45:44阅读更多 →
Modbus TCP通讯故障排查与优化实战指南

Modbus TCP通讯故障排查与优化实战指南

1. Modbus TCP通讯故障排查完全指南作为一名在工业自动化领域摸爬滚打多年的工程师,我处理过上百起Modbus TCP通讯故障。每次遇到产线突然停摆、数据采集中断的紧急情况,都需要快速定位问题根源。今天就把我这些年积累的实战经验整理成系统化的排查指南&…

2026/7/20 11:45:44阅读更多 →
验证码轰炸攻击防御与账户安全防护指南

验证码轰炸攻击防御与账户安全防护指南

1. 验证码轰炸背后的黑色产业链那天凌晨3点,我的手机突然连续震动十几下。睡眼惺忪地解锁屏幕,发现收件箱里塞满了来自各大平台的验证码短信——美团、京东、银行APP...前后不到两分钟收到23条。这种被称为"验证码轰炸"的攻击手段,…

2026/7/20 11:43:44阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/20 0:50:54阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/20 0:50:54阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/20 0:50:54阅读更多 →
2026 WAIC:努比亚二代“豆包手机”NaviX Ultra亮相,智能体验全面升级!

2026 WAIC:努比亚二代“豆包手机”NaviX Ultra亮相,智能体验全面升级!

7月18日智东西消息,在2026 WAIC期间,努比亚联合字节豆包打造的二代“豆包手机”努比亚NaviX Ultra首次亮相,相比一代有诸多升级。智能体手机理念中兴通讯终端事业部总裁、努比亚总裁倪飞表示,智能体手机要从人操作手机变为手机帮人…

2026/7/20 0:01:04阅读更多 →
努比亚NaviX Ultra亮相WAIC,智能体手机能否让用户生活更简单?

努比亚NaviX Ultra亮相WAIC,智能体手机能否让用户生活更简单?

努比亚NaviX Ultra:外观与功能双升级在2026 WAIC期间,首次亮相的努比亚NaviX Ultra吸引了众多目光。它是努比亚联合字节豆包打造的二代“豆包手机”,与一代努比亚M153相比,外观设计变化较大。其机身背部搭载横向排布的大尺寸影像模…

2026/7/20 0:01:04阅读更多 →
C# 将逗号分割的字符串转换为long,并添加到List<long>

C# 将逗号分割的字符串转换为long,并添加到List<long>

目录 方法1:使用Split和Convert.ToInt64 方法2:使用LINQ的Select和ToList 方法3:使用TryParse进行异常安全转换(推荐) 如果您喜欢此文章,请收藏、点赞、评论,谢谢,祝您快乐每一天…

2026/7/20 0:01:04阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/19 22:50:49阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/19 14:50:26阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/19 18:50:36阅读更多 →