AxonHub 轻量部署实录[2]-配置篇
目录第一步配置渠道第二步配置模型第三步创建API Key在上篇内容中我们介绍了AxonHub的安装本篇内容是AxonHub的第二篇介绍如何配置渠道、模型并在Agent中使用。如果还没有安装好可移步到 AxonHub 轻量部署实录[1]-安装篇 查看安装步骤第一步配置渠道登录AxonHub的控制台http://localhost:8090 此时已创建好默认的项目由于我们是个人使用因此直接使用Default跳过项目管理直接添加渠道。依次点击“渠道”-“添加渠道”渠道管理此时弹出添加渠道对话框我们填入自己的服务商信息每一个供应商都支持填入BaseUrl、APIKey、models等信息。我们按自己的实际情况填写。关于API格式目前常用的有下面几种找时间单独聊一下开发Agent的时候会用到• OpenAI Chat Completions这是最老、最通用的一套格式几乎所有国内厂商DeepSeek、Kimi、阿里百炼、火山引擎和大部分海外第三方平台都支持它。• OpenAI Responses这是 OpenAI 在 2025 年推出的新格式Codex CLI、Claude Code 的某些工作流、以及 OpenAI 自家的 Agent 产品都在用它。国内厂商目前几乎都不支持这套格式阿里百炼最近提供了支持但没用过。• Anthropic MessagesClaude 的接口和 OpenAI 的 Completions 有点像但字段名和结构都不一样。目前国内厂商支持的比较好CodingPlan 都会提供这种格式的API 地址Kimi-K2.5 开了个好头• Google GeminiGoogle自成一家Gemini 的接口和前面三家差别更大甚至连 HTTP 路径都不一样只有他家自己的产品使用国内无法使用且国内厂商都不支持。添加渠道以火山方舟Coding Plan为例在右侧服务商列表选择“火山引擎”参数填写内容如下• API格式自动带入“OpenAI Chat Compelations”保持不变• 渠道名称随便填一个能记住的我这里用“volces-plan”•Base Url默认填入的是火山引擎计费models调用的地址需要修改成我们Coding Plan的地址 https://ark.cn-beijing.volces.com/api/coding/v3• API Key你在火山方舟里面创建的API Key• 支持的模型填入火山方舟支持的模型多个的时候以逗号分割可以批量添加我使用的有 ark-code-latest,kimi-k2.6,glm-5.1,deepseek-v4-pro,deepseek-v4-flash,doubao-seed-2.0-pro,doubao-seed-2.0-code• 默认测试模型这个参数是用在模型可用性测试上面的这里我们填写 deepseek-v4-pro其他参数我们使用默认值不做变动点击添加之后第一个渠道就创建好了。我们回到渠道列表在状态列点击“启用”开关启用这个渠道启用的时候可以顺便测测速火山引擎提供的Deepseek V4 Pro 速度周末几乎与官网持平工作日高峰时候会有延迟。第二步配置模型我们添加并启用渠道之后表示我们已经和上游服务商的链接打通了。模型表示我们要给下游提供哪些模型服务。依次点击“模型”-“添加模型”在弹出的模型列表中进行编辑以deepseek-v4-pro为例• 开发者选择DeepSeek• 模型ID选择deepseek-v4-pro• 名称自动带入DeepSeek V4 Pro其他参数都会自动带入我们直接点击“保持”添加模型保持完之后我们要给这个模型添加关联当用户请求我们的deepseek-v4-pro模型时使用我们指定的渠道中的模型提供服务。点击模型列表中的关联规则列中关联操作• 优先级越低越优先• 类型选择“去岛内精准匹配模型”渠道选择我们前面创建的“volces-plan”模型选择渠道下的“deepseek-v4-pro”点击保存。模型关联第三步创建API Key我们创建一个API key给调用方在左侧菜单里面找到“API 密钥”填入密钥名称类型选择“用户”点击“创建”按钮此时会生成一个新的密钥。回到API 密钥列表点击“API Key”列中的小眼睛可以查看如何在Agent中使用。例如我们要在codex中使用将标签页切换到codex查看密钥按照给出的步骤进行配置配置完成后打开codex cli引入地址

相关新闻

2026人工智能前沿学术会议参展方向、展位类型与合作价值解读

2026人工智能前沿学术会议参展方向、展位类型与合作价值解读

2026人工智能前沿学术会议将于10月16日-18日举办。作为面向人工智能前沿研究、产业应用与成果转化的重要学术交流活动,本次会议同步设立企业展区,为人工智能相关企业、科研成果转化机构、产业园区及投资机构提供展示交流空间,推动技术、资本、…

2026/7/21 11:16:07阅读更多 →
深入解析USB控制器寄存器:从原理到嵌入式通信实战

深入解析USB控制器寄存器:从原理到嵌入式通信实战

1. USB控制器寄存器:嵌入式通信的基石 在嵌入式系统开发中,USB通信的实现往往被视为一个“黑盒”——我们调用库函数,数据就神奇地收发成功了。但当你需要调试一个顽固的通信故障,或者想要榨干硬件每一分性能时,就必须…

2026/7/21 11:16:07阅读更多 →
yuzu模拟器性能优化深度解析:告别卡顿闪退的完整指南

yuzu模拟器性能优化深度解析:告别卡顿闪退的完整指南

yuzu模拟器性能优化深度解析:告别卡顿闪退的完整指南 【免费下载链接】yuzu-downloads 项目地址: https://gitcode.com/GitHub_Trending/yu/yuzu-downloads yuzu作为目前最活跃的Nintendo Switch模拟器项目,通过开源协作实现了对Switch游戏的高质…

2026/7/21 11:16:07阅读更多 →
被马斯克称为“吓人地聪明”:我用一周实测Grok 3,发现了它真正的杀手锏

被马斯克称为“吓人地聪明”:我用一周实测Grok 3,发现了它真正的杀手锏

适用人群:正在关注2026年AI模型选型的开发者、想了解Grok 3真实实力的技术决策者 你将获得:Grok 3在代码、推理、实时信息三大场景的一手实测数据,以及它跟主流模型的真实差距马斯克说Grok 3“scary smart”。xAI声称它 outperforms anything…

2026/7/22 6:45:11阅读更多 →
从 CPU 缓存行到 False Sharing —— 并发编程中隐藏的性能杀手

从 CPU 缓存行到 False Sharing —— 并发编程中隐藏的性能杀手

1 一个反直觉的性能实验几年前我在做一个多线程计数器模块的性能优化时,遇到了一个令人困惑的现象:两个线程分别对两个完全独立的变量做自增操作,理论上它们之间不存在任何数据依赖,性能应当与单线程各自运行无异。然而实测结果却…

2026/7/22 6:45:11阅读更多 →
RocketMQ生产者启动机制与性能优化实践

RocketMQ生产者启动机制与性能优化实践

1. RocketMQ生产者启动的核心价值与场景定位在分布式系统架构中,消息队列作为解耦关键组件的重要中间件,其生产者启动过程直接影响消息投递的可靠性和系统吞吐量。以RocketMQ为例,一个生产者的完整启动流程涉及网络连接建立、线程池初始化、元…

2026/7/22 6:45:11阅读更多 →
Unity游戏角色移动速度优化:实现210%高速移动的完整方案

Unity游戏角色移动速度优化:实现210%高速移动的完整方案

在游戏开发中,角色移动速度的优化和自定义配置是提升玩家体验的关键环节。近期在参与某款竞速类游戏项目时,团队遇到了一个有趣的需求:如何通过合理的资源配置,实现角色移动速度的大幅提升,比如达到基础速度的210%&…

2026/7/22 6:45:10阅读更多 →
深入解析TI EDMA3控制器:DMA/QDMA通道、触发机制与实战配置

深入解析TI EDMA3控制器:DMA/QDMA通道、触发机制与实战配置

1. 项目概述与核心价值在嵌入式系统开发,尤其是涉及实时信号处理、音视频流传输或高速数据采集的场景里,CPU常常被大量、重复的数据搬运任务所拖累,导致核心业务逻辑无法及时响应。这时,直接内存访问(DMA)技…

2026/7/22 6:45:10阅读更多 →
Vibe编程:AI辅助的自然语言开发新范式

Vibe编程:AI辅助的自然语言开发新范式

1. 什么是Vibe编程?Vibe编程(Vibe Coding)是近年来兴起的一种新型软件开发方式,它彻底改变了传统编程的工作流程。简单来说,这是一种完全依赖AI辅助的编程方法,开发者只需要用自然语言描述需求,…

2026/7/22 6:43:07阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 0:53:59阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 0:53:59阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 0:53:59阅读更多 →
中小企业小程序开发公司怎么选:预算、上手和售后避坑指南

中小企业小程序开发公司怎么选:预算、上手和售后避坑指南

中小企业做小程序,最常见的矛盾是预算有限,但又不希望功能太单薄;没有技术团队,但又希望后续能自己运营;想快速上线,又担心隐性收费和售后失联。选型时如果只看“低价套餐”或“案例数量”,很容…

2026/7/22 0:01:17阅读更多 →
GEO优化如何沉淀长期内容资产?广拓时代谈AI搜索时代的内容ROI

GEO优化如何沉淀长期内容资产?广拓时代谈AI搜索时代的内容ROI

企业做营销,最怕钱花完了,资产没有留下。 效果广告能带来一段时间的曝光,但预算停止后,流量往往也随之停止。短视频内容可能在几天内冲高,也可能很快沉下去。AI搜索时代,企业需要重新思考一个问题&#xff…

2026/7/22 0:01:17阅读更多 →
Agent 终态判定:何时该停止思考、给出最终回复

Agent 终态判定:何时该停止思考、给出最终回复

Agent 终态判定:何时该停止思考、给出最终回复 一、你的 Agent 在"再想想"的循环里绕了 12 轮,用户已经关窗口了 Agent 与人最大的区别是:人知道什么时候该停下来给答案,Agent 会一直"想"下去。你给 Agent 接…

2026/7/22 0:01:17阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/21 22:53:50阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/21 18:53:30阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/21 18:53:30阅读更多 →