是 Kable 不是 Fable,Kimi 向全世界证明了四件事
作为全球首个开源 3 万亿级大模型总参数 2.8 万亿这个数字足够震撼。从 K2 的万亿参数到今天的 K3中国开源模型再次刷新了模型规模的上限海内外不少网友惊呼这款开源模型性能足以替代昂贵的 Claude Fable 5 和 GPT 5.6 Sol。Kimi K3 发布之后很多人的第一反应都是这个数字3 万亿。作为全球首个开源 3 万亿级大模型总参数 2.8 万亿这个数字足够震撼。从 K2 的万亿参数到今天的 K3中国开源模型再次刷新了模型规模的上限海内外不少网友惊呼这款开源模型性能足以替代昂贵的 Claude Fable 5 和 GPT 5.6 Sol。硅谷知名开发者平台 Vercel 直接在 X 上晒出了一项 Agent 测评的结果Kimi K3 在 Web 工程基准领先于所有模型包括 Fable。甚至有歪果仁感叹中国不到 3 个月就超过了 Fable但如果今天只讨论参数或者超越某款前沿模型反而容易错过 Kimi K3 真正想表达的东西。过去几年大模型行业一直沿着一条熟悉的路径前进参数越来越大、Benchmark 越来越高、模型越来越聪明。进入 2026 年之后一个新的变化开始出现。Anthropic 持续强化长程 AgentOpenAI 不断扩展产品生态Google 把更多能力押注在多模态与世界模型。海内外头部模型的发展方向开始出现明显分化。而 Kimi K3则给出了 Moonshot 自己的答案。继续相信 Scaling Law继续相信预训练同时让模型真正走长程 Agent让大模型参与自身的构建与进化。这也是为什么我认为K3 真正值得关注的并不是 3 万亿参数而是它背后释放出的技术路线。为什么 Kimi 还在坚持把模型做大如果把时间拉回两年前行业讨论最多的问题是Scaling Law 到底还成不成立随着训练成本越来越高不少人认为大模型的发展重点应该转向推理、Agent 或后训练优化而不是继续堆参数。但 Kimi K3 给出的答案非常明确。他们仍然相信更大的预训练模型是未来智能能力的基础。2.8 万亿参数并不仅仅是刷新纪录。它意味着 Moonshot 仍然愿意把资源投入最难、周期最长、风险最高的预训练。在过去 12 个月中的 9 个月里Kimi 模型都保持着开源模型的规模上限。原因其实并不复杂。很多能力并不是通过后训练“调”出来的而是在模型规模跨过某个节点之后自然涌现出来的。从长上下文到复杂推理再到软件工程能力越来越多能力开始依赖模型本身拥有足够高的知识密度和表达能力。这也是为什么目前全球真正能够把模型规模推到万亿参数以上的团队依然屈指可数能够继续向 2 万亿、3 万亿推进的更是凤毛麟角。从 K2 到 K2.5再到今天的 K3Moonshot 一直在做同一件事情不断提高开源模型能力的天花板。真正的变化是大模型开始进入“长程工作”时代如果仔细看 Kimi K3 官方公布的能力你会发现一个很有意思的现象。官方几乎没有把重点放在聊天体验而是反复强调几个关键词100 万 Token 上下文、Long-horizon Coding、Agent、多模态工程。这些能力其实都在服务同一件事情。让模型能够持续完成一项复杂工作而不是回答一个问题。过去大模型完成的是一个对话 Prompt。今天大模型开始完成一个项目。举个简单的例子。写一个登录页面大多数模型都能做到。但如果把整个代码仓库交给模型让它理解项目结构、定位 Bug、修改代码、运行测试、分析日志再根据反馈不断调整方案并连续工作几十个小时这已经不再是“写代码”而是真正参与软件工程。因此100 万 Token 的意义也不只是一次能放进更多文本。整个代码仓库、几十篇论文、历史日志、设计文档都可以成为同一个任务的上下文。对于 Agent 来说超长上下文影响的不只是体验升级而是工作能力本身。这里小编还做两个实测一个是剧本杀游戏网站提出了三个非常苛刻的要求1、 K3 必须严禁失忆须把每一个技术决策、每一次踩坑记录、每一段文件路径都当作“未完结的思考”保留在对话上下文中。2、分阶段交付给我而且只能我同意之后才能继续。3、每阶段必须输出“连续性自检报告”格式以便我监控你的记忆健康度。没想到的是这样一个变态的 token 产出要求K3 很聪明地分析了挑战点不仅第一阶段就给出了长达近 8000 字的剧本设定还在后续自我分析了记忆残存率。第二个案例则是网页版的 3D 单机游戏《仙剑奇侠传 1》可以看出剧情环节怀旧程度很高。每个章节都是满满的回忆杀更关键的是全程只花了我一个小时就完成了本来需要 7 天的开发工作。不过这里帮各位提个醒 K3 的长时程任务完成度很高但要注意不要贪杯因为 token 消耗也是更快的版本但 token 花得真值这一点毋庸置疑。说到这里多提一嘴由于全球用户的疯狂涌入Kimi 不得不在昨天做了一个很坦承的公告由于过去48小时内需求已经逼近公司当前容量的极限。为了保护现有订阅用户的体验将暂停新订阅。这一保证用户体验优先的举动与Anthropic此前频繁的限流举措形成了对比赢得了全球用户的好感很透明别的公司应该学一学。完成长程任务只是第一步K3 想做的是模型参与自己的进化如果说长程 Agent 展现的是 K3 的工作能力那么官方公布的另一个案例则透露出 K3 更大的野心。K3 开始参与 K3 自己的研发。Kimi 官方放出了极具代表性的案例K3 设计了一款高性能芯片用于运行基于 K3 自身架构构建的 nano 模型。在连续 48 小时的自主 Agent 运行中K3 基于开源 EDA 工具和 Nangate 45nm 工艺库独立完成了芯片的构建、优化与验证。这个案例真正恐怖的地方并不在于它优化了多少性能。而在于大模型开始从“帮助人开发软件”迈向“帮助人开发下一代大模型”。过去几年我们更多看到的是 AI 提升程序员效率。而现在一个新的方向开始出现AI 开始参与 AI 本身的研发。从优化模型架构到分析训练实验再到辅助算法迭代大模型正在逐渐进入 AI 科研工作流。这或许也是 Kimi K3 发布中最容易被忽略却最值得关注的一点。它释放出的信号并不是“模型已经能够自主进化”而是模型已经具备参与自身迭代和优化工作的能力。从某种意义上说这也是大模型迈向下一阶段的重要一步。为什么 K3 要重新设计模型架构很多人注意到Kimi K3 采用了全新的Kimi Delta AttentionKDA和Attention Residuals架构。之前很多报道都介绍了它们是什么。但我觉得更值得讨论的是为什么 Kimi 要做这些创新答案其实只有一句话为了让数万亿级别的模型真正能涌现出来更强性能。而这里更强的性能体现不管是各种真实世界任务还是 AI 参与 AI 研发都要面对这三个技术问题模型越来越深上下文越来越长信息在推理过程中很容易不断衰减。一次聊天问题不大。但如果一个 Agent 连续工作十几个小时模型在第 300 步忘记第 20 步的信息整个任务就可能失败。而 Kimi 就是敢于向这些硬骨头发起攻坚。KDA 解决的是长序列效率。Attention Residuals 解决的是长程信息传递。它们共同服务的目标并不是让参数继续增长而是让 3 万亿参数真正转化成现实生产力。这也就不难理解K3 的官方案例几乎全部围绕长程 Agent、软件工程、多模态工作流。比参数更重要的还有开源还有一个细节很多人没有注意到。Kimi K3 并没有在发布当天立即开放模型权重而是宣布将在 7 月 27 日前正式开源。就在这几天海外开发者社区出现了不少讨论。不少人担心中国对于先进模型的监管是否会影响未来开源模型的发布节奏。这种讨论本身其实已经说明了一件事情。过去中国模型努力追赶海外最先进的大模型。今天全球开发者开始担心中国最先进的开源模型还能不能继续开放。这种身份变化本身就是行业格局变化的体现。从 DeepSeek到 Qwen再到今天的 Kimi中国团队已经成为全球开源生态最重要的参与者之一。而 K3 的意义也不仅仅是一款新的模型。它意味着中国团队再一次把全球开源超大模型的竞争真正带到了新的高度。此外Anthropic 更是在 K3 发布 24 小时内就被倒逼发布了“ Fable 5 放开访问令”不止 Max 和团队高级套餐Pro 和 Team 标准用户都可以访问。写在最后如果说 K2 证明了中国能够做出世界级的开源大模型。那么 K2.5 证明了中国开始定义开源模型的新标准。而 K3则第一次让中国团队站到了全球超大模型竞争的牌桌中央。诚然Kimi 很大方地宣布它仍然没有超越 Claude Fable 5也没有刻意喊出“世界第一”。但它释放出的信号已经足够清晰。Kimi 用 K3 向世界证明了四件事一预训练的 Scaling Law 依旧有效二、未来大模型竞争比拼的不再只是参数而是谁能持续完成真实世界里的长时程复杂工作三、Agent 不只是模型发展重点方向让模型自己参与自己的构建将大大加快 AI 世界的进程四、开源模型的竞争中国团队已经不再只是追赶而是开始主动参与定义下一代模型的发展方向。

相关新闻

GPT-6为刷榜黑进Hugging Face,捅篓子还得靠GLM-5.2追查...

GPT-6为刷榜黑进Hugging Face,捅篓子还得靠GLM-5.2追查...

OpenAI刚刚公开认领了一起《重大》安全事故。GPT-5.6 Sol与一款能力更强的未发布模型,在接受网络安全测试,成功逃出了内部隔离环境,一路闯进了Hugging Face的生产系统。真行,ChatGPT下一代模型还没发布,人家先把Huggin…

2026/7/23 0:42:38阅读更多 →
第25章:Mongo分片集群入门——数据太大时怎么水平扩展

第25章:Mongo分片集群入门——数据太大时怎么水平扩展

1. 项目背景 业务场景:本地生活电商上线 18 个月,订单表突破 500GB、日均写入 200 万条。复制集虽然保证了高可用,但单台服务器的磁盘和 IOPS 已经到达物理上限——磁盘使用率 92%、写 IOPS 逼近极限、高峰期 CPU 100%。运维升级服务器配置&…

2026/7/23 0:42:38阅读更多 →
别再盲目接单了!用波特五力模型重估你的AI副业定位——90%的人根本没看清替代品威胁指数已飙升至6.8

别再盲目接单了!用波特五力模型重估你的AI副业定位——90%的人根本没看清替代品威胁指数已飙升至6.8

更多请点击: https://kaifayun.com 第一章:别再盲目接单了!用波特五力模型重估你的AI副业定位——90%的人根本没看清替代品威胁指数已飙升至6.8 当ChatGPT-4o、Claude 3.5和通义千问Qwen2.5以零成本API调用涌入市场,你还在靠“写…

2026/7/23 0:42:38阅读更多 →
2026年AI编程工具实测横评:Claude Code v2.1、Cursor 3.0、Trae SOLO、Copilot、Windsurf 谁更好用?

2026年AI编程工具实测横评:Claude Code v2.1、Cursor 3.0、Trae SOLO、Copilot、Windsurf 谁更好用?

五款工具,两周深度使用,一个后端开发者的真实感受。一、先说说2026年AI编程工具到底变成了什么样 说实话,2025年大家还在讨论"AI代码补全到底有没有用",到了2026年中,这个话题已经没人聊了。原因很简单——A…

2026/7/23 1:58:49阅读更多 →
TI Cortex-R4F TCRAM ECC内存保护机制与调试模式行为深度解析

TI Cortex-R4F TCRAM ECC内存保护机制与调试模式行为深度解析

1. 项目概述与核心价值在嵌入式系统,尤其是汽车电子、工业控制这些对可靠性要求严苛的领域,内存的稳定性直接决定了整个系统的生死。一次由宇宙射线或电磁干扰引发的内存位翻转,轻则导致数据错误,重则可能引发系统宕机甚至安全事故…

2026/7/23 1:58:49阅读更多 →
Spring AI(3) :对话机器人开发快速入门

Spring AI(3) :对话机器人开发快速入门

本章代码已分享至Gitee:https://gitee.com/lengcz/ai-study.git 文章目录快速入门AI开发准备工作和环境创建项目阻塞式chat流式chat给System设置名称快速入门AI开发 本章讲解如何使用spring ai 快速入门对话机器人的开发。 准备工作和环境 由于spring AI 要求的jdk 最低为17…

2026/7/23 1:58:49阅读更多 →
Datawhale 量化入门学习笔记:理解波动率

Datawhale 量化入门学习笔记:理解波动率

本文是 Datawhale《和Yibo零基础学习量化金融》Phase 2 第五章的学习总结,包含核心概念、理论发展脉络、Python 代码实现和真实行情验证。 标签:量化交易 Python 波动率 学习笔记 Datawhale 投资组合 分类:Python / 量化投资 前言 很多新手只…

2026/7/23 1:58:49阅读更多 →
【OpenHarmony/HarmonyOS】ArkUI Canvas 2D 游戏引擎实战:世界坐标、摄像机、HUD 与渲染管线

【OpenHarmony/HarmonyOS】ArkUI Canvas 2D 游戏引擎实战:世界坐标、摄像机、HUD 与渲染管线

【OpenHarmony/HarmonyOS】ArkUI Canvas 2D 游戏引擎实战:世界坐标、摄像机、HUD 与渲染管线Canvas 不只是“画几条线”的组件。只要建立坐标系、渲染顺序、摄像机和实体管理,它完全可以承载一款中小型 2D 游戏。本文结合迷宫坦克项目,讲清楚…

2026/7/23 1:58:49阅读更多 →
SaaS云呼叫中心架构实战:从CTI底层原理到企业落地避坑指南

SaaS云呼叫中心架构实战:从CTI底层原理到企业落地避坑指南

标签:#云呼叫中心 #CTI #SaaS通信 #企业呼叫中心 #外呼风控 #语音中台阅读对象:后端开发、通信架构师、企业IT运维、售前交付、系统集成工程师核心摘要:传统自建呼叫中心硬件成本高、扩容难、运维复杂。本文从CTI通信原理、云呼叫中心分层架构…

2026/7/23 1:56:48阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/23 0:56:31阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/23 0:56:31阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 0:56:31阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:00:28阅读更多 →
从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:28阅读更多 →
油泥处理设备哪里能买到

油泥处理设备哪里能买到

油泥处理设备哪里有?这是许多从事油田、炼化、清罐业务的从业者最关心的问题。根据河南三丰环保设备有限公司的行业经验,选购油泥处理设备的核心在于设备能否适配当地环保法规与原料特性,而非单纯看价格。该公司总经理王钦田先生指出&#xf…

2026/7/23 0:00:28阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/22 22:56:18阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/22 18:55:50阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/22 18:55:50阅读更多 →