GPT-5.6 来了,Codex 没了,我想用它做个旧手机监控 App
大家可能听说了7 月 10 日OpenAI 搞了一场发布会发布了GPT-5.6包含三个新模型。查了一下GPT-5.6 系列的三个型号Sol旗舰、Terra均衡、Luna性价比名字来自拉丁语里的太阳、大地和月亮。我更新了Codex后已经可以使用这些模型了。查了官网定价Sol 每百万 token 输入 5 美元、输出 30 美元Terra 减半2.5 美元和 15 美元Luna 最低1 美元和 6 美元。三款模型 24 小时内全量上线覆盖 ChatGPT、Codex 和 API。GPT各模型价格链接 https://developers.openai.com/api/docs/pricing编程是 GPT-5.6 的主战场一下子有三个新的模型应该怎么选我也很关心各个模型的实力。查了官网的评测Sol 在 Artificial Analysis 编程智能体指数上拿了 80 分比 Fable 5 高 2.8 分输出 token 不到一半耗时不到一半成本便宜约三分之一。Terminal-Bench 2.1 和 DeepSWE 也刷新了最好成绩。Terra 略高于 Fable 5Luna 超过 Opus 4.8两者耗时都只有对手三分之一左右。 Agents Last Exam 上Sol 拿下 53.6 分比 Fable 5 高出 13.1 分。开中档推理也比对方高 11.4 分成本只有四分之一。所以看了这些感觉性价比不错。但也不是全面碾压。SWE-Bench Pro 上 Claude Fable 5 是 80%Sol 是 64.6%——精准修改单文件的场景Claude 依然更强。FrontierMath 最难的 Tier 4 题目Sol 的 65.9% 甚至不如自家上代 GPT-5.5 的 72.5%。OpenAI 强在规划和编排Claude 强在执行。网上资料还了解到这次还有个新玩法叫 ultra 模式。默认四个智能体并行最多十六个人多力量大。Terminal-Bench 2.1 上 Sol Ultra 干到 91.9%GPT-5.5 同期 88.0%。官网的发布会视频上研究员的说法是这些智能体能像一支有经验的团队那样拆分工作有机会要去试一下的。我更新codex应用后开始还以为搞错了Codex变成了ChatGPT。后来才了解到Codex 独立 App 下线了能力全部并入 ChatGPT。还有一个让我在意的数字GPT-5.6 的内测期间研究员人均每日输出 token 量超过 GPT-5.5 时期最高水平的两倍。Lovable 联合创始人说新模型让用户构建应用的步骤少了约 25%工具调用少 35% 到 48%。话说到这份上我脑子里冒出一个想法。家里抽屉里躺着两部旧手机。儿子放暑假最近开始上网课上周推开他的房门数学课直播开着他却在玩玩具。想过买监控摄像头。但专门为网课买一套设备总有种杀鸡用牛刀的感觉。我去应用商店搜了一圈监控类 App要么限免后弹窗收费要么塞满开屏广告。更要命的是它们几乎全部要求把视频流上传到厂商服务器。一个家庭监控画面为什么要经过别人家的云正好旧手机闲着正好 GPT-5.6 Codex 合体了。我打算试试让 AI 帮我把旧手机改成一个纯局域网的家用监控设备。功能需求已经想清楚了旧手机端装上 App 当作摄像头同一 WiFi 下另一台手机或电脑通过浏览器就能看实时画面、同步收听声音。录像全部存本地不经过任何云端。监控时手机屏幕可以锁屏同时绕过电池优化限制防止系统杀进程。纯局域网传输意味着什么拿 Wireshark 抓包数据包只在路由器内部兜圈不会有一帧画面离开家门。目前刚把需求梳理完正式开发还没启动。后续会在公众号更新开发过程和踩坑记录包括 GPT-5.6 在真实项目中的实际表现以及各模型的切换策略。如果你也有闲置旧手机或者对家庭监控的隐私方案有想法留言区聊聊。有没有什么你特别想要的功能运动检测、夜间模式、多摄像头联动——需求收集得越多开发方向越清晰。

相关新闻

多智能体系统实战:从AutoGen到ChatDev的架构解析

多智能体系统实战:从AutoGen到ChatDev的架构解析

1. 多智能体系统概述:从单兵作战到团队协作的进化在大型语言模型(LLM)应用领域,我们正经历着从单一智能体到多智能体协作的范式转变。就像软件开发从单体架构演进到微服务架构一样,多智能体系统通过任务分解和角色分工…

2026/7/30 4:57:47阅读更多 →
C++枚举深度解析:从传统enum到enum class的类型安全实践

C++枚举深度解析:从传统enum到enum class的类型安全实践

1. 项目概述:为什么C程序员绕不开enum? 干了这么多年C,从学生时代的课程设计到后来参与的大型商业引擎开发, enum (枚举)这个看似简单的工具,几乎在每个项目里都会出现。新手用它来定义几个状…

2026/7/30 4:55:47阅读更多 →
AI培训材料迭代慢?某头部科技公司已启用“实时反馈—自动重生成”闭环系统(架构图+配置参数首次解禁)

AI培训材料迭代慢?某头部科技公司已启用“实时反馈—自动重生成”闭环系统(架构图+配置参数首次解禁)

更多请点击: https://codechina.net 第一章:AI培训材料迭代滞后现状与行业痛点 当前AI技术演进速度远超传统内容生产周期,主流框架如PyTorch、TensorFlow每季度发布重大更新,而企业内部AI培训课件平均更新周期长达6–12个月。这…

2026/7/30 4:55:47阅读更多 →
CentOS7部署HoRain路由追踪工具全指南

CentOS7部署HoRain路由追踪工具全指南

1. 为什么我们需要在CentOS7上部署路由追踪工具?在Linux服务器运维和网络问题排查中,路由追踪(Traceroute)是最基础也最实用的网络诊断工具之一。我管理过上百台CentOS服务器,遇到过无数次网络连通性问题,而…

2026/7/30 6:04:01阅读更多 →
Qt异步编程新范式:C++20协程与QCoro库实战指南

Qt异步编程新范式:C++20协程与QCoro库实战指南

1. 项目概述:当Qt遇上C20协程如果你是一个Qt开发者,同时又对C20带来的协程(Coroutines)特性感到兴奋,那么你很可能已经体会过那种“隔靴搔痒”的无力感。Qt框架本身提供了一套强大的异步事件驱动模型,从经典…

2026/7/30 6:04:01阅读更多 →
Jetson Nano网络配置实战:静态IP与Wi-Fi热点搭建指南

Jetson Nano网络配置实战:静态IP与Wi-Fi热点搭建指南

1. 项目缘起:为什么要在Jetson Nano上折腾静态IP和热点?如果你手头有一块英伟达的Jetson Nano开发板,无论是用来做边缘AI推理、机器人控制,还是搭建一个小型的家庭服务器,网络配置都是绕不开的第一步。默认情况下&…

2026/7/30 6:04:01阅读更多 →
Qt项目调用第三方库:静态与动态链接库配置与避坑指南

Qt项目调用第三方库:静态与动态链接库配置与避坑指南

1. 项目概述:为什么Qt调用第三方库是个“技术活”?在桌面端和嵌入式开发领域,Qt凭借其强大的跨平台能力和丰富的组件库,一直是C开发者的心头好。但现实项目里,我们几乎不可能只靠Qt自身打天下。无论是处理特定格式的图…

2026/7/30 6:04:01阅读更多 →
STM32平衡车入门:从硬件接线到CubeMX工程配置全解析

STM32平衡车入门:从硬件接线到CubeMX工程配置全解析

1. 项目启动:从零到一的硬件蓝图与软件地基做平衡车,最怕的就是东西买回来一堆,对着开发板两眼一抹黑,不知道从哪根线开始接。或者CubeMX一通配置,生成代码一编译,全是错误,连电机都转不起来。今…

2026/7/30 6:04:01阅读更多 →
国产长芯微LDC7124-8 替代 AD7124-8 参数对比分析

国产长芯微LDC7124-8 替代 AD7124-8 参数对比分析

描述LDC7124-8是一款适合高精度测量应用的低功耗、低噪声、高度集成的模拟前端。该器件内置一个低噪声24位Σ-Δ型模数转换器(ADC),可通过寄存器配置提供8个差分输入或15个单端或伪差分输入。LDC7124-4可以提供4对差分输入或者7个单端或伪差分输入。片内低噪声增益放…

2026/7/30 6:02:01阅读更多 →
覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

🔹 工具基础介绍 OpenClaw 是开源生态中一款实用性较强的本地智能工具,凭借本地离线运行、可视化图形操作和任务自动化三大核心特性,赢得了众多用户的青睐。与普通在线对话AI工具不同,它属于能够直接操控本机软硬件的智能数字员工…

2026/7/29 9:47:45阅读更多 →
伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

所谓液压伺服阀体的精密激光焊接,是用激光束对阀座壳体(通常为不锈钢或铝合金)进行密封焊接,使阀体在21-35MPa的高压液压油或压缩气体中长期运行而不发生介质泄漏。液压伺服阀是高端液压系统的"大脑"。从航空航天飞行控…

2026/7/29 7:00:19阅读更多 →
D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南 【免费下载链接】d2dx D2DX is a complete solution to make Diablo II run well on modern PCs, with high fps and better resolutions. 项目地址: https://gitcode.com/gh_mirrors/d2/d2dx 你是否还在…

2026/7/29 7:58:51阅读更多 →
3分钟解锁iOS应用自由:TrollInstallerX让你的iPhone摆脱安装限制 [特殊字符]

3分钟解锁iOS应用自由:TrollInstallerX让你的iPhone摆脱安装限制 [特殊字符]

3分钟解锁iOS应用自由:TrollInstallerX让你的iPhone摆脱安装限制 🚀 【免费下载链接】TrollInstallerX A TrollStore installer for iOS 14.0 - 16.6.1 项目地址: https://gitcode.com/gh_mirrors/tr/TrollInstallerX 你是否曾经因为iOS系统的严格…

2026/7/30 0:00:58阅读更多 →
[GESP202606 四级] 扫雷

[GESP202606 四级] 扫雷

B4557 [GESP202606 四级] 扫雷 https://www.luogu.com.cn/problem/B4557 中国计算机学会(CCF)2026年6月C四级讲解——扫雷 https://www.bilibili.com/video/BV1MCMg6AEXR/ B4557 [GESP202606 四级] 扫雷 https://www.bilibili.com/video/BV1ZKTj6ZEVh/ 2…

2026/7/30 0:00:58阅读更多 →
Windows驱动存储终极清理工具:DriverStoreExplorer完全指南

Windows驱动存储终极清理工具:DriverStoreExplorer完全指南

Windows驱动存储终极清理工具:DriverStoreExplorer完全指南 【免费下载链接】DriverStoreExplorer Driver Store Explorer 项目地址: https://gitcode.com/gh_mirrors/dr/DriverStoreExplorer 您是否曾因Windows系统盘空间不足而烦恼?是否遇到过设…

2026/7/30 0:00:58阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/30 0:27:26阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/30 4:47:18阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/29 14:26:42阅读更多 →