生命涌现的小龙虾技能之【Intelligent Video Search  Retrieval Analysis Skill | 视频搜索检索智能分析技能】简介
Intelligent Video Search Retrieval Analysis Skill | 视频搜索检索智能分析技能智能分析中枢· 图片/视频智能分析 · 结构化报告 · 历史报告云端查询 技能概览 | Overview模块内容️ 技能名称视频搜索检索智能分析技能 核心目标视频搜索/视频检索智能分析技能基于目标、语义描述进行智能视频搜索支持常规目标检索、自然语言描述检索、向量化模型匹配️ 输入类型图片、视频、本地文件、网络 URL 输出能力结构化分析报告、识别/监测结果、建议与报告链接 场景码VIDEO_SEARCHBased on multimodal large models and deep learning algorithms, this feature constructs a next-generation intelligentvideo retrieval system, supporting three core modes: conventional object retrieval, natural language descriptionretrieval, and vectorized model matching. Through computer vision technology, the system automatically identifies andindexes conventional targets such as people, vehicles, and objects. Simultaneously, it leverages image-text multimodallarge models to achieve cross-modal alignment between semantics and video content, enabling open-ended retrieval vianatural language descriptions like “person wearing red clothes” or “talking on the phone.” Furthermore, employing afull-modal vectorization model, the system transforms video content into high-dimensional vectors, realizing fusedretrieval across mixed modalities of text, image, and video. Supporting multi-condition combination and fuzzy semanticmatching, it rapidly locates target footage, meeting the precise retrieval demands of complex scenarios such as securitysurveillance and video asset management.本功能基于多模态大模型与深度学习算法构建了新一代智能视频检索系统支持常规目标检索、自然语言描述检索及向量化模型匹配三种核心模式。系统通过计算机视觉技术自动识别并索引人、车、物等常规目标同时利用图文多模态大模型实现语义与视频内容的跨模态对齐支持用户通过“穿红色衣服的人”、“打电话”等自然语言描述进行开放式检索。此外系统采用全模态向量化模型将视频内容转化为高维向量实现文本、图像、视频混合模态的融合检索支持多条件组合与模糊语义匹配快速定位目标画面满足安防监控、视频资产管理等复杂场景下的精准检索需求 技能演示 | Skill Demo▶️ 点击查看技能使用介绍 任务目标 | Goals1. 技能用途在长视频中根据用户提供的目标描述或关键词智能搜索定位包含特定目标的片段2. ️ 能力范围序号具体能力1常规目标检索检测特定物体/人物出现2自然语言智述检索用自然语言描述要找的内容3向量化模型匹配3. ⚡ 触发条件触发类型触发规则✅ 默认触发默认触发当用户需要在视频中搜索特定内容/目标时默认触发本技能进行视频检索分析 明确分析意图当用户明确需要视频搜索、视频检索时提及视频搜索、视频检索、找片段、定位目标、智能搜视频等关键词并且提供了视频文件和搜索描述 历史报告查询当用户提及以下关键词时自动触发历史报告查询功能查看历史搜索报告、视频搜索报告清单、搜索报告列表、查询历史搜索报告、显示所有搜索报告、视频检索分析报告查询视频搜索分析报告4. 自动行为自动行为执行要求 附件处理如果用户上传了附件或者视频/图片文件则自动保存为本地文件☁️ 历史报告查询如果用户触发历史报告查询关键词必须直接调用云端 API 查询不得从本地记忆或人工汇总中获取⚠️ 强制数据获取规则次高优先级橙色强约束历史报告清单只允许从云端接口读取不允许从本地记录、长期记忆或人工汇总中提取。必须执行python-mscripts.video_search_analysis--list类型要求✅ 必须使用python -m scripts.video_search_analysis --list调用 API 查询云端的历史报告数据 严格禁止从本地memory目录读取历史会话信息 严格禁止手动汇总本地记录中的报告 严格禁止从长期记忆中提取报告✅ 输出格式必须统一从云端接口获取最新完整数据然后以 Markdown 表格格式输出结果 前置准备 | Requirements依赖说明:scripts 脚本所需的依赖包及版本requests2.28.0 操作步骤 | Workflow 用户身份处理内部自动完成绿色安全原则用户身份参数由系统内部自动处理不得向用户展示、询问或要求输入任何身份标识。执行本技能分析或历史报告查询时脚本会自动完成身份初始化场景系统行为上游系统有内部身份参数由脚本静默接收并使用上游系统未提供内部身份参数脚本会自动复用本地缺省用户本地缺省用户不存在脚本会自动创建并在后续任务中复用对用户输出只展示分析进度、分析结果和报告链接不展示内部身份值 关键约束禁止/要求说明 不得询问身份不得提示用户输入用户名、手机号或任何内部身份参数 不得暴露身份值不得在回复、报告、示例、错误提示中暴露内部身份值 不得列为用户参数不得把内部身份参数列为用户需要理解或传入的参数✅ 自动关联报告历史报告查询同样由系统内部身份自动关联用户只需表达“查看历史报告/报告清单”等意图 标准流程 | Standard Flow步骤阶段执行动作1 准备视频输入提供本地文件路径或网络 URL确保输入内容清晰、符合技能场景要求2 系统自动完成身份关联无需用户输入任何身份参数不在回复中展示内部身份值3⚙️ 执行视频搜索智能分析调用-m scripts.video_search_analysis处理输入必须在技能根目录下运行脚本4 查看分析结果接收结构化分析报告查看识别/监测结果、风险提示、建议与报告链接⚙️ 脚本参数说明参数含义备注--input本地视频文件路径适用于本地文件分析--url网络视频 URL 地址API 服务自动下载API 服务自动下载网络资源--text搜索目标/自然语言描述说明要找什么内容按需填写--list显示历史视频搜索分析报告列表清单可以输入起始日期参数过滤数据范围用于云端历史报告查询--api-urlAPI 服务地址可选使用默认值按需填写--detail输出详细程度basic/standard/json默认 json输出详细程度--output结果输出文件路径可选可选️ 资源索引 | Resource Index资源类型路径用途何时读取 必要脚本scripts/video_search_analysis.py调用 API、执行分析或查询历史报告执行分析或查询时使用 必要脚本scripts/config.py调用 API、执行分析或查询历史报告执行分析或查询时使用 领域参考references/api_doc.md了解 API 接口规范、字段说明和错误码仅在需要了解接口规范或错误码时读取⚠️ 注意事项 | Notes分类注意事项 文档读取仅在需要时读取参考文档保持上下文简洁 格式支持支持格式mp4/avi/mov最大 1GB‍⚖️ 结果性质搜索结果仅供参考请以实际视频内容为准 脚本限制禁止临时生成脚本只能用技能本身的脚本 网络地址传入的网路地址参数不需要下载本地默认地址都是公网地址api 服务会自动下载 报告输出当显示历史分析报告清单的时候从接口返回 json 数据中提取字段 作为超链接地址且自动转化为如下 Markdown 报告输出表格输出示例 使用示例 | Examples# 在本地视频中搜索特定目标python-mscripts.video_search_analysis--input/path/to/life.mp4--text狗狗出现的片段在网络视频中用自然语言搜索 python-mscripts.video_search_analysis--urlhttps://example.com/event.mp4--text有人发言的片段显示历史搜索报告/显示搜索报告清单列表/显示历史视频搜索自动触发关键词查看历史搜索报告、历史报告、搜索报告清单等 python-mscripts.video_search_analysis--list# 输出精简报告python-mscripts.video_search_analysis--inputvideo.mp4--text汽车--detailbasic# 保存结果到文件python-mscripts.video_search_analysis--inputvideo.mp4--text人物出现--outputresult.json我们提供定制化AI技能开发服务。如果您有特定的业务需求可以联系我们的商务团队我们会为您量身打造专属的AI解决方案。

相关新闻

科技巨头AI资本竞赛:算力与融资策略解析

科技巨头AI资本竞赛:算力与融资策略解析

1. 科技巨头的AI军备竞赛:从技术战到资本战2025-2026年全球科技行业最引人注目的现象,莫过于七大科技巨头(微软、苹果、亚马逊、Alphabet、Meta、英伟达和特斯拉)在AI领域的总资本支出预计突破6500亿美元。这个数字相当于越南2025…

2026/7/23 15:34:17阅读更多 →
基于微信小程序的校园闲置物品交易平台

基于微信小程序的校园闲置物品交易平台

目 录 摘 要 Abstract 1 绪论 1.1 选题依据及意义 1.2 国内外研究现状 1.3论文结构安排 2开发环境与技术 2.1微信小程序 2.2 MySQL数据库 2.3 SSM框架 2.4 微信开发者工具 2.5 JDK 3 系统分析 3.1可行性分析 3.2系统性能分析 3.3 系统流程和逻…

2026/7/23 15:34:17阅读更多 →
TI Tiva C系列Hibernation模块实战:RTC、低功耗与防篡改设计

TI Tiva C系列Hibernation模块实战:RTC、低功耗与防篡改设计

1. 项目概述:为什么我们需要一个“不睡觉”的时钟? 在物联网传感器、智能门锁、便携式医疗设备这些需要常年靠电池“续命”的场景里,工程师们最头疼的问题之一,就是如何让设备在“睡着”的时候,还能知道“现在几点了”…

2026/7/23 15:34:17阅读更多 →
大模型Agent在智能客服中的实践与优化

大模型Agent在智能客服中的实践与优化

1. 大模型Agent与智能客服的现状与挑战当前大模型技术正在深刻改变智能客服领域的发展格局。根据最新行业报告显示,采用大模型技术的智能客服系统在用户满意度指标上比传统系统高出37%,首次问题解决率提升至85%以上。美团作为生活服务领域的头部平台&…

2026/7/23 17:04:41阅读更多 →
GPU资源获取、环境配置与深度学习优化实战指南

GPU资源获取、环境配置与深度学习优化实战指南

1. GPU技术背景与市场现状 在当今人工智能和深度学习快速发展的时代,GPU(图形处理器)已经从单纯的图形渲染工具演变为计算密集型任务的核心硬件。与传统的CPU(中央处理器)相比,GPU拥有数千个计算核心&#…

2026/7/23 17:04:41阅读更多 →
RAG技术:优化知识库,解决AI答非所问

RAG技术:优化知识库,解决AI答非所问

本文将深入剖析RAG的原理、当前痛点,并重点分享如何通过优化文档处理(如统一文档格式)让RAG发挥最大潜力,同时附上RAG架构图,帮助直观理解其工作机制。在AI大模型席卷全球的今天,Retrieval-Augmented Gener…

2026/7/23 17:04:41阅读更多 →
冲压自动化解决方案应用科普 智能制造落地优势与工艺适配

冲压自动化解决方案应用科普 智能制造落地优势与工艺适配

冲压自动化解决方案应用科普 智能制造落地优势与工艺适配 现代冲压制造业的智能化转型,核心在于生产工艺的标准化管控与生产流程的精细化升级。传统冲压生产模式受人为因素、设备工况、工序衔接等多重因素影响,普遍存在生产参数不统一、产品质量波动大、…

2026/7/23 17:04:41阅读更多 →
基于YOLO与SpringBoot的智能杂草检测系统实践

基于YOLO与SpringBoot的智能杂草检测系统实践

1. 项目概述:当YOLO遇上SpringBoot的智能杂草检测去年在帮朋友解决农场杂草问题时,我发现市面上大多数检测方案要么价格昂贵,要么识别率堪忧。于是决定自己动手搭建一套高性价比的解决方案。这个系统整合了YOLO系列最新算法和SpringBoot技术栈…

2026/7/23 17:04:41阅读更多 →
OpenClaw Docker部署指南:AI网关工具快速搭建

OpenClaw Docker部署指南:AI网关工具快速搭建

1. OpenClaw初探:从零开始的Docker部署指南 OpenClaw作为一款新兴的AI网关工具,正在开发者社区中快速走红。它最吸引我的地方在于能够将各种AI模型和服务整合到一个统一的接口中,这对于需要同时对接多个AI提供商的开发者来说简直是福音。通过…

2026/7/23 17:02:41阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/23 0:56:31阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/23 0:56:31阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 0:56:31阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:00:28阅读更多 →
从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:28阅读更多 →
油泥处理设备哪里能买到

油泥处理设备哪里能买到

油泥处理设备哪里有?这是许多从事油田、炼化、清罐业务的从业者最关心的问题。根据河南三丰环保设备有限公司的行业经验,选购油泥处理设备的核心在于设备能否适配当地环保法规与原料特性,而非单纯看价格。该公司总经理王钦田先生指出&#xf…

2026/7/23 0:00:28阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/22 22:56:18阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/22 18:55:50阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/22 18:55:50阅读更多 →