-
多模态图像识别与OCR文字提取技能
2026年8月28日 30 93 20
技能概述 image-reader 是一款基于多模态大模型的图像识别与理解工具,隶属于设计媒体(design-media)类别下的图片编辑与视觉素材子领域,当前版本为 1.0.0。它能够对用户提供的截图、照片、海报等图像进行深度分析,并支持高精度的 OCR 文字提取,帮助用户快速获取图像中的关键信息。 该技能依托 Doubao 多模态模型(如...
-
多模态图像视频生成技能
2026年8月28日 30 152 85
技能概述 本技能为设计媒体领域的多模态内容生成工具,版本1.0.0,覆盖图片生成与视频处理两大子领域。通过统一的AIsa API密钥,即可调用Gemini 3 Pro Image生成图片,以及Qwen Wan 2.6生成视频,实现高效的媒体创作。 技术基础依托于AIsa API,支持图片生成(Gemini...
-
多模态图像描述生成模型评估数据集
2025年7月4日 30 185 93
多模态图像描述生成模型评估数据集_Multimodal_Image_Captioning_Model_Evaluation_Dataset 数据来源:互联网公开数据 标签:图像描述, 多模态, 深度学习, 模型评估, 计算机视觉, 自然语言处理, 图像识别, 对比学习 数据概述:...
-
多模态图像_文本关联数据集
2025年9月22日 30 1 0
多模态图像_文本关联数据集_Multimodal_Image_Text_Association_Dataset 数据来源:互联网公开数据 标签:图像识别, 文本描述, 多模态, 图像检索, 计算机视觉, 自然语言处理, 数据清洗, 图像标注 数据概述: 该数据集包含来自互联网的图像及其对应的文本描述,用于研究图像与文本之间的关联。主要特征如下:...
-
多模态单细胞整合数据集
2025年4月20日 30 180 178
多模态单细胞整合数据集 数据来源:互联网公开数据 标签:单细胞分析,多模态数据,交叉验证,超参数优化,过拟合控制,数据集索引,机器学习 数据概述:...
-
多模态内容摘要与生成技能
2026年8月28日 30 175 12
技能概述 Summarize 技能是一款面向知识管理场景的多模态内容摘要与生成工具,属于知识管理类别下的摘要总结子领域,当前版本为 1.0.0。它通过 summarize CLI 实现对网址或本地文件(包括网页、PDF、图片、音频、YouTube 视频)的智能摘要,帮助用户快速提取关键信息,提升信息处理效率。 该技能以 SkillBoss...
-
多模态PDF文档深度解析与表格图表提取技能
2026年8月28日 30 136 23
技能概述 pdf-ocr-layout 技能是一款基于智谱 GLM-OCR、GLM-4.7 及 GLM-4.6V 的多模态文档深度解析工具,属于办公效率领域下的文档处理与 PDF 处理子领域,当前版本为 1.0.2。该技能专注于从 PDF 或图片中高精度提取表格并转换为 Markdown...
-
多模态AI预测数据集
2025年4月26日 30 179 100
多模态AI预测数据集 数据来源:互联网公开数据 标签:多模态AI,加密货币,时间序列,价格预测,社交媒体分析,自然语言处理,机器学习 数据概述: 本数据集用于多模态AI预测任务,包含训练集和测试集两部分。训练集包括加密货币的价格数据和相关社交媒体 tweets 数据,测试集则包含相似格式的 tweets 数据及对应的价格数据。 训练集:...
-
多模态AI内容创作一站式平台技能
2026年9月8日 30 118 102
技能概述 IMA Studio All-in-One 是一款面向设计媒体领域的多模态AI内容创作技能,版本1.0.10,子领域覆盖图片生成、视频处理与音频处理。该技能作为统一入口,集成图像、视频、音乐及语音合成领域的领先模型,旨在为用户提供一站式的AI创作体验。...
-
多模型预测结果集成数据集
2025年11月12日 30 197 165
多模型预测结果集成数据集_Multi_model_Prediction_Aggregation 数据来源:互联网公开数据 标签:模型融合, 预测结果, 数据集集成, 机器学习, 预测分析, 时序预测, 交叉验证, 模型评估 数据概述: 该数据集包含多个机器学习模型对同一问题的预测结果,以及对应的模型文件。主要特征如下:...
-
多模型集成预测结果数据集
2025年7月12日 30 151 26
多模型集成预测结果数据集_Multi_Model_Ensemble_Prediction_Results 数据来源:互联网公开数据 标签:机器学习, 模型集成, 预测结果, 分类任务, CatBoost, LightGBM, XGBoost, 交叉验证 数据概述: 该数据集包含多个机器学习模型(CatBoost, LightGBM,...
-
多模型融合结果预测数据集
2025年7月31日 30 145 51
多模型融合结果预测数据集_Multi_model_Fusion_Prediction_Results 数据来源:互联网公开数据 标签:模型融合, 机器学习, 预测结果, 二元分类, 多分类, 模型评估, 概率预测, 数据分析 数据概述: 该数据集包含多个模型融合后的预测结果,主要用于评估模型融合的效果以及分析不同模型间的差异。主要特征如下:...
-
多模型文字转自然语音合成技能
2026年9月5日 30 19 10
技能概述 Text To Speech 技能是一款基于 inference.sh 命令行工具的多模型文字转语音合成工具,隶属于设计媒体类别下的音频处理子领域,当前版本为 0.1.5。该技能将文本输入转换为自然流畅的语音输出,支持多种先进 TTS 模型,覆盖从会话型、通用型到情感控制、长音频生成等多种需求。 技能依托 inference.sh CLI...
-
多模型图片视频生成技能
2026年8月28日 30 49 48
技能概述 图片视频生成技能是一款面向设计媒体领域(design-media)的AI技能,版本号为1.0.0,专注于图片生成与视频处理两大子领域。该技能通过调用banana、sora、veo等业界领先的生成模型,为用户提供从静态图片到动态视频的全链路生成能力,适用于图片、视频及短剧素材的专业化生产场景。...
-
多模型LLM令牌用量监控与成本优化技能
2026年8月28日 30 157 116
技能概述 Token Manager 是一款通用的 LLM 令牌管理器,属于数据分析类别下的数据洞察与指标监控子领域,当前版本为 1.2.0。该技能旨在帮助用户监控 Kimi、OpenAI、Anthropic、Gemini 以及本地模型的令牌使用情况,并提供节省成本的建议。 技能基于多模型 API...
-
多模型AI图片生成技能
2026年8月28日 30 117 69
技能概述 本技能为AI图片生成技能,版本1.0.0,属于设计媒体类别下的图片生成子领域。它通过调用SiliconFlow API,支持多种先进图像生成模型,包括Kolors、FLUX系列和Qwen-Image,为用户提供高质量的图片生成能力。 技术上,本技能基于SiliconFlow...
-
多模型AI图像生成与编辑技能
2026年8月28日 30 19 6
技能概述 本技能「Ai Image Generation」是一款面向设计媒体领域的 AI 图像生成与编辑工具,版本为 0.1.5,子领域覆盖图片生成与视觉素材。它通过 inference.sh CLI 提供统一的命令行接口,支持超过 50 种前沿图像模型,涵盖文本生成图像、图像编辑、修复、放大等多种能力,是创意工作者与开发者的高效视觉资产生产工具。...
-
多框架合规评估与SBOM生成技能
2026年8月28日 30 195 7
技能概述 agent-bom compliance 是一款面向 IT 运维安全领域的 AI 合规与策略引擎,当前版本为 0.97.2。它专注于安全扫描结果的多框架合规评估,支持 OWASP、NIST、SOC 2、ISO 27001、CMMC、EU AI Act、AISVS v1.0 等主流安全与隐私标准,并能够生成...
-
多框架合规审计与风险优先整改技能
2026年9月8日 30 82 11
技能概述 Compliance Audit Generator 是一款面向组织的内部合规审计自动化技能,属于专业服务领域的法律合规与风险风控子领域,当前版本为 1.0.0。该技能旨在帮助企业无需聘请外部顾问即可开展内部合规审计,覆盖 SOC 2、ISO 27001、GDPR、HIPAA、PCI DSS、SOX 和 CCPA/CPRA 等主流合规框架。...
-
多格式日志解析与实时监控分析技能
2026年8月28日 30 193 188
技能概述 本技能为 Log Analyzer,属于 IT 运维安全类别下的日志分析子领域,版本 1.0.0。它是一款专业的日志解析与监控工具,旨在帮助开发者和运维人员高效处理各类应用程序日志。 技能基于 Python、grep、awk、jq 等常用命令行工具构建,覆盖多种日志格式,包括纯文本日志、结构化 JSON...



