GLACIER AI · 产品资料

AI 资料中心

Berserk 是 Glacier ai 的核心自有大模型系列。AI Tools 和聚合站分别提供任务工具与模型接入。

Berserk 自有大模型系列

包括对话、文生图、文生视频等单模态与跨模态模型。

产品定位:接近对标模型效果,Token 售价为对应对标模型当日市场最低价的 50%。参考价格每日更新或浮动,实际价格以当日报价为准。此处展示产品规则,不是实时市场报价。

聚合站

国内模型统一接入,协议收敛、密钥和调用按项目开通。

原有接入介绍涵盖通义千问、文心、智谱、Kimi、DeepSeek、豆包、混元和星火;具体模型版本与接口在接入时确认。

AI Tools

六类、84 项功能介绍,涵盖视频、文字、图像、语音、跨模态、时序与感知。超分、画质增强、AI 降噪与码率恢复是 AI Tools 下属能力。

查看原始图片与视频演示 ↗

完整功能目录

文生视频与图生视频

根据文本提示或参考图生成视频片段,用于创意内容、广告素材、预演。

视频超分与插帧

提升视频分辨率、帧率,改善流畅度与清晰度,适用于老片修复、慢动作。

视频高光检测与自动剪辑

自动识别精彩片段并剪辑成短片,用于赛事、直播、短视频生产。

视频去字幕

检测并移除视频中硬字幕,便于二次配音、多语言分发。

视频去水印

定位并去除视频水印/台标,用于素材清洗与合规处理。

视频稳定与防抖

消除手持拍摄抖动,输出平稳画面,提升观看体验。

视频抠像与背景替换

分离前景人物与背景,支持虚拟背景、绿幕替代。

动作与事件识别

识别视频中的人体动作、行为事件,用于安防、体育、工业监控。

活动、跌倒与疲劳检测

面向养老、工地、驾驶场景,检测跌倒、疲劳、异常活动并告警。

视觉异常检测

从视频中识别偏离正常模式的异常,用于产线、巡检、安防。

多目标跟踪

在视频中持续跟踪多个目标,输出轨迹 ID,用于人流、车流分析。

目标检测与多目标跟踪

检测视频/图像中的目标并持续跟踪,支撑计数、测速、行为分析。

轨迹预测与运动规划

预测行人/车辆/机器人未来轨迹,用于自动驾驶、机器人避障。

口型同步与数字人播报

让数字人口型与语音对齐,用于虚拟主播、播报、客服。

视觉语言动作与抓取

结合视觉与语言指令驱动机器人抓取,用于具身智能。

通用写作与对话

文本生成、改写、问答、多轮对话,覆盖通用助手场景。

摘要与改写

长文压缩、风格改写、要点提炼,用于报告、资讯、会议纪要。

机器翻译与本地化

多语言互译与本地化润色,支持文档、界面、字幕。

文本内容审核

识别违规、暴恐、色情、广告等文本,用于社区与内容平台。

文本向量与语义相似度

将文本编码为向量,支持语义检索、去重、聚类、相似匹配。

实体与关系抽取

从文本中抽取人物、机构、事件及其关系,构建知识图谱。

情感与观点分析

判断文本情感极性、观点倾向,用于舆情、评论、客服质检。

意图识别与槽位抽取

理解用户意图并抽取关键槽位,用于对话系统、工单分流。

表格分类与风险评分

对表格/表单分类并输出风险分,用于风控、合规、审核。

字段与表单抽取

从合同、票据、表单中抽取结构化字段,用于录入自动化。

文本语种识别

自动判断文本语种,用于路由、翻译前置、内容分发。

语种识别

识别语音/文本语种,用于多语言客服、会议系统。

PII/PHI 检测与脱敏

检测个人身份信息与健康信息并脱敏,满足隐私合规。

AI 安全检测与响应

识别提示注入、越狱、有害内容等风险并触发响应策略。

因果推断与增益模型

估计干预因果效应与增量收益,用于营销、运营、定价。

图谱、反欺诈与关系风险

基于图谱挖掘团伙、关联风险,用于反欺诈与风控。

文生图与参考图生成

文本或参考图生成图像,用于创意、设计、营销素材。

修补、扩图与可控编辑

局部重绘、外扩、可控编辑,用于修图、电商、设计。

图像分类与细粒度识别

识别图像类别与细粒度子类,用于质检、归档、识别。

OCR 文字识别

识别图像中的文字,支持票据、证件、文档、场景文字。

版面、表格与公式解析

解析文档版面、表格结构、数学公式,用于文档数字化。

人脸检测识别与活体

人脸检测、比对、活体判断,用于门禁、核身、安防。

姿态、手势与关键点

识别人体姿态、手势、关键点,用于交互、健身、动画。

医学影像检测与分割

检测与分割病灶、器官,用于辅助诊断与科研。

监督式缺陷检测

基于标注样本检测产品表面/内部缺陷,用于工业质检。

视觉测量与对位

测量尺寸、位置、对齐度,用于精密制造与装配。

开放词汇检测与分割

用自然语言描述目标进行检测与分割,无需固定类别。

图像与视频分割

语义/实例/全景分割,用于抠图、标注、分析。

三维重建与数字孪生

从图像/点云重建三维场景,用于孪生、测绘、仿真。

深度估计

估计单目/双目深度,用于自动驾驶、AR、机器人。

超分、去噪与去模糊

图像增强与修复,用于画质提升、老照片修复。

文本/图像生成 3D 资产

由文本或图像生成三维模型/资产,用于游戏、电商、元宇宙。

语音转文字 ASR

将语音转写为文本,用于会议、客服、字幕。

文字转语音 TTS

将文本合成为自然语音,用于播报、有声内容、无障碍。

实时语音客服与业务代理

实时语音交互并执行业务动作,用于呼叫中心、语音助手。

语音到语音翻译

端到端语音翻译,保留音色与韵律,用于跨语言沟通。

语音克隆与转换

克隆音色或转换语音风格,用于配音、个性化 TTS。

说话人分离

区分不同说话人,用于会议纪要与多说话人转写。

声纹识别与验证

基于声纹确认身份,用于核身、反欺诈。

唤醒词检测

检测指定唤醒词,用于语音助手低功耗唤醒。

语音活动检测 VAD

检测语音段与非语音段,用于降本、切分、实时交互。

降噪与语音增强

抑制噪声、增强人声,用于通话、录音、会议。

回声消除与去混响

消除回声与混响,用于免提通话、会议室音频。

环境声音识别

识别环境中的声音事件,用于安防、工业、城市感知。

音乐与音效生成

生成音乐、音效,用于内容创作、游戏、短视频。

RAG 知识问答

检索增强生成,基于企业知识库问答,降低幻觉。

文档问答与比较

对多文档问答、对比、摘要,用于合同、报告、论文。

企业知识助手

面向企业内知识检索、问答、写作的综合助手。

多模态检索

以文搜图/视频、以图搜文等跨模态检索。

视觉问答与场景理解

结合图像与问题作答,用于无障碍、教育、巡检。

实时多模态助手

实时处理语音、图像、文本的交互助手。

工具调用与工作流代理

调用外部工具/API 编排工作流,完成复杂任务。

GUI 与浏览器代理

操作图形界面与浏览器完成任务,用于自动化与 RPA。

编码与 DevOps 代理

代码生成、理解、审查、运维自动化。

代码生成与理解

代码补全、生成、解释、重构、单测生成。

研究与运营多代理编排

多智能体协作完成研究、运营、分析任务。

个性化排序

基于用户行为个性化排序,用于推荐、搜索、广告。

候选召回与相似推荐

召回候选并做相似推荐,用于电商、内容、社交。

语义搜索与重排序

语义召回 + 重排,提升搜索相关性。

预测性维护与剩余寿命

结合多源数据预测设备故障与剩余寿命。

流式异常与变化检测

对流式数据实时检测异常与突变。

时间序列预测

对时序数据做趋势、周期、异常预测。

排程、路径与资源优化

求解排程、路径、资源分配优化问题。

AMR 导航与调度

移动机器人导航、避障与多机调度。

无人机与现场自主巡检

无人机自主巡检、识别与告警。

多传感器感知与融合

融合摄像头、雷达、激光雷达等多传感器感知。

IMU/雷达/激光雷达融合

融合惯性、雷达、激光雷达数据做定位与感知。

视觉惯性 SLAM

视觉 + 惯性里程计与建图,用于机器人与 AR。

负荷与环境预测

预测电力负荷、环境指标,用于能源与城市管理。

产品入口

Berserk 模型 · AI Tools · 聚合站

GLACIER AI

从你的需求开始。

告诉我们你感兴趣的产品、现有系统与预期目标。

shenzhongchang@glacier.fit

具体产品范围、配置与开通方式,以沟通结果为准。