Skip to content

SenseClaw:商汤科技推出的视觉AI助手,让OpenClaw看懂世界

2026年4月8日

SenseClaw:视觉世界的「智能龙虾」

商汤科技正式推出 SenseClaw —— 一款专为视觉理解场景打造的 AI 助手。

这款产品基于 OpenClaw 框架,融合商汤日日新大模型,让 AI 不仅能"说话",更能"看懂"世界。

核心能力

能力说明
图像理解深度理解图片内容
视频分析逐帧理解+时序分析
文档识别OCR+版面分析
视觉推理基于图像的逻辑推理
多模态对话图像+文字融合交互

视觉场景深度定制

1. 图像理解

yaml
senseclaw:
  vision:
    capabilities:
      - object_detection
      - scene_understanding
      - emotion_recognition
      - text_recognition
      - style_analysis
      
    output:
      - detailed_description
      - structured_tags
      - semantic_analysis

场景示例

上传:一张商业会议照片
→ SenseClaw 分析:
  - 场景:商业会议
  - 人数:8人
  - 氛围:严肃认真
  - 关键人物:左侧男士
  - 会议主题:(根据PPT推测)
  - 情绪分析:专注、略有压力

2. 视频理解

yaml
senseclaw:
  video:
    frame_sampling: intelligent
    analysis:
      - scene_detection
      - action_recognition
      - speech_transcription
      - key_moment_extraction

3. 文档识别

yaml
senseclaw:
  document:
    ocr:
      languages: [中文, 英文, 日文, 韩文]
      formats: [pdf, 图片, 扫描件]
      
    layout:
      - 标题检测
      - 表格识别
      - 公式识别
      - 手写识别

商汤生态集成

产品集成方式
日日新大模型核心视觉能力
商量大模型对话理解能力
书生大模型图像编码能力
视觉AI平台企业级服务

应用场景

场景使用案例
电商商品图自动生成描述
医疗影像辅助分析
制造质检自动化
教育作业批改
安防智能监控

未来展望

SenseClaw 的推出意味着:

  1. 视觉AI普及:商汤顶级视觉能力通过 OpenClaw 走向大众
  2. 多模态融合:图像+语言+动作的完整理解
  3. OpenClaw 视觉落地:视觉场景成为新赛道

让 AI 不仅能说,更能看懂这个世界。


SenseClaw 正在灰度测试中

不要孤军奋战啦!

加入微信群一起学习交流 AI

与大神一起使用 OpenClaw、Hermes、Claude Code、Seedance 2.0、GPT-Image-2 等

微信公众号

扫码关注微信公众号
私信 "加群",将自动获取微信群二维码

探索 AI 世界,掌握智能未来