Dsh Omc Tui banner
ipromise2021 ipromise2021

Dsh Omc Tui

Development community

Description

DeepSeek Harness (DSH) 原生全功能终端交互界面 · Claude Code-styled Terminal TUI & CLI for DeepSeek Harness

Installation

This entry records only its repository, not the path inside it, so there is no exact command to give. Open the source below and copy the folder into ~/.claude/skills/, or the file into ~/.claude/agents/.

README

DSH OMC TUI

[![GitHub](https://img.shields.io/badge/GitHub-ipromise2021%2Fdsh--omc--tui-181717?style=flat-square&logo=github)](https://github.com/ipromise2021/dsh-omc-tui) [![License: MIT](https://img.shields.io/badge/License-MIT-blue.svg?style=flat-square)](LICENSE) [![DeepSeek Harness](https://img.shields.io/badge/Harness-0.1.1--rc.1-00bcd4?style=flat-square)](https://github.com/deepseek-ai/deepseek-harness) [![Node.js](https://img.shields.io/badge/Node.js-20%2B-green?style=flat-square)](package.json)

**DeepSeek Harness 的终端原生 TUI**

保留终端 Scrollback,提供自主决策视觉 Subagent、多模态图片直贴、行内审批、Plan/Jobs、模型选择和上下文状态栏。

[架构与全功能实现](ARCHITECTURE.md) · [界面与设计说明](PRODUCT_SHOWCASE.md) · [兼容性记录](HARNESS_COMPATIBILITY.md) · [变更日志](CHANGELOG.md)

![DSH OMC TUI 主界面](assets/welcome.png)

`dsh-omc-tui` 是面向 [DeepSeek Harness](https://github.com/deepseek-ai/deepseek-harness) 的 ANSI 终端界面插件。

插件专注于终端渲染与键盘交互;模型、会话、工具、权限、后台任务及持久化均由 Harness 官方服务提供。

个人比较喜欢 Claude Code 终端的交互方式,项目参考了它的习惯,适合希望在终端中使用 DSH,同时保留滚轮回看、文本选择和复制体验的用户。

**个人尝试开发**的插件工具,功能会按需扩展,Bug 也会持续修复。欢迎使用、点 Star 和反馈问题。

插件功能

保留终端 Scrollback

不进入备用屏幕。对话、工具调用、Thinking 和 Diff 会追加到终端普通缓冲区,可以直接滚动回看和选择复制。

Harness 原生集成

会话恢复、Plan 模式、权限审批、Jobs、Skills、模型和图片附件都使用 Harness 官方服务与 durable event。TUI 只负责展示和交互。

智能视觉 Subagent(全自动自主决策识别)

deepseek-v4-pro/flash等纯文本模型,不具备直接接收多模态图片的能力。传统方案往往要求用户**手动切换全局模型**、**手动调用特定技能/插件**,或在外部识别后再复制文本,严重打断编程思路。

`dsh-omc-tui` 插件实现了 **零手动干预的自主旁路视觉架构(说人话就是子代理,主agent会自主分配给该代理执行)**:

  • 图片无感直贴:支持在终端直接按 Cmd/Ctrl+V 粘贴 macOS 剪贴板图片,或通过 iTerm2 OSC 1337、Kitty Graphics 协议直接发送图片。图片通过 Harness Attachment 管道自动管理与落盘。
  • Agent 自主决策调用用户无需手动使用技能、无需手动执行插件命令,也无需临时切换主模型。主 Agent(纯文本/代码模型)在接收到带图片上下文的提问时,会结合当前任务意图自主判断何时需要读取图片,并在需要时自动触发底层的 analyze_image 视觉工具。
  • 瞬时旁路 Sidecar Subagent:TUI 在后台动态拉起一个隔离的临时视觉 Subagent,定向解析图像细节、提取 OCR / UI 布局信息后立即销毁。
  • 主会话无缝协同:视觉识别结果以标准工具结果形式返回给主 Agent,主模型保持原有的模型身份、推理链与上下文记忆继续处理任务,既享受了主模型的纯粹代码推理能力,又获得了强大的多模态感知。

**💡 视觉子代理模型与 API Key 配置提示**: