Hermes Web UI 外网访问与 Android App 连接:ngrok 反向隧道实战
1:结论与适用范围
这篇文章记录一次在 Windows + WSL2 环境中,将本机 Hermes Web UI 通过 ngrok 发布为 HTTPS 地址,并用 Android 的 Hermes Agent WebUI App 连接访问的完整过程。
这篇文章记录一次在 Windows + WSL2 环境中,将本机 Hermes Web UI 通过 ngrok 发布为 HTTPS 地址,并用 Android 的 Hermes Agent WebUI App 连接访问的完整过程。
Go 应用 -> JSON 日志文件 -> Filebeat -> Logstash -> Elasticsearch -> Kibana;| 组件 | 职责 | 本文端口 |
|---|---|---|
| Go 应用 | 生成逐行 JSON 业务日志 | 无 |
| Filebeat | 追踪文件读取位置,将新增日志发送给 Logstash | 无 |
| Logstash | 通过 Beats input 接收事件,并写入指定索引 | 5044,监控 API 9600 |
| Elasticsearch | 存储、索引和查询日志 | 9200 |
| Kibana | 创建 Data View,使用 KQL 检索日志 | 5601 |
数据流如下:
目的:把前面关于 Hermes Team 拆分、Profile 创建、角色职责、命令报错、执行步骤、后续任务的讨论整理成一个可直接落地执行的
hermes-team.md文档。
1: sql2go sql 语句转换为 Go 结构体,使用 ddl。 http://stming.cn/tool/sql2go.html
2: json2go 将 json 格式转为 Go struct https://mholt.github.io/json-to-go/
3: toml2go 将编码后的 toml 文本转为 Go struct https://xuri.me/toml-to-go/
4: curl2go 将 curl 命令转为 go 代码 https://mholt.github.io/curl-to-go/
平常用 Claude Code、Codex、Cursor 这类 AI Coding Agent 时,一个很常见的问题是:每次问一个稍微复杂一点的问题,AI 都会重新读一遍整个项目。
最近看 AI Coding 工具的使用成本时,一个很容易被忽略的问题不是“模型推理本身有多贵”,而是 AI 为了理解代码,要先读掉多少无关上下文;
| |
session:一个独立会话,像一整套工作台window:会话里的标签页pane:窗口里的分屏你现在最需要会的是:
https://mp.weixin.qq.com/s/AocomOFTTr2V0PPL2rKiRAcontent/post/C++ 目录文章风格整理,核心关注点是低延迟行情链路中的 CPU 绑核设计。irqbalance 会自动平衡硬件中断;irqbalance,然后手动规划网卡队列和 CPU 的对应关系。 | |
pthread_setaffinity_np;std::thread 或 std::jthread,可以封装一层通用 helper,避免到处散落平台细节; | |
cpu_id 做合法性检查,避免绑定到不存在的核心;sched_getcpu() 验证;| 线程类型 | 建议 CPU | 设计原则 |
|---|---|---|
| 行情接收线程 | CPU 0-3 | 与网卡队列一一对应,独占物理核 |
| 排序线程 | CPU 4-7 | 与接收线程相邻,减少跨核通信 |
| 串行核心线程 | CPU 8 | 独占核心,承载策略主链路 |
| 监控 / 日志线程 | CPU 15 | 放在非关键核或低优先级资源上 |
isolcpus 用于把指定 CPU 从常规调度域里隔离出去;nohz_full 用于减少指定 CPU 上的调度 tick;rcu_nocbs 可以让指定 CPU 避开 RCU callback 的干扰; | |
sched_getcpu(); | |
taskset -cp <pid> 查看某个线程或进程的 CPU 亲和性;ps -eLo pid,tid,psr,comm 观察线程实际落在哪个 CPU 上。 | |
perf stat; | |
| |
lstopo 查看。行情模块绑核的目标,不是为了“看起来专业”,而是为了降低链路中的非确定性;
很多人刚开始用 Claude Code 时,最先关注的是模型强不强、上下文长不长、生成速度快不快。 但真正用一段时间后就会发现,拉开人与人差距的,往往不是模型本身,而是你有没有把一批高频、稳定、可复用的 Skills 装进自己的工作流。