Finer04's Blog
首页
乱写一通
脑洞破文
随便谈谈
当前播放.page
我对 Hermes-Agent 的折腾
Finer04
August 8, 2026
1465 字
文章目录
今天四月的时候公司领导说要全面推行 AI 增效工作,那个时候外界天天被 openclaw 炒得热火朝天。我当时也想试试龙虾的话但我那天在知乎文章测评中就被那个 hermes 的特性吸引住了,毕竟有长期记忆和自动做技能这工作更加适合我在公司的工作流。所以我就折腾了四个月,也真他吗痛苦。 ## 模型选择 由于我的工作流太多涉及政务相关的内容,我不敢用线上模型,用着公司的 5090 显卡装了个 LM Studio 去跑私有 LLM 模型,截止现在已经决定长期用 `ornith-1.0-35B-MoE` 了,除非后面有更牛逼的。 在此之前我也在用千问 3.6-35B 还有蒸馏了 Claude opus 4.7 的千问模型,但说真的效果真的令我无法接受,好多问题都绕了很多大弯。后面也通过 27B 的 Dense 模型,公司就算是 32G 显存但跑稠密的 27B 直接干废显卡。当然其实 ornith 也是基于千问模型做了后训练,水平也高不到哪里去,但至少相比之前用过的模型稍微是聪明了一点,很多任务至少比之前的模型少了折腾一问就对。 然后千问本来是有视觉模型的,但 ornith 砍掉了视觉模型,所以我跟某只大鲸鱼一样也是瞎子,我的工作流有一个是识别策略工单的任务,需要借助 OCR 识别才可以。我也在 SkillHub 找了一些本地的 OCR 模型的 skill,安装后进行识别质量真的一般般,还要让 AI 做数据清洗还是太累了。于是我又拿了公司闲置没怎么用的 3090 显卡跑智谱的 `GLM-OCR` 0.9B 模型融合到我的工作流 Skill,结构化输出和准确率已经基本够用。 实在遇到私有模型没办法解决的事情,我以前还是把跟 AI 聊天记录发给 DS 或豆包问,不过上周开始就有 AGENT TO AGENT 的功能在,我就开始遇到长时间内耗的问题直接让 hermes 委托我的 deepseek-v4-flash 请教特殊问题才能快速闭环问题。 所以说,用私有模型好处是 token 无上限,但水平和上下文一直是硬伤,上下文一压缩就质量指数级下降,所以我建议做长线工作交给线上模型比较好,短线用私有模型就行。这只能说做取舍吧。说到这个就想起我6月份用 AI 做平台花了我 200 块的 token 还没报销就想哭。毕竟还没有成品也不好报销。研发就爽咯天天用中转站跑 GPT 做平台。 ## 我的工作流 之前就用私有模型做了很多切合我工作场景的事情,但怎么说想法是好的刚开始做也是好的,后面也是逐渐失控起来。所以人家说想养马好,初期最好用线上模型打个底炼化优质 Skill,在实际工作才用私有小模型去执行是最好的。 ### 工作聊天群自动总结工单 由于历史原因,我们跟客户厂商沟通群全都是个人微信而不是企业微信,就算是企业微信用 `wecom-cli` 也有限制只能给10人企业以下才可以看聊天记录。所以前期我用了 wx-cli (已经失效了)和现在的某某工具的 MCP 工具定时获取所有聊天群的信息,再通过私有模型分析连续聊天记录后自动总结工单。 但问题就出在后面的定时任务太容易忘记事,到了后面的登记表格越来越不符合规范,全是乱填。事情也不总结了直接拿用户的 “好的”当成事件看。其实后面最好还是搞个 Sub-Agent 比较好,这样总结的质量才会高。不过现在这个我已经暂时停掉了,等后面再弄。 ### 还有其他,有心情再更新
发表评论
称呼
*
Email
*
网站
提交评论
▲ Top
发表评论