Hermes CLI 提示(上):基本命令用法与环境配置

Hermes CLI 提示(上):基本命令用法与环境配置 ««««« DO NOT LOCALIZE — img src=https://images.unsplash.com/photo-205126 »»»»» hermes run "在 ~/project 下写一个 Python 脚本 分析最近半年 Git 提交频率" 上述命令将创建一个独立的 Hermes 实例,自动切换到你的项目目录,编写并执行脚本,最后返回结果。无需预装环境,无需额外对话。 将 Hermes 用于个人搜索助手: cat ~/archive/research-notes/**/*.md | hermes run "从上述文件中归纳出适合『下岗职工』话题且可能引起争议的部分,每点不超过 24 字"

2026年6月1日 · 阅读 加载中… · NFY

Hermes Agent 记忆系统详解:机器人进化闭环的5层实现

Hermes Agent 记忆系统详解:机器人「进化闭环」的5层实现 ««««« DO NOT LOCALIZE — img src=https://images.unsplash.com/photo-229828 »»»»» 在 Hermes 项目的主 config.yaml 里,记忆设置被锐化为两个核心指令: memory: max_user_tokens: 1536 # 用户Profile上限 max_memory_tokens: 2048 # LTM的总token数上限

2026年6月1日 · 阅读 加载中… · NFY

Hermes 快速上手:CLI 终端的高效对话模式

核心原则:命令式交互 Hermes 是为行动设计的,而非解释或规划。模糊的指令会触发不必要的明确化请求(如"你是想让我部署博客吗?"),而命令式语句则直接触发执行。 低效示例(会被打断): “如何部署 Hugo 博客到 Vercel?” 高效示例(直接执行): “部署 Hugo 博客到 Vercel,使用默认配置” 1.1 直击要害 部署:直接说 部署 Hugo 博客,Hermes 会自动调用 npx vercel deploy --prod --yes。 调试:检查 Vercel 构建日志 会触发 npx vercel logs --prod。 修改文件:在 hugo.toml 添加 Umami 配置 会调用 patch 工具。 2 避免的坑 2.1 工具明确性 Hermes 会优先选择最合适的工具执行任务,但有时可能猜错(如误用 web_search 查找本地文件)。在复杂任务中明确指定工具: # ❌ 低效 "给博客加个 RSS" # ✅ 高效 "修改 hugo.toml 启用 RSS,使用 patch 工具" 2.2 文件路径 始终使用绝对路径(如 /root/hugo-blog/hugo.toml),避免相对路径的歧义。Hermes 默认以用户的 home 目录(/root)为起点,但不会假设项目路径。 ...

2026年6月1日 · 阅读 加载中… · NFY

农村光棍的AI生存指南:下岗职工转型样本

农村光棍的AI生存指南:下岗职工转型样本 ««««« DO NOT LOCALIZE — img src=https://images.unsplash.com/photo-1513622470522-26c3c8a854bc »»»»» 人口问题最终不是“人口红利结束”,而是“社会结构开始腐败”。 在沿海制造业城市打工的王永贵(化名,河南周口人,42岁),两年前工厂倒闭后一度陷入迷茫。今年一月,他在村里弟弟的介绍下尝试AI模型制作农业政策解读短视频,粉丝量迅速突破5万,视频平台的广告分成开始超过之前的工资。

2026年6月1日 · 阅读 加载中… · NFY

OPC一人公司实操指南:从月入三千到撬动企业订单

最近读了一篇清华大学技术创新研究中心对绛烨的访谈,核心数据很刺眼:技术只占OPC成功要素的30%,剩下的70%是商业判断、客户需求感知、精力管理。 这对习惯"先学技术再找客户"的人是当头一棒。但换个角度想,这也意味着——现在入行OPC,反而比技术极客更有优势。 如果你现在月薪5k以下,这篇是专门写给你的 别再看那些"年入百万AI创业"的爽文了。真正适合新手的OPC路径,是边赚边学、用小单养大单。以下是基于访谈整理的可执行版路线图,每一步都有具体的行动指令。 第1关:工具入门(第1-2周) 你不是在"学习AI",你是在搭建自己的数字员工团队。 不要这样做: ❌ 研究GPT-4和Claude的区别 ❌ 背诵各种提示词模板 ❌ 追求"精通所有模型" 正确做法是: 场景 工具 你要用它解决什么问题 写内容 ChatGPT/Claude 让客户觉得"这个人专业"的文案 做图 Midjourney/即梦 小红书配图、课程封面、提案PPT配图 做视频 剪映AI/可灵 短视频素材、教程录屏 写代码 Cursor/Github Copilot 帮客户搭个简单网站、自动化脚本 做表格 AI表单/Notion AI 客户管理、项目进度跟踪 行动指令(今天就能做): 打开ChatGPT,输入这个提示词: 我是一个[你的工作领域]的自由职业者,需要帮客户[具体服务]。 请帮我列出5个能用AI提效的具体工作环节。 把AI产出的结果,自己手动执行一遍 记录哪一步AI帮上了,哪一步还需要人工介入 💡 关键认知:你现在不是在"学AI",你是在验证"AI能不能帮你把活干得更好、更快、更便宜"。 第2关:跑通第一个付费闭环(第3-6周) OPC最大的陷阱是"准备好了再开始"。 正确的姿势是:今天有需求,明天就接单。 新手友好的三种起手式 方式A:改造你现有的工作流 假设你之前帮客户写文案,现在用AI提速了30%。别降价——用省下来的时间接更多单,或者把服务打包成"AI加持版",涨20%的价格。 **方式B:做"AI翻译官" 很多企业主想用AI但不会用。你的价值不是"懂AI",而是把企业的具体问题翻译成AI能解决的方案。 比如:客户说"我想让销售团队效率更高",你不是给他推荐工具列表,而是说"我可以用AI帮你把客户跟进流程自动化,预计每周省8小时"。 方式C:从最小可行性产品开始 产品形态 定价区间 交付周期 适合谁 AI提示词定制 ¥199-499 1-2天 刚入门,有特定行业知识 自媒体/小红书代运营(含AI生成) ¥999-2999/月 按月 有内容经验 企业AI内训(半天线上) ¥3000-8000 3-5天准备 能讲清楚一个垂直场景 简单Agent/自动化工作流搭建 ¥5000-15000 1-2周 有基础开发能力 行动指令(本周完成): ...

2025年6月12日 · 阅读 加载中… · NFY

Snell v6.0.0b1 服务端安装实录

Snell 是 Surge 团队开发的私有代理协议,相比 Shadowsocks 在抗检测和性能上都有明显优势。本文记录一次在 Debian 服务器上安装 Snell v6.0.0b1 的完整过程,包括踩坑与修复。 异响方式:本次使用标记版本为 v6.0.0b1 的服务端构建。 下载与解压二进制 wget https://dl.nssurge.com/snell/snell-server-v6.0.0b1-linux-amd64.zip unzip snell-server-v6.0.0b1-linux-amd64.zip -d /usr/local/bin && rm -rf snell-server-v6.0.0b1-linux-amd64.zip chmod +x /usr/local/bin/snell-server 修复 libssl 依赖 在较新的 Debian 系统上直接运行会报错,因为系统默认不再提供 libssl1.1: snell-server --version # 报错:缺少 libssl.so.1.1 确认依赖关系: readelf -d /usr/local/bin/snell-server | grep NEEDED 推荐的修复方式是从 Debian 快照仓库获取兼容版本: wget https://snapshot.debian.org/archive/debian/20240311T000000Z/pool/main/o/openssl/libssl1.1_1.1.1w-0+deb11u1_amd64.deb dpkg -i libssl1.1_1.1.1w-0+deb11u1_amd64.deb ⚠️ 注意:某些较旧的镜像源提供的 deb11u4 版本在某些新系统上安装会失败,建议使用上述 snapshot 链接中的 deb11u1 版本。 生成配置文件 snell-server --wizard -c /etc/snell-server.conf 按提示生成密钥即可,配置文件示例: ...

2025年6月12日 · 阅读 加载中… · NFY

顶级AI模型更新周期与迭代速度全景对比

从 GPT-1 到 GPT-5,从 Llama 1 到 Llama 4,AI 大模型的迭代速度正在以月为单位加速。本文用数据与时间表,呈现一场看不见硝烟的军备竞赛。 一、闭源巨头:版本号背后的迭代逻辑 1.1 OpenAI:从年更到季度更 版本 发布时间 间隔周期 核心变化 GPT-1 2018.06 — Transformer 解码器,1.17 亿参数 GPT-2 2019.02 8 个月 15 亿参数,生成能力质变 GPT-3 2020.06 16 个月 1750 亿参数,涌现能力初现 GPT-3.5 2022.03 21 个月 指令微调 + RLHF,ChatGPT 前身 GPT-4 2023.03 12 个月 多模态,推理能力跃升 GPT-4o 2024.05 14 个月 原生多模态,速度成本优化 GPT-4.5 2025.02 9 个月 “Orion” 项目成果 GPT-5 2025.08 6 个月 三组件架构,PhD 级能力 观察: OpenAI 的迭代周期从 2 年缩短到半年,速度提升了 4 倍。2023 年后进入"季度更新"模式。 ...

2025年6月12日 · 阅读 加载中… · Blog

免费模型 API 平台大全 本文收录了截至 2026‑09‑06 可公开获取的免费大模型 API 平台,涵盖国内外主要供应商、接口地址、免费额度、支持模型以及使用注意事项。所有信息均来源于公开文档或平台首页,已尽量验证准确性。若平台政策变化,请自行关注官方公告。 📚 目录 UnoRouter – 190+ 免费模型聚合 Poixe AI – 免费模型套餐 ChatAnywhere – 免费模型转发 SiliconFlow / SiliconCloud – 国内免费模型 Kilo AI Gateway – 多厂商免费模型 OpenRouter – 免费模型列表 EdgeOne Makers – LLM Gateway 免费模型 Free‑LLM‑Collection (GitHub) 其他值得关注的免费平台 1. UnoRouter – 190+ 免费模型聚合 网址: https://unorouter.com/zh-CN/boke/free-models-aggregated 简介: 把 18 家上游免费提供方的 190+ 条模型统一到一个 OpenAI‑compatible 端点,只需要一把密钥即可调用。 免费额度: 每个模型 ≈1 次/分钟(平台层面统一限制),上游自身也会有每日/每分钟配额。超过配额返回 429 并附 Retry‑After。 支持的上游: Groq、Gemini、Cerebras、SambaNova、Mistral、Cloudflare Workers AI、GitHub Models、Z.ai、OVHcloud、AI Horde、Pollinations、Cohere、Jina、NVIDIA NIM(Nemotron、Llama、Qwen、gpt‑oss、DeepSeek 等)、SiliconFlow(DeepSeek‑V4、GLM‑5.1、Qwen3.5/3.6、Kimi‑K2.6、MiniMax‑M3)、HuggingFace 路由器、LLM7 等。 使用方式: curl https://api.unorouter.com/v1/chat/completions \ -H "Authorization: Bearer YOUR_KEY" \ -d '{"model":"gpt-oss-120b","messages":[{"role":"user","content":"你好"}]}' 注意: 免费层是 共享池,高并发或大批量请求容易触发 429;建议轮换模型或加入重试逻辑。 2. Poixe AI – 免费模型套餐 网址: https://poixe.com/products/free 提供: 两个套餐(大杯/小杯),均为 免费,每日请求次数分别为 5 次/天 与 50 次/天,单请求 token 上限 4k/2k(输入/输出)。 模型: 包含 Claude、GPT、Gemini、Mistral 等品牌的免费版,具体模型以页面列表为准。 调用示例(Node.js): const openai = new OpenAI({apiKey: 'POIXE_API_KEY', baseURL: 'https://api.poixe.com/v1'}); const res = await openai.chat.completions.create({model: 'claude-3-5-haiku-20241022:free', messages:[{role:'user',content:'你好'}]}); console.log(res.choices[0].message.content); 适用场景: 低频实验、个人项目、教育演示。 3. ChatAnywhere – 免费模型转发 网址: https://chatanywhere.tech/ 关键特性: 国内中转: https://api.chatanywhere.tech(国内网络延迟更低),国外使用 https://api.chatanywhere.org。 免费额度: 每天 10 000点(约 10 000 token),各模型每日调用次数上限(如 DeepSeek‑V4‑Flash 30 次/天、GPT‑4o‑mini 100 次/天)。 支持模型: DeepSeek、OpenAI 系列(gpt‑3.5‑turbo、gpt‑4o、gpt‑4o‑mini 等)、Claude、Gemini、MiniMax、Kimi、Qwen 等。 使用示例(cURL): curl https://api.chatanywhere.tech/v1/chat/completions \ -H "Authorization: Bearer YOUR_KEY" \ -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"写一段诗"}]}' 注意: 免费版需要 GitHub 登录 获取 token;若超过配额会返回 429,请自行实现退避。 4. SiliconFlow / SiliconCloud – 国内免费模型 网址: https://siliconflow.cn (SiliconFlow) / https://siliconcloud.com (SiliconCloud) 免费模型: deepseek-ai/DeepSeek-R1-0528-Qwen3-8B Qwen/Qwen3-8B Qwen/Qwen3.5-4B THUDM/glm-4-9b-chat THUDM/GLM-4-9B-0414 THUDM/GLM-Z1-9B-0414 THUDM/GLM-4.1V-9B-Thinking API 地址: https://api.siliconflow.cn/v1 免费额度: 1000 RPM / 模型(每分钟 1000 次请求),每日约 1440 RPD(请求次数)。 注册方式: 通过邮箱或企业微信快速获取 API_KEY,无需信用卡。 调用示例(Python): import openai client = openai.OpenAI(base_url='https://api.siliconflow.cn/v1', api_key='YOUR_KEY') resp = client.chat.completions.create(model='deepseek-ai/DeepSeek-R1-0528-Qwen3-8B', messages=[{'role':'user','content':'写一篇短文'}]) print(resp.choices[0].message.content) 适合: 对中文/中英混合需求、需要更高令牌上限(相比 30 RPM 的国外免费平台),但仍受每日配额限制。 5. Kilo AI Gateway – 多厂商免费模型 网址: https://kilo.ai/leaderboard#all-models 统一入口: https://api.kilo.ai/api/gateway 免费模型(部分示例): openrouter/free kili-auto/free inclusionai/ling-3.0-flash:free poolside/laguna-s-2.1:free tencent/hy3:free nex-agi/nex-n2-pro:free nvidia/nemotron-3-ultra-550b-a55b:free 额度: 200 RPH(每小时 200 次请求),适合中等频次的实验。 使用方式(curl): curl https://api.kilo.ai/api/gateway/v1/chat/completions \ -H "Authorization: Bearer KILO_API_KEY" \ -d '{"model":"inclusionai/ling-3.0-flash:free","messages":[{"role":"user","content":"解释一下量子计算"}]}' 优势: 多厂商聚合,支持 OpenAI、Claude、Gemini、Qwen、GLM、DeepSeek 等,且不强制传入 base_url,只需在 model 中指明即可。 6. OpenRouter – 免费模型列表 网址: https://openrouter.ai 免费模型入口: https://openrouter.ai/api/v1 部分免费模型(官方标记 free): nvidia/nemotron-3-super-120b-a12b:free minimax/minimax-m2.7:free google/gemma-4-31b-it:free nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free z-ai/glm-5.2:free cohere/north-mini-code:free 额度: 20 RPM / 200 RPD(每模型),超过后返回 429。免费模型多数为 实验性,可能随时下线。 适用: 快速尝鲜、对多供应商模型有统一调用需求的开发者。 7. EdgeOne Makers – LLM Gateway 免费模型 网址: https://pages.edgeone.ai/zh/use-cases/llm-gateway 核心卖点: 统一端点、零平台费用、内置免费 Token(约 50 万 token),支持 8+ 供应商。 免费模型(示例): @makers/deepseek-v4-flash @makers/minimax-m3 @makers/gemini-3.7-flash @makers/qwen3.5-4b 额度: 每账号赠送 50 万 token,随后按实际使用的上游配额计费(若使用免费上游则仍受上游限制)。 调用方式(Python): import openai client = openai.OpenAI(base_url='https://gateway.edgeone.ai/v1', api_key='EDGEONE_API_KEY') resp = client.chat.completions.create(model='@makers/deepseek-v4-flash', messages=[{'role':'user','content':'写一首诗'}]) print(resp.choices[0].message.content) 适合: 需要一次性接入多家免费模型,且不想自行管理密钥的项目。 8. Free‑LLM‑Collection (GitHub) – 开源免费模型清单 仓库: https://github.com/for-the-zero/Free-LLM-Collection 内容: Markdown 表格形式列出 国内外 近 200 条免费模型 API,包含以下信息: 平台名称 & 官网 API 地址 支持模型(示例) 免费额度(RPM / RPD) 备注(是否需要 GitHub 登录、是否有国内 CDN) 使用方式: 直接克隆仓库或下载 README.md,按需挑选模型。 优势: 开源、持续更新、社区维护;可自行部署到自己的文档站点(如 Hugo、Hexo)进行二次分发。 9. 其他值得关注的免费平台 平台 网址 免费模型 额度示例 备注 Celebras https://celebras.ai gpt-oss-120b、zai-glm-4.7 等 30 RPM / 900 RPH 需邮箱注册,免费额度有限 Mistral https://mistral.ai mistral-large-2512(免费试用) 未公开,通常需绑定支付 付费后额度提升 BigModel(智谱) https://bigmodel.cn GLM-4.7-Flash、GLM-4.6V-Flash 免费配额不明,但官方提供试用 token 国内备案平台 ModelScope https://modelscope.cn deepseek-ai/DeepSeek-V4-Flash、ZhipuAI/GLM-5 等 2000 RPD 需要 MODEL_SCOPE_API_KEY,支持多模型路由 HuggingFace Router https://router.huggingface.co/v1 数百开源模型(全部免费) 300 RPH 需要 HF 账户 token,配额受 HF 计费策略影响 G4F(免费代理) https://g4f.dev/ 自动路由到多家免费上游 未公开 适合作为 一次性实验,不保证稳定性 讯飞星火 https://spark-api-open.xf-yun.com/v1 lite(免费) 2 QPS 仅限中文对话,需企业备案 VolcEngine https://developer.volcengine.com/articles/7535310994050908206 多款国产模型(如 Qwen2) 注册即送 2000 万 token 需实名认证 📌 小结 免费模型并非无限:大多数平台都会对 请求频次、每日 token 设限,超过后会返回 429。建议在代码里实现 指数退避 或 轮询不同模型。 安全性:免费平台的 API Key 往往 没有付费额度 的风险,泄露后影响有限,但仍建议使用 只读权限 或 短期 token(如 GitHub OAuth)。 国内外混合使用:在国内网络环境下,优先选择 SiliconFlow、Kilo、ChatAnywhere 等本地节点;在海外需求(如使用 Code Interpreter)可使用 UnoRouter、OpenRouter 的免费层。 持续关注:免费政策随时可能变更,建议关注各平台的官方博客或 Discord 群组,以免业务中断。 祝开发顺利,玩转免费大模型! ...

阅读 加载中… · NFY