把 unlimited.surf 装上 Cloudflare 边缘:一个 OpenAI/Anthropic 通用适配 Worker 的部署手记

把 unlimited.surf 的真上游 key 锁在 Cloudflare 边缘 Worker 的 Secret 后端,把任意 client(key 都不必) → 你的统一 base URL → upstream;这就是今天凌晨从 Published transfer-api (0.47 sec) 到 https://transfer.ningop.com/health 在线的一次完整上线记录。 一、为什么是 Worker,不是 Pages / VPS 做这件事的标准诉求: 一站接入 OpenAI/Anthropic 双方 SDK 还要统一 base_url 多个 agent / IDE 工具要把同一个接入点写到配置文件里 不能在每个客户端都暴露 unlimited.surf 的真 key Cloudflare Worker 自带 Secret 加密 + 边缘 anycast + 绑定自定义域 30~60s 自动证书——这三条刚好覆盖。另外一个次选是 VPS + nginx + Lua,但要自己搞 SSL 续期、限流、熔断,且 latency 不如边缘化 POP。 ...

2026年6月21日 · 阅读 加载中… · NFY

AI 应用部署实战:Modal.com 与主流平台选型指南

“2026年,AI 应用爆发式增长。但一个残酷的现实是:大部分 AI 项目死在’最后一公里’——部署。” 一、为什么 Modal 值得关注 传统部署路径太沉重了:先写 Dockerfile,再配置 CI/CD,最后处理 GPU 驱动和依赖库版本地狱。Modal 的核心价值在于——把这一切压缩到一行命令。 三个让人无法拒绝的理由: gpu 秒级开箱:modal run 就能启动 A100/H100 容器,按秒计费 Python 原生:没有复杂的 K8s YAML,纯 Python 装饰器定义任务和流水线 云端持久化:文件系统和环境自动保存,下次启动复用 二、Modal 快速上手 安装与认证 pip install modal modal token new # 浏览器完成 OAuth 第一个无服务器函数 # hello.py import modal app = modal.App("hello-world") @app.function() def greet(name: str) -> str: return f"Hello, {name}!" if __name__ == "__main__": with modal.run(): print(greet.remote("Modal")) 运行: modal run hello.py GPU 推理实战:LLM 部署 # llm_serve.py import modal app = modal.App("llm-deploy") # 定义环境(只构建一次,缓存复用) image = (modal.Image.debian_slim() .pip_install("torch", "transformers")) @app.function(image=image, gpu="A100") def generate(prompt: str) -> str: from transformers import pipeline pipe = pipeline("text-generation", model="gpt2") return pipe(prompt, max_length=50)[0]["generated_text"] # Web 端点暴露 @app.function(image=image, gpu="A100") @modal.web_endpoint() def web_generate(prompt: str): return {"result": generate.remote(prompt)} 核心命令: ...

2026年6月6日 · 阅读 加载中… · NFY