文章

AI API 中转站选型、测评与行业动态

官方在永久降价,中转的价差还剩多少?

官方在永久降价,中转的价差还剩多少?本文用可核实的官方定价回答这个问题:OpenAI 从 GPT-6 Astra 的 $10/$50 降到 GPT-6 Sol 的 $2/$10(官方声明永久有效、无到期日),再降到 GPT-6 Luna 的 $0.10/$0.50,输出价从 Astra 到 Luna 差 100 倍;GPT-6.1 Sol 同为 $2/$10、官方称"接近 Astra、价格五分之一"且缓存输入 $0.10(标价 5%);Claude Opus 5.5 定在 $4/$20、缓存读取降 60%,Sonnet 5.5 更便宜。文章把中转的账算清楚:同一个 20% 加价率,每百万输出 token 毛差从 Astra 时期的约 ¥71 掉到 Sol 时期的约 ¥14,再到 Luna 时期的约 ¥0.7——而服务器、带宽、支付通道、客服、风控成本一分不降;按国内中转常用的 ¥0.5/美元汇率杠杆测算,用户为省 3 块 3 而去注册充值的动机在 Luna 档上已不成立。同时给出官方从下游动手的三条线(OpenAI 把 Pro 每美元 API 额度砍半并新增 500 美元/月 Pro 500;阿里 Token Plan 一份订阅通吃 Qwen/Kimi/GLM/DeepSeek;智谱给 10 万用户各发 1 亿 Token),证伪"行业减速"叙事(9月21-29日至少 11 款模型落地、lmmarketcap 口径 9 月共 60 个发布,但 GPT-6.1 Astra 原定 10 月被报道取消、DNS 隧道事件导致工具调用相关训练/评测/推理暂停),并给出 10 月事实上会到货什么——Kimi K3.1(官方预告页已挂、注册表可调用,强报道,媒体口径月底,1M 上下文 + Low/High/Max 三档推理)、Qwen4(官方"即将发布",无日期)、Gemini 4(官方"远早于年底",不写 10 月)、Meta Watermelon(仅内部文件的 10 月窗口);明确剔除 DeepSeek V4.1 Pro 的排期、Space Bunny 归属与 Grok 5 任何时间。最后落到中转真正要拼的五件事:大陆直连与可用性、官方结构上做不到的聚合、支付与开票、上游通道质量与延迟、以及把降本从"买得更便宜"换成"用得更少"的工程能力(英伟达 SoL-Pi 少用 50%/54.3% token、单任务成本 $1339→$894;OpenSquilla 保 99.96% 质量降本 88.9%;Anthropic 砍掉 80% system prompt)。

Jev 为什么爆火:1954 分的 Hacker News 热潮拆开看——触发点、真实采用信号,以及哪些数字其实是营销

本文不复述「Jev 是什么」,只回答「为什么火」这一个问题,并把热度与证据分开摆。触发点是 TypeSafe 自己 2026 年 9 月 15 日的官宣与创始人 Diogo Almeida 的发布推文(75,217 赞),一小时后被社区顶到 Hacker News 1,954 分 / 511 条评论(当周第 2、AI 类第 1);官网因流量过载短暂无法服务(TechCrunch 原文);48 小时内 launch 视频被第三方记为 3,100 万到 4,000 万播放;browser-use 的 jev-ultrafast 一天内 17,441 star。采用侧最硬的一条是 Vercel:Jev 是 AI Gateway 历史上采用最快的模型,首日覆盖约 13% 的团队,是 GPT-5.6 家族的 2 倍,其工程师称换掉 Luna 后快 5–18 倍且更准;另有 LangChain 的 Jev-as-a-Judge(平均 0.44 秒、每次 $0.00035)、elvex 的 2,000 张报销单 21 秒约 5 美分。但热度明显超过证据:193.6 倍 / 444.6 倍是厂商自评上限(TypeSafe 自己披露三条偏差);Jev 准确率约 68% 低于 GPT-5.6 Sol 的约 74%——它赢的是成本不是准确率;「0% 幻觉」是 schema 保证而非事实正确;独立测评方 Archestra 发现 79% 恒定基线陷阱与最高 0.17 的运行间概率漂移,且 100 条真实调用上 Sonnet 5 达 98%、Jev 为 93%;官方承认无法证明定价没有补贴;护城河很薄——两天内出现 6 个复刻,0.5B 版本能跑在 MacBook 上。中文圈比英文圈晚 3–6 天且以编译教程为主,腾讯技术工程 9月21日的实测质量最高。最后一节给出一把可复用的尺子:下次遇到爆火模型该怎么自己判。对国内读者最关键的一条:Jev 走 POST /v1/systemone 而非 OpenAI 兼容端点,连 OpenRouter 都要为它单开 Decisions API 通道,本站收录的 153 家中转站无一上架,改 base_url 那套玩法从根上不成立——目前只有官方直连、经 OpenRouter、或自建网关透传三条路。

「JEV」是什么:TypeSafe AI 首个 System One 模型 Jev——已发布功能、价格、发布时间与接入方式

先解决歧义:AI 语境下「JEV」指 Jev,TypeSafe AI(创始人 Diogo Almeida,前 OpenAI 研究员,参与 ChatGPT 核心训练方法)于 2026 年 9 月 15 日发布的首个 System One 模型(其余同名缩写如《细胞外囊泡杂志》、乙脑疫苗均与 AI 无关)。它完全不生成文字,只做类型安全的决策:传入 state 与三类结构化问题(choice 选项 / score 打分 / noul 是否),返回带校准概率与置信度的类型化答案。本文只写官方文档与定价页里已落地的东西:jev-1.13.0(别名 jev-latest / jev-preview,两个别名当前都指向 1.13.0)的完整规格——64k 上下文(其中 state+最长问题 32k)、仅文本输入(无图像/音频/视频)、单字段基数上限 255、不支持按客户微调、请求不用于训练、企业版可谈零数据保留、英文为主训练语言 CJK 效果不均衡;三种原语的确切返回字段(choice/probabilities/confidence、score/legend/probabilities/confidence、noul 0-1);RLCD(Reinforcement Learning for Calibrated Decisions)训练目标与并行采样器;价格 $42/十亿输入 token(即 $0.042/百万,输出免费,官方称输入单价比 Claude Fable 5.1 低 238 倍)、限速 25 万 token/秒与 1200 请求/分钟;发布时间线(9/15 官宣博文署名、9/17 官网元数据、9/18 上架 OpenRouter 且定价与官方一致);POST https://api.typesafe.ai/v1/systemone 的 curl 调用与 pip install typesafe-sdk 完整代码、JS SDK、Claude Code 等 agent skill 安装命令;并以官方自报口径(193.6x Faster / 444.6x Cheaper)逐条标注官方自己披露的局限。最关键的是第九节:Jev 不是 OpenAI 兼容的 chat.completions 接口,所以「改 base_url 就能用」的中转玩法在这里不成立,国内 153 家收录中转站目前无一上架,唯一第三方通道 OpenRouter 并非国内直连方案。

Google Gemini 产品线全景:Gemini 4 Pro 仍未发布,谷歌真在卖的是 3.8 Flash 与 3.1 Pro——功能、价格、发布时间与中转接入

截至2026年9月18日的核实结论:Gemini 4 与 Gemini 4 Pro 均不存在于谷歌官方模型目录(页面更新日期 2026-09-17),变更日志中也无任何 4 代条目;官方唯一表态是皮查伊 7月26日称"正在训练体量远大于以往的基座模型",无日期、无规格、无价格——网传"10月发布"的唯一源头(Geeky Gadgets 9月9日)把 Anthropic 写成"Enthropic"、把 Grok 说成 SpaceX 产品,本文不予采用。本文改写真事实:9月2日 GA 的 Gemini 3.8 Flash(DeepSWE v1.1 73.7%、Terminal-bench 2.1 89.4%、HLE-Verified 54.9%、Vals Finance Agent v2 61.4% 超 Claude Opus 5、约1M上下文/64K输出、$0.75/$3.75促销价2027年1月翻倍为$1.50/$7.50);网络安全专用、仅通过 Fairwind 计划限量开放的 3.8 Flash Cyber(CyberGym Pass@1 86.2%、内部20语言发现基准71.0%);9月15日 GA 的 3.8 Live 与 3.8 Live Extended Thinking;当前唯一在售 Pro 档 3.1 Pro(Preview,$2/$12起、HLE 44.4%、SWE-Bench Verified 80.6%、ARC-AGI-2 77.1%);8月27日 GA 的视频模型 Omni 1.1 Flash(续写、首尾帧插值、360p-4K);以及仍未发布的 Gemini 3.5 Pro。附谷歌官方定价页逐项价格表、2026年完整发布时间线,与国内153家中转站接入现状:ProAI API 明确标注 gemini-3.7-flash 已上线,MKEAI/NodAPI/全智API覆盖 Gemini 3.5-3.7,14家已列入 gemini-3.1-pro,但暂无一家列出 gemini-3.8-flash——含 OpenAI 兼容与 LiteLLM 接入代码。

GPT-6 Sol 前瞻:6 倍速的「速度档」会怎样补齐 GPT-6 家族?

站在 2026年9月往前看 OpenAI 的 GPT-6 Sol:据量子位 2026-09-07 报道,OpenAI 正在内测这个定位在 Astra 之下的速度档——同一 SVG 生成任务上 Sol 约 3 分钟、Astra 约 19 分钟(约 6 倍速),质量略逊 Astra 但仍属「怪物级」,爆料人称有望于 9月29日 OpenAI 开发者大会发布。本文把这件事讲透:为什么 GPT-6 家族缺的正是这样一个「快而便宜」的档位(Astra 9月4日发布,$10/$50,ARC-AGI-3 99.9%、GPQA Diamond 96%、OSWorld 2.0 72.6%,9月10日前后暂停 200 美元/月 Pro 档新订阅);6 倍速在 Agent 循环、批量生成、草稿轮次里到底能换来什么;Sol 大概率落在 Astra 四分之一到一半之间的哪个价位(推演,非事实,含与 Gemini 3.7 Flash 等走量档的对照);它会怎样经官方 API → OpenRouter/AiHubMix → 国内中转站触达你,以及上架节奏快的一批站;上线第一周该验证的三件事(官方模型 ID 核对、业务题基线对拍、价格合理性反推);9月29日 Dev Day 的观察清单与三种情景;以及现在就做的五项准备——含 OpenAI 兼容接入代码与 LiteLLM 快速档/旗舰档分级路由配置。

Meta Watermelon 模型解读:下一个 Llama,还是 HATCH 背后的闭源旗舰?——10月发布窗口、已确认事实与中转站接入预期

拆解2026年8月25日律动BlockBeats转述The Information与Meta内部文件报道的下一代AI模型Watermelon:它是什么(Meta最新AI模型的内部代号,广泛报道预计2026年10月发布)、与HATCH/OpenClaw消费级代理平台的关系(Instagram智能购物助手、分层定价高级档最高199.99美元/月)、开放还是闭源的两条可能路线(Llama开源继承者 vs Muse Spark式闭源旗舰)、目前没有任何公开规格与跑分这一事实本身怎么读,以及——对本站读者最实际的问题——如果走开源路线,如何通过自托管(Ollama/vLLM)、聚合平台(Groq/Together/Fireworks/硅基流动等)与国内AI API中转站接入;如果走闭源路线,如何通过Meta Model API(api.meta.ai/v1)与OpenRouter接入。全文逐条标注置信度:已报道/合理推断/未核实。

DeepSeek V4-Flash-Vision-Exp 解读:多模态Flash首次发布Agent基准,4项评测2:2打平Opus 4.8——视觉版意味着什么、怎么接

拆解2026年8月22日DeepSeek为其V4-Flash模型推出的视觉版本V4-Flash-Vision-Exp:在284B/13B MoE、1M上下文基础上加入视觉输入的多模态扩展;官方首个Agent基准如何在4项多模态评测中与Anthropic Opus 4.8打成2:2(Agents' Last Exam 27.3对25.7、ZeroBench 35.0对34.0胜;ApexBench 36.5对39.4、Chartography 64.3对65.0负);相对纯文本版V4-Flash-0731把ApexBench从26.2拉到36.5、DeepSWE从54.4升到59.3并超过Opus 4.8的58.0;官方定价大概率沿用V4 Flash峰谷电价(非高峰¥1.5/¥4.5、高峰¥3/¥9每百万token)但视觉输入是否单独计价未核实;以及国内AI API中转站接入现状(截至发稿153家收录供应商无一明确列出视觉版模型ID,硅基流动/ProAI API/NoDAPI/JENIYA等同步快的站最可能先行上架)与OpenAI兼容接入代码。

Google Gemini 3.7 Flash 深度测评:三周一更的"编码与Agent主力模型",$0.75/M半年促销怎么读、怎么接

拆解2026年8月14日发布的Gemini 3.7 Flash:官方定位为迄今"最智能的主力模型"、专为编码与Agent任务设计、距上一代3.6 Flash仅约三周;约1M输入上下文、64K输出、原生多模态输入;官方自报跑分DeepSWE v1.1 49.0%→65.3%、FrontierCode 1.1 34.4%→43.6%(小幅超过Claude Sonnet 5的42.7%)与第三方AAII缺失的诚实落差;$0.75/$3.75半年期促销(2027年1月恢复$1.50/$7.50)实为3.6/3.7全线促销的真相;与Claude Sonnet 5/GPT-5.6 Terra/DeepSeek V4 Flash/Pro/Kimi K3/GLM-5.3/Qwen3.8-Max的逐token对比;以及国内中转站接入现状(ProAI API明确上架gemini-3.7-flash,MKEAI/NoDAPI/JENIYA覆盖Gemini 3.7)与OpenAI兼容接入代码。

GLM-5.3 深度测评:最强的开源编程模型?一次「纯后训练」的旗舰升级

拆解智谱2026年8月14日发布的GLM-5.3:743B参数、与GLM-5.2同一基座、架构未动,编程与Agent能力却大幅拉升——DeepSWE v1.1 46.2→66.9开源第一、Terminal-Bench 3.0 4.6→28.3、CyberGym 84.5%成为所有已评测模型中的第一(超过Mythos 5的83.8%与GPT-5.6 Sol的83.6%)。诚实对比闭源旗舰Fable 5/GPT-5.6 Sol的真实差距与token效率优势,说明网络安全双刃剑带来的「trusted access」分级与API强制思考模式,以及通过中转站怎么用、什么时候能用上(GLM Coding Plan/ZCode/AutoClaw现在可用,API+权重约两周后)。

DeepSeek Harness 架构深潜:Cordis 的「可逆效应」与「反应式余效应」到底是怎么一回事,四种运行模式的机械细节一次讲透

从「一切皆插件」往下一层,拆解 DSH 底层插件框架 Cordis:它的血统(shigma/Koishi 生态)、论文《A Programming Paradigm for Spatiotemporal Composability》里两个关键概念——可逆效应(Revertible Effects,时间维)与反应式余效应(Reactive Coeffects,空间维)——以及 effect/disposer/fiber 的机械运作;再看 DSH 如何把模型适配器、工具注册表、会话日志、agent loop 全都做成可替换插件,最后深挖标准、PTC/Code、极简、创造四种运行模式各自开了什么、关了什么。

DeepSeek Harness 深度解析:DeepSeek 的 Agent 终于发布了,但它发布的是一个"组装 Agent 的运行时",不是又一个 Codex

拆解2026年8月13日DeepSeek面向全球开发者开放的Agent产品DeepSeek Harness(DSH)开发者预览版v0.1:它到底是什么(开源Agent运行时,而非闭源编程Agent)、有哪些功能(本地Agent工作台、四种运行模式、MCP客户端桥、仅追加会话日志)、采用了什么框架(基于Cordis插件系统,"一切皆插件")、有哪些真正的新东西与哪些只是"卷配置",以及——对本站读者最实际的部分——如何通过DEEPSEEK_BASE_URL/Web UI/settings.yaml把它接到国内AI API中转站,让DeepSeek V4 Pro/V4 Flash驱动它干活。

DeepSeek V4 Pro 正式版 vs Grok 4.6 对撞:同夜发布的两枚“半价核弹”,谁更值得接入?

拆解2026年8月13日凌晨同夜发布的DeepSeek V4 Pro正式版(1.6T/49B MoE、1M上下文、双协议兼容)与Grok 4.6(约1.5T参数、AAII 61分追平GPT-5.6 Sol Max)的真实规格、官方自报跑分与第三方AAII的落差(53 vs 61)、定价对撞(输出价差约7倍、缓存命中价差超过100倍)、生态路线之争,以及国内AI API中转站的接入现状与选型结论。

DeepSeek Flash V4 薅羊毛,快速接入教程

把 DeepSeek V4 Flash 的免费接入路线全部摊开:商汤 SenseNova Token Plan 免费公测、OpenCode Zen 限时免费、NVIDIA NIM 免费原型、DeepSeek 官方注册送 500 万 tokens、阿里百炼/腾讯云/七牛云/魔搭的免费额度,以及 10 家第二梯队厂商。附每家平台的 base_url + 模型 ID 速查表与 OpenAI 兼容接入代码,诚实说明每条免费路径的硬限制与 OpenRouter :free 死列表争议。

AI视频生成模型价格全景横评:Seedance 2.0/2.5、可灵Kling 3.0、Google Veo 3.1、阿里万象Wan 2.7怎么选最省钱

横向拆解四大主流视频生成模型的真实定价:字节跳动Seedance 2.0/2.5(2.5 API定价8月7日刚公布)、快手可灵Kling 3.0、Google Veo 3.1官方三档报价、阿里万象Wan 2.7(唯一开放权重可自托管)。附官方直连vs聚合中转两条接入路线的完整对比、同一模型不同平台最高20%的价差实例,以及eggstriker已收录供应商里谁真的在卖这四个模型、中国大陆读者该怎么绕开代理省钱。发布前独立联网核实。

DeepSeek官宣涨价却不说涨多少:现状核实、社区怎么应对、中转站省钱是不是真的

8月6日DeepSeek抛出一份没有具体数字、没有生效日期的整体涨价公告,7月传闻的峰谷电价截至发稿仍未生效。本文实时核实官方定价页现状、梳理V2EX/知乎/Reddit的真实反应、拆解开发者层面的技术性省钱思路,并交叉验证硅基流动、EasyRouter、TokenRiver等中转站"更便宜"背后的三种完全不同机制——哪类是真省钱、哪类只是汇率游戏、哪类官方自己都说是加价,发布前独立复核最新进展。

AI大模型价格全景横评:OpenAI、Anthropic、谷歌、DeepSeek、Kimi、Qwen、GLM、xAI、MiniMax九大厂商定价、缓存折扣与中转站价差全解析

横向拆解九大厂商当前主力高性能模型的真实定价:每百万token输入/输出价、上下文窗口、缓存折扣、DeepSeek峰谷电价、思考模式如何变相加价,以及开放权重模型vs闭源模型在中转站上完全不同的价格逻辑。含Claude Opus 5取代4.8同价发布、Qwen3.8-Max转正定价、Gemini 3.5 Pro仍未发布等最新变化,发布前独立核实。

OpenAI "Astra" 预告深度解读:藏在数学论文里的下一代模型,还剩下一堆问号

拆解OpenAI下一代主力模型Astra的官方预告:2026年8月1日研究员Noam Brown如何在一篇数学论文博客里"顺带"公布它、10个悬置至少十年的数学与理论计算机科学难题、Sam Altman向华盛顿政策制定者的演示、特朗普政府"上市前30天审查"新规、Gary Marcus等人的质疑,以及这对国内AI API中转站读者意味着什么。

MiniMax H3开源 vs 字节跳动Seedance 2.5闭源:同日发布的路线对决,附H3深度测评

2026年7月31日,MiniMax H3与字节跳动Seedance 2.5同日发布,却押上了两条相反的路:一个承诺开放权重,一个继续闭源API。拆解H3的真实架构与规格、MiniMax开源权重的实际条款与近一年来的松动轨迹、字节跳动为什么坚持闭源、这场对决在中国AI版图里处于什么位置,以及H3在Artificial Analysis三份视频榜单上的真实名次、定价和国内中转站接入现状。

Seedance 2.5 深度测评:单镜头时长翻倍到30秒,官方API定价却还是个问号

拆解字节跳动Seedance 2.5的真实升级点(单镜头时长15秒翻倍到30秒、参考输入扩大到50份、四类新增编辑能力)、从6月预热到7月31日正式发布的完整时间线、对比Kling 3.0/Veo 3.1/正在退场的Sora 2、尚未公布的官方API定价与第三方估算的矛盾之处、好莱坞版权异议现状,以及国内AI API中转站的接入现状。

Portkey 深度测评:网关+可观测+护栏三合一,被 Palo Alto Networks 收编之后还值得选吗?

拆解 Portkey 的核心功能(AI 网关、Virtual Keys、可观测、60+ 护栏、治理、Prompt 管理、MCP Gateway)、2026年3月网关开源、被 Palo Alto Networks 以约7亿美元收购收编进 Prisma AIRS 的完整时间线,真实定价(Developer免费/Production $49/月/Enterprise定制),以及它和 LiteLLM、OpenRouter、国内 AI API 中转站到底是什么关系。

Jina API 完整指南(2026):为什么RAG开发者仍在关注它?优势对比与手把手搭建领域知识图谱教程

Jina AI被Elastic收购后依然独立运营的检索层全家桶——诚实拆解它相对Firecrawl/Tavily/Exa/Diffbot的优势与短板(含GitHub星标数据、v5-omni多模态模型发布等实测/核实信息),并用一条实测过的管线教你把网页真正组装成能查询的领域知识图谱,含完整Python代码。

Grok 4.5是现在全网性价比最高的模型吗?2026年7月全网最具性价比模型排名

Grok 4.5($2/M输入、$6/M输出)跑分逼近Claude Opus 4.8、token效率约是Opus 4.8的4倍、Agent工具调用能力全场最高——但它既不是全网最便宜的模型,也不是最便宜的多模态模型。用8个主流模型的真实定价横向排名,诚实拆解谁的性价比真正最高,附国内中转站接入现状对比。