gpt-instruct 提供面向 Codex 的提示词与可复现评测工具链,重点改善复杂任务的首轮执行、过程连续性、工件验证和可运行回滚。长期维护两条产品线:gpt-5.6-sol-v45(当前稳定生产版)和 gpt-6-astra-v1(首个正式版,在 A/B/C 评测门禁体系下逐版本迭代)。使用
AI 雷达 AI 雷达是一个 AI 模型评测对比平台,直接拿真实账号蹬额度,把所有信息全给你整理好了:模型能力、速度、成本、社区真实评价、历史表现都能横向对比。现在 Sol、Terra、Luna 一堆模型和不同推理档位,很多人最头疼的就是到底哪个最强、哪个最快、哪个最省额度、今天有没有偷偷降智。
DSH Quality 是一个DeepSeek Harness 插件质量评分与安全检查平台,帮你快速筛选优质插件,减少踩坑风险。通过公开的 GitHub 与 npm 元数据对插件进行独立质量评估,不推荐、不安装,只负责提供客观的数据分析与健康评分。 每个插件从多个维度综合评分,包括维护状态、文
GetCheapAI 是一个AI 模型 API 价格对比平台,对比各 AI API 中转站的模型价格,查询 Claude、GPT、Gemini 等模型多少钱、哪个中转站更便宜,覆盖 Claude Code、Codex、Gemini CLI 等编程工具常用的模型价格。 核心功能包括:模型搜索快速
yangmao.ai 是一个追踪全球 AI 工具、模型平台和 API 服务的中文信息平台,帮你快速判断哪些值得用、哪些涨价了、哪些还有免费额度。已追踪 168 家厂商、14028 组对比、160 个免费额度。 追踪维度包括:免费额度(注册送额度、免信用卡、限时羊毛)、API 价格 / Toke
PriceAI 是一个AI 订阅与模型 API 的比价平台,聚合 ChatGPT、Claude、Gemini、Grok 等 AI 服务以及 API/CDK、邮箱和接码等渠道报价,把不同来源的商品统一整理成标准分类,支持查看最低价、有货状态、渠道数量、更新时间和原始商品信息,可跳转至对应渠道查看详情。
虾跑分是一个AI 大模型和 AI Agent 的跑分测试平台,通过 8 大能力维度和 16 道测试题,评测 GPT、Claude、DeepSeek、Gemini 等模型的理解、推理、执行、工具调用和表达能力,生成可分享的跑分报告与排行榜。 8 大维度包括:理解力(复杂指令理解)、执行力(多步骤