Search: #模型服务

  1. Rapid-MLX: 面向 Apple Silicon 的高性能本地 AI 引擎• 基于 MLX 原生优化,支持连续批处理、提示缓存和量化 KV Cache,本地推理速度表现很强• 提供兼容 OpenAI 与 Anthropic 的 API 接口,可直接接入 Claude Code、Aider、Codex CLI 等开发工具链• 覆盖文本、音频、视频、嵌入与工具调用场景,适合在 Mac 上快速搭建统一的本地 AI 服务层

    Rapid-MLX: 面向 Apple Silicon 的高性能本地 AI 引擎

    • 基于 MLX 原生优化,支持连续批处理、提示缓存和量化 KV Cache,本地推理速度表现很强

    • 提供兼容 OpenAI 与 Anthropic 的 API 接口,可直接接入 Claude Code、Aider、Codex CLI 等开发工具链

    • 覆盖文本、音频、视频、嵌入与工具调用场景,适合在 Mac 上快速搭建统一的本地 AI 服务层

    https://github.com/raullenchai/Rapid-MLX

    GUI: https://rapidmlx.com/desktop

    合集 群组 恰饭 联系推广

    #本地推理 #模型服务 #工具调用 #AppleSilicon #MLX #OpenAI #ClaudeCode

  2. Codex 雷达: 面向 Codex 用户的实时额度与模型表现监测站感谢群友 @dheigrb 的分享• 实时汇总 Sol、Terra、Luna 等模型在不同推理强度下的通过率、IQ、耗时、成本与 Token 数据• 提供重置卡到期提醒、官方重置动态和服务状态更新,方便高频用户管理配额节奏• 开放 JSON 状态接口与 RSS 提醒源,适合接入机器人通知、自动化监控和社区数据看板

    Codex 雷达: 面向 Codex 用户的实时额度与模型表现监测站

    感谢群友 @dheigrb 的分享

    • 实时汇总 Sol、Terra、Luna 等模型在不同推理强度下的通过率、IQ、耗时、成本与 Token 数据

    • 提供重置卡到期提醒、官方重置动态和服务状态更新,方便高频用户管理配额节奏

    • 开放 JSON 状态接口与 RSS 提醒源,适合接入机器人通知、自动化监控和社区数据看板

    https://codex-reset-radar.pages.dev

    合集 群组 恰饭 联系推广

    #Codex #AI #模型评测 #额度监控 #开发者工具 #OpenAI #RSS #JSON

    • ❤️2