Search: #大模型聚合

  1. ChromeClaw: 基于 Chrome 浏览器运行的免费 AI 聚合助手方案• 直接复用各大模型官网的已登录账号,在浏览器内实现近乎无限 token 的日常调用体验• 当前已支持 Qwen、Kimi、GLM、Gemini、Claude 等多个主流模型平台,适合个人多模型统一使用• 相比本地可执行方案,依托 Chrome 沙盒机制运行,更轻量,也更符合安全优先的使用场景V2EX:

    ChromeClaw: 基于 Chrome 浏览器运行的免费 AI 聚合助手方案

    • 直接复用各大模型官网的已登录账号,在浏览器内实现近乎无限 token 的日常调用体验

    • 当前已支持 Qwen、Kimi、GLM、Gemini、Claude 等多个主流模型平台,适合个人多模型统一使用

    • 相比本地可执行方案,依托 Chrome 沙盒机制运行,更轻量,也更符合安全优先的使用场景

    V2EX: https://www.v2ex.com/t/1201640

    GitHub: https://github.com/algopian/chromeclaw

    相关: https://github.com/linuxhsj/openclaw-zero-token

    #ChromeClaw #AI #浏览器扩展 #大模型聚合 #免费 #AI #工具 #Chrome #GitHub #开发者工具

    • ❤️6
    • 😁1
  2. llm_benchmark: 面向复杂推理与长文本场景的 LLM 中文能力基准项目• 聚焦高难度任务设计,覆盖符号推导、规则归纳、代码阅读、日志分析、长文本总结等多类真实问题,更适合检验模型的综合推理能力• 题目设置强调指令遵循与复杂约束处理,包含生产日志、棋局解读、工具组合、寻路规划等场景,对模型实用性评估更有参考价值• 基于 GitHub 开源发布,适合用于大模型评测、能力对比、提示词测试与中文推理 benchmark 构建

    llm_benchmark: 面向复杂推理与长文本场景的 LLM 中文能力基准项目

    • 聚焦高难度任务设计,覆盖符号推导、规则归纳、代码阅读、日志分析、长文本总结等多类真实问题,更适合检验模型的综合推理能力

    • 题目设置强调指令遵循与复杂约束处理,包含生产日志、棋局解读、工具组合、寻路规划等场景,对模型实用性评估更有参考价值

    • 基于 GitHub 开源发布,适合用于大模型评测、能力对比、提示词测试与中文推理 benchmark 构建

    https://github.com/llm2014/llm_benchmark

    #大模型评测 #中文基准 #推理能力 #长文本 #代码阅读 #日志分析 #GitHub #LLM #Benchmark #AI