尧图精选

免费本地AI改写:claudish-to-english的Ollama模型选择清单(从gemma4到轻量替代)

🕒 发布时间:2026/10/1 21:33:46 📁 来源:尧图网络
免费本地AI改写claudish-to-english的Ollama模型选择清单从gemma4到轻量替代【免费下载链接】claudish-to-english项目地址: https://gitcode.com/gh_mirrors/cl/claudish-to-englishclaudish-to-english是一款免费的 Claude Code 插件通过本地 Ollama 大模型把 AI 助手满屏的黑话自动改写成大白话默认模型为 gemma4:26b-mlx全程本地运行、不花一分钱 API 费。本文给出一份 Ollama 模型选择清单从默认的 gemma4 到低配机可用的轻量替代并附最快配置方法和排查指南。一、它到底做了什么只改显示不动原文 理解模型怎么选先要知道这个插件的工作方式显示钩子每条 AI 回复生成完毕后本地模型把全文重写成通俗版本默认以 In plain English:块追加在原文后面append模式也可以选择完全替换replace模式Markdown 钩子可选AI 写入/编辑.md文件时顺手把文档改写成白话版默认生成NAME.plain.md兄弟文件不碰原文件失败即放行fail-open模型没拉取、Ollama 没启动、请求超时……任何环节出问题你都只会看到 AI 的原始回复绝不会吞掉或改写坏答案也就是说模型选错了、机器跑不动了最坏的结果就是看到原文没有风险成本。核心逻辑分别在 rewrite.sh 和 rewrite-md.sh 中钩子注册见 hooks/hooks.json。二、3步搭好本地 Ollama 改写环境 模型清单生效的前提是 Ollama 就绪。以 macOS 为例Windows 步骤见 README.md 中的 Windows setup 章节安装并启动 Ollamabrew install ollama然后运行ollama serve拉取模型例如ollama pull gemma4:26b-mlx约 17 GB请按你的内存选更小的预热一次ollama run gemma4:26b-mlx hi——首次调用是慢速冷加载预热后体验才正常⚠️ 如果本地模型没就绪插件对文字什么都不做——这是设计使然不是 bug。插件首次跳过后会在屏幕上一行字告诉你原因CLAUDISH_NOTICE0可静音。三、Ollama 模型选择清单按内存对号入座CLAUDISH_MODEL可以指向任何已拉取的 Ollama 标签默认值只是起点。对照下表选模型标签特点适合谁gemma4:26b-mlx默认模型~17 GBApple 芯片 MLX 构建约 60 token/sMac 主力机建议 24 GB 内存gemma4:26b同尺寸的非 MLX 通用标签Windows / Linux 高配机llama3.2:3b轻量级秒级响应8 GB 内存入门机、怕超时的长消息qwen3-30b中大型改写质量更高长文档、Markdown 文件改写两个关键坑位⚡MLX 标签是 macOS 专属Windows 上gemma4:26b-mlx根本跑不起来保持默认会导致每条消息都静默跳过改写必须把CLAUDISH_MODEL换成普通标签模型名必须精确匹配如果CLAUDISH_MODEL指向一个未拉取的模型每次改写都会被跳过并出现一次性提示四、最快配置方法一个变量切换模型所有配置都通过CLAUDISH_*环境变量控制推荐写在~/.claude/settings.json的env块里不要改插件缓存里的 hooks/hooks.json更新时会被覆盖{ env: { CLAUDISH_MODEL: gemma4:26b-mlx, CLAUDISH_MODE: append } }不想改文件启动前临时指定一次也行CLAUDISH_MODELllama3.2:3b claude注意两点改完env需要重启 Claude Code才生效变量在启动时读取多项目共用配置请放在优先级最高的那份 settings 里env块不会跨层级合并五、轻量替代怎么选速度、质量、体积三角 ⚖️选模型的本质是权衡三个维度维度大模型gemma4 26b / qwen3-30b轻量模型llama3.2:3b响应速度长消息明显等待长文档 30–120s快几乎无感改写质量高术语解释更到位够用但弱模型可能越改越糙内存门槛高16–32 GB低8 GB 可跑实操建议日常对话改写轻模型完全够用显示钩子的 LLM 超时默认 45 秒小模型很少碰线Markdown 长文档改写大模型按 60 token/s 估算一篇长规划文档要 30–120 秒文件钩子默认允许 150 秒CLAUDISH_MD_TIMEOUT上限 180 秒文档特别长可以调高这两个值或干脆换小模型保速度推理类模型别开思考插件已对 ollama 请求发送think: false省掉你看不到也派不上用场的推理耗时保持默认即可六、改写没生效按这个顺序排查 插件失败即放行所以最常见的症状是好像没反应。排查顺序看一次性提示屏幕底部/系统消息会写明跳过原因模型未拉取、超时、Ollama 不可达模型没拉取→ollama pull 你的模型标签Windows 上用了 MLX 标签→ 改CLAUDISH_MODEL为普通标签超时→ 换小模型或调高CLAUDISH_TIMEOUT/CLAUDISH_MD_TIMEOUT想深挖→CLAUDISH_DEBUG1后查看$TMPDIR/claudish-to-english/debug.log临时暂停/恢复touch ~/.claude/claudish-off立即暂停改写删除该文件即恢复会话中即时生效七、相关文件速查文件作用README.md完整文档安装、配置、隐私说明rewrite.sh显示改写钩子逐块缓冲、收尾调用一次模型rewrite-md.shMarkdown 文件改写钩子可选、按目录启用providers.sh提供方层ollama / anthropic / openai 默认模型与请求逻辑hooks/hooks.json钩子注册与超时配置60s / 180sCHANGELOG.md版本变更记录总结三句话选对你的 Ollama 模型Mac 用户保持默认gemma4:26b-mlx内存不够就换小标签Windows / Linux 用户必须设置CLAUDISH_MODEL从gemma4:26b起步低配机器直接llama3.2:3b速度优先改写质量依然够用改坏了不怕——这个插件永远兜底显示原文放心试。【免费下载链接】claudish-to-english项目地址: https://gitcode.com/gh_mirrors/cl/claudish-to-english创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联 返回资讯列表 →