English | 中文


生态入口


🧠 第一部分 · 引擎与模型

① StepFun 默认主链 + 实时语音 + 本地编排器储备

v0.85 的 GUI / CLI 默认对话与任务执行统一走 StepFun 3.7 Flash:优先保证普通对话能回复、工具任务能完成、最终答案可见。本地蒸馏 A3B manager 仍作为显式 Lynn manager run 能力保留;考虑本地部署的并发能力与稳定性,默认切换到本地编排器继续暂缓。

语音主入口同样走 Brain 托管 StepFun Realtime:GUI 麦克风直接进入实时语音;CLI 在当前 Lynn chat 里输入 /voicelynn voice 会就地切到实时语音,状态和采样波形显示在聊天框下方,Ctrl+C 返回聊天。Lynn voice --file/--record 转写、Lynn voice --speak 朗读保存只是辅助工具,不再作为语音主体验。

我们同时储备了一个会快速 拆分 → 分派 → 验收任务的本地编排器模型:用 LoRA(r=64 / α=128 / dropout 0.05,1842 条蒸馏样本)把 DeepSeek-V4-Pro 在「思考开启(thinking-on)」时的多步推理与自我验证思维方式蒸进 Qwen3.6-35B-A3B(MoE,3B 激活)。

编排器有三个硬条件——快、会拆解验收、不乱报完成。实测(同一 harness,thinking-on):

维度 蒸馏编排器 原版 A3B 说明
端到端编排耗时 26.6s 60.7s 决断不啰嗦,比原版快 2.3×、比云 API 快 2–3×
GPQA-Diamond-198 80.3%(32K) 72.7% 硬推理 +7.6pp
MMLU-500 90.2% 91.4% 知识广度持平
编排假验证(20×5) 0 / 20 0 / 20 自报完成与真实状态一致

关键:蒸馏与原版单流 TPS 相同(R6000 ~224 tok/s),但端到端编排快一倍——蒸的是「思维方式」,红利是更少 token 到结论。难题仍以 harness 客观验证 为准,不把模型自报完成当作验收。

📦 端侧默认模型:Merkyor/Qwen3.6-27B-DSV4Pro-GLM52-SFT-GPT55-RL-Coding-GGUFHuggingFace 镜像:nerkyor/Qwen3.6-27B-DSV4Pro-GLM52-SFT-GPT55-RL-Coding-GGUF

与早期 Lynn-V4-Pro-Distill 区分:这一版蒸的是 thinking-on 的思维方式,目标「学会怎么想」,直接服务 Agent 编排。

② 引擎路线:端侧选最快的 llama.cpp,并回馈上游

我们自研过 NVFP4 推理引擎,在 Blackwell 上认真啃了几周内核。结论很硬:单流 decode 是带宽 / launch 游戏,自写内核打不过成熟的 llama.cpp

单流 decode(同模型同卡) tok/s
llama.cpp Q4_K_M(Spark sm_121) 69.77(+MTP 79)
自研 NVFP4(Spark,内核融合后) ~45
llama.cpp Q4_K_M(R6000) ~207
自研 NVFP4(R6000 strict) ~108

所以端侧主推理我们选 llama.cpp(单流最快、生态成熟、全平台),并把实测验证的改进回馈上游:

  • #24273 NVFP4 转换 / 后端 / 基准实测指南文档(open,review 中)

不是放弃,是「打得过就用、用得上就贡献」——自研引擎收束为研究资产,前沿 NVFP4 仍在持续科研

③ 不放弃 NVFP4:前沿在并发服务侧,已用 vLLM 求证

NVFP4 的真正红利不在单流 decode,而在并发吞吐。同一张 R6000,VLLM_MOE_FORCE_MARLIN=1:

并发 1 16 64(release soak)
输出 tok/s 175 1289 2434(0 failed)

NVFP4 vs FP8(同机同 harness):每档都赢 1.14–1.34×。我们把这条 W4A16 NVFP4 Marlin 路径的回归测试 / 文档 / 正确性门禁回馈给 vLLM(3 个 open PR,maintainer review 中):

  • #44671 Add ModelOpt W4A16 lm_head regression tests
  • #44672 Document ModelOpt W4A16 NVFP4 Marlin path
  • #44673 Add speculative decoding correctness gate

🔭 V0.80 起源:CLI Worker, V0.86 安全边界与运行时可靠性更新

V0.80 把 Lynn 带回编程主战场,但不是再做一个单 CLI 或 IDE 插件。最初的方向是探索多 CLI Agent 编排;到 V0.86,GUI 右侧收敛为更直接的 当前会话 + 最近会话 + 文件 + 确认改动,Brain 与本地 Agent 也把工具暴露、空答接班、权限边界和单轮状态重置变成可回归的运行时契约。公开可下载的 27B Coding Q4 MTP 继续作为默认端侧模型;并行 worker 能力保留在 CLI,给终端、CI 和其他 Agent 无头调用。

这不是“不服务代码”。恰恰相反,Lynn 要把代码任务和业务任务放到同一个调度系统里:

  • GUI 会话进度:在 Lynn 桌面端沉淀当前会话、需要处理的信号、最近会话、证据、文件和分支关系。
  • CLI 无头 worker:统一调度 Codex、Claude Code、Qwen、codebuddy、Kimi、opencode 或自定义 CLI,每个 worker 可进入独立 worktree。
  • 任务协议化:自动生成 task brief,包含 owned files、forbidden files、验收标准、测试命令和提交要求。
  • 验收收口:worker 完成后回到 GUI 的 diff、证据、测试门禁和发布流里验收。
  • @lynn/cli:CLI 包支持 Lynn -pLynn codeLynn agentsLynn worker run,既能给终端用户使用,也能被其他 Agent 调用。

Cursor 解决“我正在编辑这段代码”;Claude Code / Codex CLI 解决“我在终端里让一个 Agent 干活”。Lynn V0.86 解决的是下一层问题:长会话、证据、文件、任务和分支关系怎么被安全地看见、同步、验收和收口。

CLI 快速安装

V0.80 的 CLI 是 Lynn 的终端版:跑在命令行里的 AI 编码助手,带终端 TUI、完整 Markdown 渲染、流式输出、工具调用和长任务续跑。它可以独立给人使用,也可以给其他智能体和 CI 当无交互 worker。一行命令装好,不用克隆仓库、不用编译。

# 1. Node requirement: Node.js 20 LTS or 22 LTS with npm.
# Check: node -v should be >= v20.
# macOS: brew install node@20
# macOS/Linux: nvm install 20 && nvm use 20
# Windows: winget install OpenJS.NodeJS.LTS

# 2. Install or update from the Lynn mirror. --force is safe for first install too.
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.86.1.tgz"

# 3. Launch.
Lynn            # interactive chat TUI; 输入 /voice 或 lynn voice 进入实时语音
Lynn code       # coding-agent TUI
Lynn --version  # should print 0.86.1
Lynn agents     # copyable headless worker commands for other agents

默认走 Brain V2 路由:本地 Lynn Brain 可用时优先本地,不可用时自动回到 Lynn 远端 Brain。v0.85 的 GUI/CLI 普通对话与任务执行统一回到 StepFun 3.7 Flash(256K 上下文,Brain 托管 reasoning / 生成预算) 一条龙主链,优先保证能正常对话、能完成工具任务、能给出最终答案。视觉由 StepFun step-1o-turbo-vision 承接;语音由 Brain 托管 StepFun Realtime 承接,CLI 当前 chat 内 /voice / lynn voice 与 GUI 麦克风默认就是实时语音对话。本地 manager 作为显式 Lynn manager run 实验链路保留,不会抢占默认 GUI/CLI 路径。纯 CLI 用户也可以用 Lynn providers set ... 绑定自己的 OpenAI 兼容端点。

长任务默认采用 Reasonix 风格的前置缓存纪律:稳定前缀、工具定义、运行时约束和 resume 摘要分层固定,避免每轮重排导致 prefix drift;缓存命中以 prefix-cache ... hit 进入 usage、session、replay 和 Lynn cache doctor --json,不在界面里制造上下文焦虑。

面向其他智能体的最短静默契约:

Lynn code -p "fix tests, run the suite, summarize the diff" \
  --json \
  --cwd /path/to/worktree \
  --approval yolo \
  --sandbox danger-full-access \
  --save-session

需要“穷尽最优解”时用 --best(或 /goal / /best 交互入口):Lynn 会启用 300 步预算、ultra 任务分解、原子 worker、对抗式验收、自动验证、checkpoint/resume 和运行时压缩。它不会用路由替模型选答案,只负责拆步、调度、验证和防工具风暴。

机器调用请只解析 JSONL,不要解析人类 TUI。完整契约见 docs/ops/lynn-code-headless-agent-contract.zh.md / English contract

Agent Quick Contract

Lynn 也可以作为给 Codex / Claude Code / Qwen / Kimi 调用的 worker-runner。交互式 TUI 给人看;机器调用请用 -p --jsonworker run --jsonl

# 单次无交互任务,打印 JSON/JSONL 后退出。
Lynn -p "总结这个 repo" --json
git diff | Lynn code -p "审查这个 diff,只输出风险和测试建议" --json

# 无头 worker:给终端、CI 或其他 Agent 调用的统一适配器。
Lynn worker run --brief task.md --worktree . --jsonl
Lynn worker run --brief task.md --worktree . --agent codex-cli --jsonl
Lynn worker run --brief task.md --worktree . --agent claude-code --jsonl
Lynn worker run --brief task.md --worktree . --agent qwen-cli --jsonl

一个 --agent 把任务派给 Codex / Claude Code / Qwen / Kimi / CodeBuddy / OpenCode 或 Lynn 自身,统一吐 Fleet JSONL。安全边界守在 Lynn 侧(ownership / forbidden-glob / diff 校验 / gate),不依赖外部 worker 自觉。

成功信号 = gate.finished.ok;硬失败 = worker.violationworker.error{recoverable:false}。完整规范(BYOK 配置 / agent 适配表 / 全事件 schema / code tools)见 docs/ops/lynn-cli-agent-contract.md

🆕 近期更新

v0.86.1 体验与可靠性更新:

  • CLI Ink 退出链路修复:忙碌时 Ctrl+C 只取消当前轮,REPL 保持可用;完整 Ink PTY 门禁要求 1 秒内取消并最终零退出。
  • CLI 质感与长会话稳定性:历史输出改用 Static 保留,不再因固定条数截断;流式 Markdown 40ms 合批,工具开始/完成合并为同一行,输入框支持可见光标、左右移动和行首/行尾。
  • 端侧 27B 下载可管理:默认 Q4 imatrix MTP 下载显示真实总进度、分片、速度和剩余时间,支持暂停、断点继续、取消与删除;切到云端不再锁死安装流程。
  • 本地模型提示不再每天打扰:硬件不足仍不主动推荐,符合条件的设备可选择“7 天后提醒”或“不再提醒”;PID、端点和槽位收进诊断详情。
  • GUI 更容易找到内容:会话搜索默认可见,长对话提供回到最新消息按钮;输入区低频功能收进“更多”,停止操作立即显示反馈。
  • 错误与主题可读性:网络、认证、超时和本地运行时错误统一显示人话;暖纸/深色主题提高次要文字对比度,并补齐跨主题语义变量。
  • 高风险回答采用异构复核:DS V4 Flash 继续异步快速复核;仅当医疗、法律、金融或时效事实回答被判为有疑点时,再由 MiMo 2.5 Pro Token Plan 做一次限时仲裁。仲裁不阻塞原回答、不触发自动重答,GUI 和 CLI 都会显示结构化结论。
  • V0.86 安全基线完整保留:自动浏览器权限、OS 沙箱、IPC/SSRF、本地服务鉴权、会话互斥、工具取消和跨轮污染修复继续受安全测试与 Agent 回归门禁保护。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.86.1.tgz"

完整 Release Notes →

v0.86.0 安全、运行时与体验更新:

  • 自动浏览器默认拒绝敏感权限:模型访问的网页不能静默获取麦克风、摄像头、定位或通知;所有导航和子资源请求都经过 DNS/SSRF 校验。
  • 执行模式仍受 OS 沙箱保护:授权确认不再等于完全放开系统;SSH、云凭证、浏览器用户数据、Lynn token 与 Agent 配置均禁止模型读取。
  • 本地服务信任边界收紧:IPC 只信任已知窗口对象,失败会返回可追踪错误;本地 HTTP/WS 校验 Host、Origin 与启动 token,敏感配置统一使用 0600 权限。
  • Windows 27B 启动修复:支持通过 where.exe 发现 PATH 中的 llama-server;手动 GGUF 启动会返回真实 ready/失败状态,端口占用、缺 runtime、超时和崩溃都有明确提示。
  • 会话可靠性:同一 session 的 prompt admission 串行化,turn_end 四类兜底有独立单测;移除废弃 internal retry 状态,断线重放容量提升并可配置。
  • Brain 双层伪工具防线:腾讯 Brain 已部署跨 chunk sanitizer,客户端仍保留末端清理;普通代码/JSX 文本不会被误删。
  • CLI 可控、可脚本化:流式回答支持 Ctrl+C 取消;未知 flag 立即报错;命令级 help、非 TTY 退出码、manager/worker JSONL/纯文本行为一致,Windows 外部 worker 使用 argv 执行。
  • GUI 状态更可见:Fleet 任务进入活动面板,语音显示 RTT/上下行统计,崩溃恢复给出提示;Bridge、模型状态和语音操作补齐中英文与键盘焦点管理。
  • 发版门禁加固:Brain mirror/prod 漂移检查、CLI100、GUI100、Agent regression、Windows/macOS 打包验证继续作为发布硬门槛。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.86.0.tgz"

完整 Release Notes →

v0.85.10 运行时与体验更新:

  • 会话进度更直观:右栏只突出一次当前会话,最近会话默认收起详情;“打开会话”“新建分支”动作明确,键盘焦点和展开状态可访问。
  • 防止回合状态串线:每轮开始统一清理工具、重试、解析器、定时器和临时输出状态,避免“重新回答”后把上一题目标或结果带进下一题。
  • 普通回答不再误生成文件:只有明确要求报告、HTML、PDF、PPT、附件或导出物时才开放交付物工具;清单、设定表、代码和解释直接留在聊天正文。
  • Brain 兜底真正可执行:Step、DS V4 Flash、MiMo Token Plan、端侧和 GLM 各有独立尝试时限,单个候选不会吃光整轮;reasoning-only 和半句截断会交给下一候选完整回答。
  • 实时工具按需出现:明确查证、来源、天气、行情、比分、新闻等请求仍走证据工具;普通写作、规划和解释不再无意义启动搜索。
  • 结构门禁补强:拆出 WebSocket transport、布局控制器、Engine/Agent 边界帮助模块,并新增前端运行时循环依赖门禁和真实 Session Progress 组件回归。
  • 本地 27B Agent 链路保持完整:默认 Q4 imatrix MTP 下载与 draft-mtp 启动不变;代码/工具任务继续进入完整 Agent loop,而不是降成只聊天的直通回答。
  • 右侧空状态更紧凑:没有历史会话时不再出现整栏空白,内容多时才滚动;巡检延迟刷新也会随界面卸载清理。
  • 打包门禁收口:macOS/Windows dist 都先经过完整发布门禁,固定覆盖 Agent regression、CLI100 和 GUI100。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.85.10.tgz"

完整 Release Notes →

v0.85.8 本地模型热修:

  • 修复 GitHub #2 Windows 27B 启动失败:部分 Win11 环境中的 llama.cpp 不支持 0.85.7 固定传入的新版 MTP / reasoning / KV cache 参数,导致模型校验完成后服务立即退出;现在会按本机 llama.cpp 实际支持的参数自动降级启动。
  • 主界面不再“点了没反应”:聊天栏会监听 llama.cpp 启动失败/崩溃事件,收起启动中状态,显示明确错误并引导到设置页查看详情。
  • 设置页显示真实失败原因:本地模型面板会展示 child-exited、启动超时或子进程输出,方便定位二进制/参数/模型文件问题。
  • 确认 #75 python3_not_found 已被当前链路覆盖:桌面端继续走 Electron 主进程 downloader / manager,干净安装不要求用户机器有 Python。
  • 保留 v0.85.7 端侧模型链路:默认仍是公开 27B Coding Q4 imatrix MTP;低配设备不主动弹安装引导,9B / 4B 只作为显式降级选择。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.85.8.tgz"

完整 Release Notes →

v0.85.7 端侧模型链路与发版纪律:

  • 默认端侧模型切到公开 27B Coding Q4 MTP: 设置页推荐 Qwen3.6-27B-DSV4Pro-GLM52-SFT-GPT55-RL-Coding-GGUF 的 Q4 imatrix MTP 四分片,总量约 19.6GB。
  • 模型链接修正: README、Release notes、下载页和应用推荐都指向可打开的 ModelScope / HuggingFace GGUF 镜像,不再跳打不开的非 GGUF 页面。
  • 低配不主动打扰: 硬件不足时聊天窗不会主动弹 27B 安装引导;9B / 4B 保留为设置页里的低配降级入口。
  • 修复本地模型 python3_not_found: 桌面端本地模型安装优先走 Electron 主进程下载器,不再依赖旧 Python bootstrap 阻塞“设置 → 模型 → 加载本地模型”。
  • 发版流程加严: 新版本/热修必须同步 LynnMerkyor/LynnMerkyorLynn/Lynn、Gitee merkyor/Lynn 和腾讯镜像下载站;release:verify-remotes 默认校验三远端。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.85.7.tgz"

完整 Release Notes →

v0.85.6 客户端修复与发版覆盖:

  • 修复 IJV6WH 本地绝对路径读取:用户明确要求“阅读 /Users/.../main.tex”时,Lynn 会按那个文件读取,不再退回当前 workspace 目录或误报“空目录”。
  • 修复 file:// 说明类问题误触发读目录:询问“为什么 file:// 协议被阻止”这类元问题时,不会把 file:// 当成本地文件路径去预取,避免答非所问。
  • 修复上一题路径/ComfyUI 任务污染:上一轮 ComfyUI、main.tex 或其它文件任务不会继续污染下一轮普通追问;回归测试已覆盖“先问 ComfyUI、再读 main.tex”的串题场景。
  • 大文件读取更稳:用户点名的大文件只做可控 preview,避免一次性把巨大 LaTeX/代码文件塞进模型上下文导致卡顿或截断。
  • Windows 路径更兼容:D:\...D:/...%20 编码路径都按本地文件处理,不会误判成 URL 或协议说明。
  • Windows CMD 弹窗热修:GUI、CLI、Agent 工具、MCP、本地模型、语音和 worker 后台子进程统一设置 windowsHide;release static gate 已加入生产代码与主进程 bundle 扫描,漏掉即阻断发布。
  • 设置页入口更稳:从聊天窗/本地模型提示跳到“模型服务”设置时,不再偶发落回“关于”页;安装态门禁已覆盖设置页供应商列表和模型删除回归。
  • 门禁覆盖:本次客户端包按发布指令完成 CLI100、packaged server / CLI smoke、远端 CLI 安装烟测、macOS 公证/Gatekeeper、三远端同步和 GitHub CI;日常生活、政务/法律、医疗、教育、旅行、招聘、办公、行业运营、代码和小说写作场景已进入同一套回归集,CLI/GUI 同核回归不再只靠人工体验。
  • 保留 v0.85.5 体验改动:右侧“会话进度”、27B 端侧默认推荐、低配不主动弹本地模型引导、隐藏推理短答兜底继续保留。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.85.6.tgz"

完整 Release Notes →

v0.85.5 体验修复与发版整合:

  • 右侧栏改为会话进度:不再把“工作地图”做成内部调试面板,而是优先展示当前会话、需要处理、最近会话和轻量预览;历史会话卡片有明确“打开”按钮,当前会话可直接“继续输入”。
  • 减少内部术语和空白面板:“地图/资料/巡检/推进中/已收口”收敛为“进展/文件/同步/进行中/已完成/需要处理”;没有相关会话时展示最近会话,底部提示更早历史可从左侧搜索打开。
  • 端侧模型推荐链路确认:默认推荐切到 Qwen3.6-27B DSV4Pro GLM52-SFT-GPT55-RL-Coding LynnStyle Dense;32GB 优先 Q5,24GB 用 Q4,16GB 用 Q3,8GB 只作为 Q2 实验档。9B / 4B 仅作为低配置显式降级,35B-A3B 保留为 legacy 可选。硬件不足时不会主动弹 27B 安装引导。
  • 本地模型入口更直接:聊天输入区的本地模型提示可直接准备并启动 27B,不再先把用户丢到设置页。
  • 隐藏推理短答兜底:当模型把大量内容放进 reasoning、最终可见答案只剩半句时,Lynn 会补出明确可见收口并触发自动复查。
  • 保留 v0.85.4 修复:点击“重新回答”后再问新问题,不会复用旧 prompt、旧 replaceFromMessageId 或旧回滚目标。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.85.5.tgz"

完整 Release Notes →

v0.85.4 热修:

  • 修复“重新回答”污染后续问题:点击助手消息的重新回答后,Lynn 会从对应上一条用户消息处回滚旧分支,再按正常发送链路重新请求;之后再问新问题时,不会复用上一轮 prompt、旧 replaceFromMessageId 或旧回滚目标。
  • 发送失败不污染当前会话:重新回答或编辑重发如果发送失败,只恢复输入草稿,不会把失败轮次乐观上屏,避免下一问继承半截旧状态。
  • 补齐回归测试:新增覆盖“点重新回答后再问新问题”的精确测试,断言第二次 WebSocket payload 是新问题,并且没有携带旧分支替换参数。
  • 保留 v0.85.3 质量修复:sports 直证据闭环、本地数据分析直答、证据兜底安全、Windows 工作区修复、Session Runtime 拆分和更新源切换继续保留。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.85.4.tgz"

完整 Release Notes →

v0.85.3 热修与质量修复:

  • GUI / CLI sports 证据闭环修复:sports_score 命中 ESPN 直证据后会直接收口,不再被泛搜索、自动任务列表或旧比分覆盖;今晚世界杯有比赛吗/几场 这类实时问题已进入门禁。
  • 未知问题 ReAct 纪律加固:默认链路先判断是否需要工具,再观测工具证据,最后只基于可用证据总结;工具失败时不再用无关本地任务或泛搜摘要冒充结论。
  • 小型本地数据分析直答:纯算术/经营分析题不会误触 step_execute 后超时,会直接给出计算结果和建议。
  • Windows D 盘工作区修复:选择 D:\... 等非用户主目录工作区后会立即写入 last_cwdcwd_historydesk.trusted_roots,书桌文件列表和新会话不再回退旧目录。
  • IJV6WH 证据兜底修复:本地文件 read 只返回路径、LaTeX 模板包名或 \includegraphics 结构片段时,不再当作“我能确认”的事实结论,会明确提示证据不足。
  • 旧任务污染回归:编辑重发、助手重做和发送失败场景都有回归测试覆盖,避免“问新问题却继续回答上一个任务”。

稳定新内核与工作地图:

  • v0.85 自研核心稳定版:继续保持完全替换 Pi SDK 主链、NO Fork、自主 runtime 的方向,把空答、证据完整性、GUI/CLI 差异和 provider 抖动纳入发版门禁。
  • Session Runtime 拆分:create-session.ts 从 1700+ 行拆出 OpenAI/工具续轮适配和证据兜底 helper,保留对外 API 不变,降低后续修复空答、工具链和 fallback 的耦合风险。
  • Session Map 工作地图:右侧旧便签区替换为当前会话工作台,展示当前线索、巡检状态、证据/资料和“从此分支”入口,左侧不再只靠一串重复“新对话”和数字导航。
  • 超大 session health 标记:巡检会标记 large / huge / blocked / archived 等状态,让 7GB 级历史会话变成可见风险节点,不再一打开就拖死 GUI。
  • 主界面减法:GUI 不再展示 Fleet 指挥台和独立便签面;MCP 接入收进设置。并行 worker 能力保留在 Lynn worker run / Lynn agents 里,给终端、CI 和其他 Agent 无头调用。

GUI / CLI 与 Brain 运维:

  • GUI / CLI 继续同核:桌面包和 CLI 包都走 Brain V2、证据优先、工具事件和最终可见收口门禁,CLI 不再作为另一套临时补丁面存在。
  • 从当前会话开分支:长对话可以保留血缘、摘要和下一步,同时用新会话继续工作,减少把完整长上下文反复拖入模型。
  • Brain auth / healthcheck 修复:修复一条损坏 device JSON 导致的 internal auth error,v2 healthcheck / cron-smoke 改为 HMAC 签名请求,并停止旧 v1 smoke 对 MiMo 过期 key 的噪声调用。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.85.3.tgz"

完整 Release Notes →

Runtime 稳定性与后续替换准备:

  • Pi SDK 接缝收口:主聊天、Bridge、isolated dry-run、Hub agent executor 四个会话入口统一经过 createLynnAgentSession,为后续自研 transport / loop 替换打下单一入口。
  • Brain 托管工具清单统一:web_searchstock_marketweather 等 Brain 已执行工具统一到一个共享清单,避免本地二次执行、工具 trace 串台或三处清单漂移。
  • 替换 Pi SDK 设计文档:新增 docs/PLAN-pi-sdk-replacement.md,明确 P1a transport、P1b 工具、P2 loop、P3 清理的拆分、验收与回退策略。
  • 编排/执行/复核固定化:主回答继续走 StepFun / Brain 托管工具链,Hanako 自动复核改为 Hanako · DS V4 优先,DeepSeek V4 Flash 先做事实核查与反驳,MiMo 和 GLM 仅作为二、三梯队 fallback,减少空答和乱说后的无人接管。

Hana / Hanako legacy 兼容清理:

  • Lynn 根路径与 fetch 命名:新增 LYNN_ROOTwindow.lynnlynnFetch,并保留 HANA_ROOTwindow.hanahanaFetch 兼容旧插件 / 脚本。
  • notary profile 默认改名:发版脚本默认使用 lynn-notary,避免继续依赖旧 Hanako 命名。
  • 兼容不破坏:旧 hana-* 入口仍可用,本轮只建立 Lynn-first alias,不做风险较高的大规模重命名。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.84.9.tgz"

完整 Release Notes →

自动复查与兜底:

  • Hanako 自动复查:事实题、工具结果、空答兜底等高风险回答会自动触发 Hanako · MiMo/GLM 复查;界面会标明复查模型、结论、发现数和建议动作。
  • 复查备用链路:MiMo 优先,GLM 作为低并发 fallback,避免 GLM 并发 429 时整条复查链路空转。
  • 默认/BYOK 空答兜底延续:模型未返回可见内容时仍会写入安全兜底,避免空 assistant 轮污染后续上下文。

GUI / CLI 稳定性:

  • 主聊天输入区窄窗修复:左侧栏存在、窗口未全屏时,输入区和底部按钮不再按 100vw 撑出主内容,解决横向拉长前显示不完整的问题。
  • 真实安装包门禁:新增 installed gate,在 /Applications/Lynn.app 上真实点击 Settings、主聊天输入区、模型下拉、任务模式、执行模式,并发跑 Hanako 自动复查;失败即阻断发布。
  • 工具成功无总结链路继续加固:复杂工具成功但模型未总结时,会基于工具证据生成可见收口摘要,并支持编辑重发恢复。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.84.8.tgz"

完整 Release Notes →

工具收口与复查稳定性:

  • 复杂工具成功但无总结兜底:看图、文件、搜索等工具均成功但模型没给最终总结时,Lynn 会基于工具证据生成可见收口摘要,避免只剩“已执行 N 个操作”。
  • 编辑重发恢复修复:上一轮仍在处理或发送失败时点击“编辑重发”,不会把旧替换目标残留到下一条普通消息里,避免后续误截上下文或出现 error。
  • Hanako 自动复查兜底延续:默认模型或 BYOK 模型无可见内容、事实题需要校验时,Hanako · MiMo/GLM 会作为复查/补位链路介入。

Issue #74 与 BYOK 模型闭环继续保留:

  • DeepSeek V4 Pro / V4 Flash 实测可连续对话:DeepSeek provider 统一大小写与 id 归一,旧版不可读 API Key 会明确提示重填,重复 provider 不再把模型路由到空 key 条目。
  • 思考模型空答污染修复:BYOK 思考模型出现纯空轮时会写入可见兜底文本,并在下一轮前剥离历史里的空 assistant 轮,避免一次空答把整条会话带坏。
  • DeepSeek V4 上下文与输出预算修正:V4 Pro / V4 Flash 保持 1M 上下文,输出预算回到稳定上限,不再把超大 max_tokens 传给 provider。
  • 模型配置页修复:删除 deprecated / 误读出的模型后不会从“读取模型”结果里循环冒回;留空保存不会覆盖已有 Key。
  • 搜索、比分、行情工具修复:BYOK 工具搜索优先走 Brain GLM/MiMo 高质量链路,失败时不再把 Baidu/Bing 搜索页当证据;世界杯赛程、NBA 比分、金价、美股 NVDA 等场景均走结构化/可解析数据源。
  • 发版门禁:本地 App 包已跑 packaged server / CLI / settings smoke,并用 DeepSeek V4 Pro / Flash 做真实多轮验证。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.84.6.tgz"

完整 Release Notes →

默认模型 Agent 工作流热修:

  • GUI / CLI 本地文件任务修复:默认模型会收到真实本地 workspace 摘要,“找本地第一章小说”“读桌面文件”“查看当前目录”这类只读任务不再误答“无法访问本地文件系统”。
  • 本地文件直接回答兜底:简单只读文件搜索会先用本地扫描结果给出确定上下文;章节暗号、文件片段等能稳定返回,不依赖模型猜权限。
  • 工具边界修复:Brain 托管实时工具与客户端本地工具分离,不再把 GUI/CLI 的本地文件、搜索、代码工具整批压掉。
  • 本地 Qwen direct bridge 收窄:utility / coding 任务不再绕过工具链直连本地模型,需要工具时会走正常工具路径。
  • 伪工具调用清理:模型吐出的 <tool_call> / <function=...> 模拟工具文本会在服务端流式和前端渲染两层清理,不再展示给用户。
  • Agent 任务矩阵门禁:新增 release gate 覆盖 GUI + CLI 本地小说/文件读取、路由分类、工具边界、伪工具泄漏与 live smoke。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.84.4.tgz"

完整 Release Notes →

同日稳定性修复:

  • CLI 实时语音断句修复:当前 chat 内 /voice / lynn voice 仍然进入 Brain 托管 StepFun Realtime,但 CLI 端改为 raw mic 默认 + 本地 VAD 负责停顿提交、Brain 端关闭 server_vad 抢断,最长 10s 兜底提交、播放时暂停采麦;旧 dynaudnorm 滤镜只做 opt-in,避免再次出现“有波形但一直在听、不回答”的问题。
  • Issue #74 BYOK Key 重置修复:provider API Key 不再用 macOS 易漂移的 hostname 派生加密密钥,改为绑定 Lynn 数据目录的稳定随机 seed;旧 hostname 密文保留回退解密,坏密文按缺失处理,避免设置页 Key 看似重置、模型拿不到 key 而不回复。
  • Hanako 数据隔离继续收紧:provider key seed 只写入 Lynn 自己的数据目录,不读取 HANA_HOME~/.hanako
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.84.2.tgz"

完整 Release Notes →

GUI 与 CLI 同步发版:

  • StepFun 3.7 Flash 默认主链:普通 GUI/CLI 对话、Lynn -p 和编码执行默认走 StepFun 3.7 Flash,不再让实验性 manager 抢占默认回答路径。
  • 🎙️ 实时语音主入口:GUI 麦克风与 CLI 当前 chat 内 /voice / lynn voice 默认走 Brain 托管 StepFun Realtime 连续对话;CLI 在聊天框下方显示状态与采样波形。ASR 转写、录一句和 TTS 保存作为辅助命令保留。
  • 🩹 GUI 空答修复:旧会话复用过期设备签名时会自动刷新签名;工具链最终答案晚到时不再被 8 秒硬关流吞掉。
  • 🧯 GUI 内容串台修复:Brain V2 托管的 stock_market / web_search 等工具 trace 不再被本地 Pi SDK 当作客户端工具二次执行,避免“金价工具结果串到英伟达问题”或红叉假失败。
  • 🎛️ CLI 实时语音补强:当前 chat 输入框内 /voice / lynn voice 是一眼可见的主入口;CLI 端加入本地停顿提交与播放失败提示,避免“有波形但不出声/不结束本轮”。
  • 🧠 reasoning-only 空答重试:Brain 在源头识别“只有思考、没有可见正文”的响应并重试,减少“思考完但不说话”。
  • 🔧 工具 turn 收口更诚实:工具完成后如果还在等待模型最终答复,显示事实性的工具完成状态,不静默关闭、不伪造本地总结。
  • 📊 GUI token/cost pipeline:SDK usage → WebSocket → store → 输入行 chip 打通,桌面端能长期显示会话 token/cost 状态。
  • 🧭 Fleet 可发现性与验收面板:桌面端增加 Fleet 入口和 acceptance panel,便于调度黑灯工厂 worker。
  • 🧪 Issue #72/#74 数据隔离与自愈:Lynn 默认不再读取/迁移 ~/.hanako;只有显式设置 LYNN_IMPORT_HANAKO_ON_FIRST_RUN=1 才导入。已被旧版污染的 ~/.lynn 会在启动时把已下线 MiMo/TokenPlan 模型引用修回 Brain 默认路由,同时保留用户 API key。
  • 🛡️ 安全与 BUG 修复附带:设备签名刷新、工具 turn 收口、reasoning-only 空答重试、Fleet 验收面板和发布门禁随本版一起落地。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.84.1.tgz"

完整 Release Notes →

CLI-only 热修,GUI 仍为 v0.80.1:

  • 💾 前置缓存命中可见:借鉴 Reasonix 的 prefix-cache 思路,stable prefix / resume history / volatile runtime / current user 分层固定;usage、session、replay 和 Lynn cache doctor --json 会显示 prefix-cache ... hit,但不在聊天 UI 里显示 ctx% 焦虑条。
  • 🧱 长任务运行时压缩:Lynn code --long 在工具循环中自动压缩旧消息,保留原始目标、当前计划和最近工具结果;JSONL 会发出 code.runtime.compacted,人类 TUI 会显示轻量信息卡。
  • 🔁 Brain 早期断流自动重试:如果 SSE 在任何可见内容/工具调用前断开,CLI 会指数退避重试;一旦已经开始输出,不会重试以避免重复半轮工具调用。
  • 🧭 计划与工具卡片继续打磨:update_plan 和 resume 计划回显使用 Claude Code 风格 plan card,工具/路由/压缩状态保持左 gutter 卡片风格。
  • 🧪 门禁覆盖长跑压缩路径:cli-longrun-smoke 会制造大工具结果并要求出现 code.runtime.compacted,避免长任务稳定性只停留在单测。
npm install -g --force "https://download.merkyorlynn.com/downloads/cli/lynn-cli-0.84.4.tgz"

完整 Release Notes →

Lynn 有史以来最重要的编程版本:

  • 🖥️ Lynn CLI / Lynn Code:新增 Ink TUI、流光等待、Markdown/代码高亮、真实 diff 预览、多行输入、图片/音频/视频附件、Lynn code -p ... --json 无交互调用和 Lynn agents 机器可读命令面。
  • 🧭 GUI Fleet 指挥台:桌面端可以 fan-out 派单到多个 CLI worker,显示 stdout/stderr、测试、diff、越界红灯、gate 状态,并支持 gated merge 到目标分支和远端 push。
  • 🧠 Brain V2 默认路由:StepFun 3.7 Flash(256K 上下文,Brain 托管 reasoning / 生成预算) → Spark Qwen 3.6 35B A3B 单槽 → DS-V4 Flash 逃生舱。StepFun 负责高速文本/编码与视觉(step-1o-turbo-vision),Spark 接本地零成本兜底。
  • 🔗 链式工具与搜索加固:工具结果显著性注入、链式工具 hint、tool-storm 抑制、pre-search/web_search 代理和搜索源展示补齐,降低多步工具漂移。
  • 💾 长任务续跑与前置缓存纪律:CLI 会话 JSONL、checkpoint、帧恢复、计划重建、原始目标钉住、git 快照和 stable context layers 一起支撑长任务稳定续跑;cache telemetry / prefix drift 进入日志和 metadata,不增加用户焦虑。
  • 🧊 本地 9B 改为显式启用:本地 Qwen3.5-9B MTP 不再随启动自动占用约 6GB 显存/统一内存;用户点击启用时才下载/启动,并只在本地模型入口提示首次暖机较慢。
  • 📦 CLI 镜像安装与发布门禁:Node 要求、CDN tarball、Lynn/Lynn code/Lynn agents 启动命令和 headless contract 写入 README、CLI README、release notes 与 release static gate。

完整 Release Notes →

稳定性与维护成本下降版:

  • 🧩 五个高风险中枢拆分:InputAreastock-marketmcp-clientbridge-managerengine/agent 已拆出稳定边界,降低后续改动冲突和回归面。
  • 🔎 搜索工具更可解释:web search 默认优先走 brain v2 本地 proxy,搜索 key 不进客户端;聊天工具卡支持展开查看综合答案与搜索源。
  • 🧭 本地模型升级窗口:默认仍是 Qwen3.5-9B Q4_K_M imatrix MTP;旧版 9B GGUF 会显示为“可升级到 9B MTP”,不会误判为默认就绪。9B/35B 下载入口指向 ModelScope MTP 仓库,启动默认保持 MTP + thinking-on,并在模型卡标注 DGX Spark TPS 区间。
  • 🛡️ 中枢回归继续收紧:session event、tool runtime、dynamic prompt、MCP transport、bridge streaming/attachment 和搜索源摘要都补了 focused tests。
  • 发布门禁:V0.79.9 候选已通过 typecheck、runtime typecheck、全量 vitest、三段构建与 release regression 门禁。

完整 Release Notes →

V0.79 最后中枢 TypeScript 收口版:

  • 🧱 LynnEngine 门面迁入 TS:core/engine 已从 JS 迁入 TypeScript,agent/session/config/model/plugin 组合入口进入 runtime typecheck。
  • 🔁 兼容旧入口:历史 HanaEngine import 保留为 LynnEngine 的别名,插件和旧代码无需立即改动。
  • 🧰 工具安全边界纳入类型检查:tool guard、工具别名、MCP 按需激活、sandbox 参数和事件广播边界补齐类型外壳。
  • 🧭 前序中枢迁移保持稳定:server/routes/chatcore/session-coordinatorcore/agent 仍在同一 release gate 下回归。
  • 🧭 本地模型口径不变:默认仍是 Qwen3.5-9B Q4_K_M imatrix MTP;4B 保持低配降级,继续提示 thinking-on 风险。
  • 发布门禁:V0.79.7 合入后通过 typecheck:runtime、全量 typecheck、全量 npm test、release static/UI/live regression 与打包公证门禁。

完整 Release Notes →

V0.79 架构安全推进版:

  • 🧱 TypeScript 迁移继续推进:server/chat 多个叶子 helper、server/routes 轻路由、shared runtime 工具与配置迁移到 TS,减少字符串 typo 和隐式 unknown 进入热路径。
  • 🔎 更稳的 release gate:V0.79.3 合入后通过全量 npm testtypechecktypecheck:runtime、server/main/renderer 构建与目标回归测试。
  • 🧭 本地模型口径不变:默认仍是 Qwen3.5-9B Q4_K_M imatrix MTP;4B 保持低配降级,继续提示 thinking-on 风险。
  • 🧾 聊天与 artifact 热路径更容易维护:stream emitter、turn state、artifact recovery、tool summary、voice fallback 等模块进入 TS 边界,为后续拆 chat.js 和 core 做铺垫。
  • 🧪 core 大迁移延后:core/session-coordinator.jscore/engine.js 等大文件不塞进本次包,避免为追求 JS 占比牺牲发版稳定性。
  • 📦 macOS 三重校验完成:Apple Silicon / Intel DMG 已签名、公证、stapled,并通过 Gatekeeper 校验;Windows 提供签名 NSIS 安装包。

完整 Release Notes →

V0.79 稳定收口补丁:

  • 🧭 本地模型引导维持 9B 默认:继续默认 Qwen3.5-9B Q4_K_M imatrix MTP,4B 只作为低配降级并保留 thinking-on 风险提示。
  • 🌦️ 天气/实时工具链路加固:天气回答按工具返回的绝对日期与降水描述输出,避免把“未来两天/明后天”解释错。
  • 🔁 Brain v2 fallback 更稳:Spark APEX-MTP fallback 修正模型 ID、默认关闭 thinking,并把本地 provider health probe 从冷启 800ms 误判加固为可配置超时。
  • 🧾 Deep Research artifact 统一:本地模型、BYOK 和默认模型的 HTML 报告统一落为聊天内可点击预览卡片。
  • 🧱 架构债务清扫:brain-v2-mirror 完成 TypeScript island 后继续收紧热路径类型;server/chat 叶子模块与 core provider/LLM contract 增加 TS 迁移前的类型边界。
  • 发布门禁:npm test 全量通过,新增 typecheck:runtime,brain-v2 tsc + 104 tests 通过,release preflight 覆盖构建与回归。

完整 Release Notes →

本地模型默认档更换:

  • 🧠 默认 Qwen3.5-9B Q4_K_M imatrix MTP:5.38 GB · 24GB 显存/统一内存推荐 · MTP 加速 · thinking-on 稳定性优先。4B 复测确认 thinking-on 有长思考后无正文风险,不再作为默认引导模型。
  • 🎚️ 三档硬件分级:
    • 默认 (24GB 显存/统一内存+):Qwen3.5-9B Q4_K_M imatrix MTP — 质量更强,带 MTP 加速
    • 低配降级 (8~16GB 可选):Qwen3.5-4B Q4_K_M imatrix (Lynn) — 建议 thinking-off,thinking-on 可能长思考后无正文
    • 高端 (24GB 显存/统一内存+):Qwen3.6-35B-A3B Q4_K_M imatrix — MMLU 90.40% / GPQA Diamond 80.70% · Lynn 校准 · 21 GB
  • 🔁 平滑迁移:旧 4B 默认配置自动回到 9B MTP;4B 保留为显式低配降级。
  • 🧾 深度调研 HTML 报告:本地 9B、BYOK 和默认模型都会生成聊天内可点击预览的 HTML 报告;本地/部分 thinking 模型遇到空正文会自动 no-think fallback。
  • 🛡️ 架构与安全刷新:聊天主链拆分为更小的服务模块,本地 GGUF 下载增加源地址/文件类型校验,模型状态与 token 文案统一到 provider state,避免 4B/9B 状态误导。
  • 测试矩阵:9B MTP、GPT-5.4、默认模型安装版 smoke 全绿;Deep Research 三路 HTML artifact 门禁全绿;4B thinking-on 风险已在 Spark 复现并写入模型说明。

[完整 Release Notes →](http