本地 LLM · Mac · 把内存账算完再吹 能跑起来 ≠ 用起来爽

Pinned Tweet
想吐槽一下最近网上那波「128G MacBook Pro 本地跑 Qwen3.8-Flash-Next 爽翻了」。 模型本身没问题,问题是——你们真的把内存账算完了吗? Q3 量化,内存就得吃掉接近 90G;IQ4 更是贴着 95G 往上走;上下文拉到 262K,整体内存占用直接 100G+。 然后再考虑 macOS、Metal、系统缓存,以及开发环境本身的内存开销。 你把 Docker 关了,Chrome 清了,IDE 关了,后台服务停了,甚至各种 sysctl 参数都调一遍,最后终于把模型“成功加载”了。 然后呢? 128G 还剩多少? 剩下十几二十个 G,真的够你日常开发吗? Xcode、IntelliJ IDEA、Docker、模拟器、浏览器、各种 Agent、索引服务……这些东西随便开几个,内存压力马上就上来了。 所以我一直觉得: 「能跑起来」≠「用起来很爽」。 一台 128G 的 MacBook Pro,如果为了跑这个模型,把自己从开发主力机变成了一台专用推理盒,那这个“爽翻了”到底是模型爽,还是博主的标题爽? 本地部署当然值得玩,但别只晒一个“模型成功加载”的截图。 真正应该晒的是: 模型跑起来以后,我还能不能正常写代码、开 Docker、跑服务、开浏览器、跑 IDE,甚至边开发边让 Agent 干活? 如果这些都能正常干,那才叫—— 128G MacBook Pro,本地部署爽翻了。 否则,充其量只能叫: 128G MacBook Pro,成功把模型塞进去了。🙂
1
1,757
别以为点了 Restore Checkpoint,聊天记录也会一起退回去。 文档写明 Checkpoint 只回滚那一版文件快照——对话消息还在。Agent 跑歪了先认清:文件能救,会话得自己收;要永久历史还是靠 Git。 cursor.com/docs/agent/overvi…
1
1
7
别以为 Settings 里还能随手加白名单。仓库一旦塞了 `.cursor/permissions.json`,文档写明它会整表盖掉 IDE 白名单——那栏变只读,「加到白名单」按钮直接没了。你在 UI 点的那些,文件在就全作废。cursor.com/docs/reference/pe…
5
xAI 把文本、语音、图像、视频塞进同一个 TypeScript SDK 了——还挂着他们服务器上的实时 X 搜索和代码执行。以前接 Grok 要自己拼一堆端点的,现在 npm 一条线;别再把「多模态」当成五个 SDK 的拼盘。
we just launched a typescript sdk the @SpaceXAI developer experience will be first class
5
别以为丢个大需求进 Agent 就会自己先画蓝图。Shift+Tab 进 Plan Mode:它先问清再吐可改的方案,你点 Build 才动手写代码;方案默认落在主目录,不点 Save to workspace 同事根本看不到。cursor.com/docs/agent/plan-m…
4
Cloudflare 决策模型直接塞进 Ollama 了。分类图、贴错报标签、工单路由——这类活以前默认烧云端 API;现在 Clef 27B 能本地拉。别再把「小分类器」和「大聊天模型」捆在同一张账单上。
.@Cloudflare's decision models are available on Ollama! Decision models allow you to classify an image, label a bug report or route a support ticket to the right team. Clef (27B): ollama pull clef Clef Flash (9B): ollama pull clef-flash
8
云代理跑完不会直接合主分支。文档写明 Hand off:它 push 自己的分支 + 开 draft PR,人审之前什么都不 merge。你以为“开了就自动进 main”的,先去 PR 列表瞅一眼。cursor.com/docs/cloud-agent/…
4
Claude 换到 PI 掉近 20pt,GPT 反而涨——这不是模型玄学,是 harness 在干活。打榜只报模型名的,下次把工具壳也写上,不然那串百分数基本没法比。
同一个模型,换个 Agent 工具,表现能差多少? 10 月 1 日的一篇论文,把 Claude Code、Codex 和 PI 放到同一组 63 道终端任务里测,结果挺有意思。 Claude Opus 5 在 Claude Code 里的通过率是 49.21%,换到 PI,只剩 30.16%。 GPT-6 Astra 则相反,在 Codex 里是 55.56%,换到 PI,涨到了 60.32%。 同样是换到 PI,Claude 掉了近 20 个百分点,GPT 反而提高了。一个工具适合哪个模型,差别还真不小。 这就是 harness 会影响的东西。模型能调用什么工具、上下文怎么保留、报错能不能及时传回来、卡住以后怎么继续,都由外面这套系统安排。模型得先拿到有用的信息,才有机会把活干完。 而且换到论文另外两组任务,Claude Code 都是 Claude 表现最好的搭配。挑工具时,模型和具体任务都得一起看。 这组数据每题只计一次运行,各工具沿用的配置也有差异。对应的是这些具体搭配,但已经很值得想想:平时我们评价一个模型好不好用,到底有多少体验来自模型,又有多少来自承载它的工具?
4
别以为开了 Auto 就等于你挑了模型。Cursor Router(Teams/Enterprise)在 Balance / Intelligence 下会按任务复杂度自动分流,文档写明你没法手选这一轮到底进哪个模型;Admin 把池子砍太狠(Grok 4.6 还是硬要求)路由质量会掉甚至直接停摆。cursor.com/docs/cursor-route…
9
别以为 Slack / GitHub 里写了 `worker=my-devbox` 就一定能跑到那台机器——文档写明还得名字对上、机器属于你、且 worker 注册的仓库跟触发目标仓库一致;仓库对不上会直接拒,不会偷偷落到别的 checkout。 cursor.com/docs/cloud-agent/…
6
别以为塞进 `.cursorignore` 就堵住了 Agent 摸密钥。文档写明:它挡的是 Agent / Tab / Inline Edit 和 @ 引用读文件;终端和 MCP 工具照样能碰到那些路径。cursor.com/docs/context/igno…
6
别以为 Cursor 搜代码就会把仓库索引扔上云。文档写明:Instant Grep 的索引建在本机、也只在本机查;不会为了建搜索索引上传路径或代码。cursor.com/docs/context/code…
6
沙箱 + 粘性会话挺香,我卡在凭证边界——会话粘回去时,旧密钥是跟着粘,还是沙箱每次冷启动重注?Sidecar 碰不碰得到主进程那套。
Just launched at Modal Runtime: - Multi-node clusters - VM Sandboxes - Sandbox Sidecars - Sticky Sessions And more:
6
Notion 把 MCP 连接管理做顺了挺好,我更关心凭证边界——这些 MCP 密钥是挂在 Notion 工作区级,还是每个 Muse/Bot 各自一套?换一个 Bot,旧 token 还会不会自动带上。
Small QoL improvement:
4
Cloud Agent 刚加完 Secrets,别指望正在跑的那只立刻能读到。文档写明:Secrets 只在 agent 启动时注入;已经在跑的不会捡新密钥。加完得新开一只。cursor.com/docs/cloud-agent
3
MCPs 把数据塞进 HF Chat 听着爽,我更关心凭证落点——tool 密钥是停在你这边,还是进了托管会话?断线会不会把半截上下文一起带走
MCPs are making quite the comeback! You can now use them to bring your data to hf.co/chat?mode=ml-intern
4
别以为仓库里塞 `.cursor/rules/*.mdc` 就能盖过团队规则。文档写明冲突时优先级是 Team Rules → Project Rules → User Rules;Team Rules 是 dashboard 上的自由文本(可挂 glob),不是项目里那种 `.mdc` 结构。想改组织基线得去 dashboard,别在 repo 里硬怼。cursor.com/docs/rules
4
别把 Bugbot 规则塞进 .cursor/rules/*.mdc。Cursor 文档写明:标准项目规则(*.mdc)对 Bugbot 不生效;要管 PR 审查得用 .cursor/BUGBOT.md(还能叠 Team Rules)。想看某次跑了哪些规则,PR 里回一句 `bugbot run verbose=true`。cursor.com/docs/bugbot
11
别把钩子只塞本机 ~/.cursor/hooks.json。Cursor 文档写明:Cloud Agent 会跑仓库根目录的 .cursor/hooks.json(Enterprise 还有 team/enterprise hooks),但读不到你本机 home 里的 user hooks。想管云端 Agent 的 shell,hooks 得进项目里。cursor.com/docs/agent/hooks
8
别把钩子只塞本机 ~/.cursor/hooks.json。Cursor 文档写明:Cloud Agent 会跑仓库根目录的 .cursor/hooks.json(Enterprise 还有 team/enterprise hooks),但读不到你本机 home 里的 user hooks。想管云端 Agent 的 shell,hooks 得进项目里。cursor.com/docs/agent/hooks
7
远程 MCP 不只能吐文本了。Cursor 文档写明支持 MCP Apps:tool 可以直接回交互 UI;宿主渲不出就降级成普通 MCP 响应(progressive enhancement)。还有 Elicitation——服务端能主动跟你要补充信息,不是只能等你先问。cursor.com/docs/context/mcp
9