本周焦点:本地代码 Agent 从“能跑”到“能量产”;开源瞭望关注 Qwen3-Coder、Poolside 与平头哥 SAIL;自托管实验室继续深耕 Open WebUI + Ollama 本地 AI 栈。
本周焦点
这一周最值得注意的信号,不是又出了更大的模型,而是 「本地代码 Agent 开始具备量产条件」。Qwen3-Coder 与 Poolside Laguna S 2.1 同时开源,一个强调工具调用、一个强调长任务自我校验;再配合 Open WebUI 的插件与 MCP 生态,本地 AI 栈已经从“能聊天”进化到“能接工具、能改代码、能留痕”。
数据不出门、推理在本地、 Agent 能编排——这才是极客玩家真正该关注的拐点。
AI & 大模型
- Qwen3-Coder-480B-A35B 开源:阿里 Qwen 团队发布旗舰编程模型,480B 总参数、35B 激活,原生 256K 上下文,Agentic Coding / Browser-Use / Tool-Use 三项开源 SOTA,开源可本地部署。
- Poolside Laguna S 2.1 开源:118B 总参数、8B 激活的 MoE 代码模型,最高 1M 上下文,Terminal-Bench 2.1 70.2%,强调“更愿意验证、更少提前宣布完成”的工程行为。
- 本地 Agent 编排进入可量产阶段:Open WebUI + Ollama + MCP/Pipe 的最小栈已经稳定,本地知识库、RAG、工具调用、多账号权限都能跑。
开源瞭望
- Open WebUI —— 自托管 ChatGPT 平替的事实标准,插件/知识库/RAG/MCP 全有,社区 146K+ stars。
- 平头哥 T-Head SAIL —— 真武系列 AI 芯片底层软件栈开源,驱动/编译器/高性能库/ profiler 全开放,兼容主流 AI 生态。
- GigaToken —— Rust 重写的 LLM 分词工具,吞吐量比 HuggingFace 原生分词器快约 1000 倍,支持 Llama / Qwen / DeepSeek / GPT 等主流模型。
自托管实验室
本周继续把 Open WebUI + Ollama 全家桶跑在 HomeLab,并做了两项加固:
# docker-compose 片段
services:
ollama:
image: ollama/ollama
volumes: ["ollama:/root/.ollama"]
open-webui:
image: ghcr.io/open-webui/open-webui
ports: ["3000:8080"]
environment:
OLLAMA_BASE_URL: http://ollama:11434
depends_on: [ollama]
实测:内网任意设备打开浏览器即可对话,模型权重、聊天记录、知识库全部留在本地。再也不用担心聊天内容被拿去训练了。
效率工具箱
- fzf —— 命令行模糊查找,配合
Ctrl+R历史搜索爽到飞起。 - lazygit —— 终端里管理 git,告别记不住的参数。
- Happy-Code-Review —— 自托管多平台 Git 可视化管理 + AI 辅助 Code Review,支持 GitHub / GitLab / Gitee。
极客冷知识
我们熟悉的「404 Not Found」并没有官方的技术含义——它只是 CERN 当初某间「404 号房间」的编号,那间房里正好放着 web 服务器的原始文件。
本周金句:The best way to predict the future is to invent it. —— Alan Kay