Dr. Pang 史丹福机器人庞博士
  • 主页
  • AI和大模型课程
  • ChatGPT
  • Dobby智能体
  • AI照相
  • 简介
Sign in Subscribe

Leo Pang

13 款 AI 模型重新排名:规划、编码、复核与执行的模型路由

AI Models

我重新给 13 款 AI 模型排了名:一切都变了

最新 13 款 AI 模型实战分级:Opus 5.5 负责规划,GPT-6.1 Sol 负责实现,Sonnet 5.5 负责复核,并从能力、成本与任务路由重新排序。

By Leo Pang 09 Oct 2026
五大常驻 AI Agent 对决:谁真正需要托管型智能体

AI Agent

Dots、Muse、OpenClaw、Hermes 与 Grok Bot:谁真正需要托管型常驻 Agent?

五大常驻 AI Agent 的真正区别,不在谁最聪明,而在计算机、模型、安全护栏与运维由谁掌控。本文比较五种路线,并补充 Dobby 的独特定位。

By Leo Pang 05 Oct 2026
Claude Sonnet 5.5 的 Medium、High 与 Max 推理档位连接到不同 token 成本路径

Claude Sonnet 5.5

Claude Sonnet 5.5 使用指南:Medium、High 还是 Max?

Sonnet 5.5 在 Medium 与 High 档位很有吸引力,但 Max 的 token 成本可能反超 Opus。本文用基准、成本与工作负载拆解最佳使用方式。

By Leo Pang 01 Oct 2026
Jev System One AI 将非结构化信息转换为 Choice、Score 和是非概率决策,展示毫秒级速度与类型安全输出

Jev

Jev 完全指南:为更快决策而生的前沿 AI

Jev 不生成长文本,而以 70–500 毫秒返回类型安全、带校准置信度的结构化决策。本文详解 System One、三种问题类型、级联架构、案例与限制。

By Leo Pang 27 Sep 2026
Claude Opus 5.5 面向长时间编码与知识工作的发布解读,展示性能、速度和成本对比

Claude Opus 5.5

Claude Opus 5.5 发布:更快、更便宜,还是更可靠?

Claude Opus 5.5 面向长时间编码与知识工作,带来更快输出、更低单价、百万级上下文和自适应思考。本文解析能力、基准、成本与稳定性争议。

By Leo Pang 26 Sep 2026
斯坦福自我改进智能体课程示意图,对比脆弱直线流程与带评估、路由和记忆压缩的反思循环

AI Agent

斯坦福公开自我改进智能体课程:为什么你的 Agent 仍会崩溃

Stanford CS329A 公开讲解自我改进智能体。本文拆解生成器、评估器、路由器与记忆压缩,并补上可靠生产系统必须具备的预算、沙箱和人工接管。

By Leo Pang 14 Sep 2026
GPT-6 Astra 从基准实验室走向现实世界,连接科研、城市、工业和专业工作

GPT-6 Astra

GPT-6 Astra 太强了:剩下的唯一测试,是现实世界

当纸面基准逐渐失去区分度,GPT-6 Astra 真正需要证明的,是能否在现实任务中降低成本、减少监督并创造可测量的影响。

By Leo Pang 07 Sep 2026
h5i 纯 Rust AI Agent 浏览器架构图,展示结构化页面、网络策略、审计和沙箱

h5i

不用 Chromium,也不用 V8:h5i 用纯 Rust 为 AI Agent 重做浏览器

h5i 不依赖 Chromium 或 V8,而是用 Rust 组件、结构化快照、请求前策略检查与分层沙箱,为 AI Agent 打造更轻、更可审计的浏览器。

By Leo Pang 04 Sep 2026
2026 年十款现代开源开发工具分类图,覆盖数据库、UI、API、终端、语音、CMS、DevOps、PDF、办公和团队协作

Open Source

2026 年值得尝试的 10 款现代开源工具

从数据库、API、终端和本地语音,到 CMS、DevOps、PDF、AI 办公与团队协作,这 10 个开源项目正在把成熟开发工具重新带回本地与自托管。

By Leo Pang 02 Sep 2026
FreeToken、Ollama 与 llama.cpp 在 6GB 笔记本上的 MoE 推理架构对比

FreeToken

FreeToken 刚发布:它真的比 Ollama 和 llama.cpp 更好吗?

在 RTX 3050 6GB 笔记本上用同一 gpt-oss-20b 测试 FreeToken、Ollama 与 llama.cpp:速度、首 Token 延迟、MoE 动态专家缓存原理,以及 FreeToken 真正适合的硬件与模型。

By Leo Pang 01 Sep 2026
开发者对比复杂插件化 DeepSeek Harness 与精简 Claude Code 编码工作流的技术封面

Claude Code

该从 Claude Code 切换到 DeepSeek Harness 吗?我看了发布代码

深入检查 DeepSeek Harness 发布包:多模型适配、插件架构、本地模型缺口、Token 开销与迁移成本。现在值得从 Claude Code 切换吗?

By Leo Pang 19 Aug 2026
独立创业者在明亮办公室中通过网站、设计、邮件、CRM、客服、记账、自动化与 AI 模块运营一个人公司

Solopreneur

一个人公司的 AI 技术栈:替代 10 人团队?真实成本拆解

拆解一个人公司的 AI 与自动化技术栈:建站、设计、邮件、CRM、客服、记账和运营分别要花多少钱,以及哪些工作仍不能交给软件。

By Leo Pang 17 Aug 2026
See all

Dr. Pang 史丹福机器人庞博士

斯坦福庞博士为你带来硅谷最新科技,尤其是机器人、AI和大模型的最新进展、知识、课程、实战应用,使用技巧等。输入你的邮箱免费订阅:

Dr. Pang 史丹福机器人庞博士
  • Sign up
Powered by Ghost