AI Models
我重新给 13 款 AI 模型排了名:一切都变了
最新 13 款 AI 模型实战分级:Opus 5.5 负责规划,GPT-6.1 Sol 负责实现,Sonnet 5.5 负责复核,并从能力、成本与任务路由重新排序。
AI Models
最新 13 款 AI 模型实战分级:Opus 5.5 负责规划,GPT-6.1 Sol 负责实现,Sonnet 5.5 负责复核,并从能力、成本与任务路由重新排序。
AI Agent
五大常驻 AI Agent 的真正区别,不在谁最聪明,而在计算机、模型、安全护栏与运维由谁掌控。本文比较五种路线,并补充 Dobby 的独特定位。
Claude Sonnet 5.5
Sonnet 5.5 在 Medium 与 High 档位很有吸引力,但 Max 的 token 成本可能反超 Opus。本文用基准、成本与工作负载拆解最佳使用方式。
Jev
Jev 不生成长文本,而以 70–500 毫秒返回类型安全、带校准置信度的结构化决策。本文详解 System One、三种问题类型、级联架构、案例与限制。
Claude Opus 5.5
Claude Opus 5.5 面向长时间编码与知识工作,带来更快输出、更低单价、百万级上下文和自适应思考。本文解析能力、基准、成本与稳定性争议。
AI Agent
Stanford CS329A 公开讲解自我改进智能体。本文拆解生成器、评估器、路由器与记忆压缩,并补上可靠生产系统必须具备的预算、沙箱和人工接管。
GPT-6 Astra
当纸面基准逐渐失去区分度,GPT-6 Astra 真正需要证明的,是能否在现实任务中降低成本、减少监督并创造可测量的影响。
h5i
h5i 不依赖 Chromium 或 V8,而是用 Rust 组件、结构化快照、请求前策略检查与分层沙箱,为 AI Agent 打造更轻、更可审计的浏览器。
Open Source
从数据库、API、终端和本地语音,到 CMS、DevOps、PDF、AI 办公与团队协作,这 10 个开源项目正在把成熟开发工具重新带回本地与自托管。
FreeToken
在 RTX 3050 6GB 笔记本上用同一 gpt-oss-20b 测试 FreeToken、Ollama 与 llama.cpp:速度、首 Token 延迟、MoE 动态专家缓存原理,以及 FreeToken 真正适合的硬件与模型。
Claude Code
深入检查 DeepSeek Harness 发布包:多模型适配、插件架构、本地模型缺口、Token 开销与迁移成本。现在值得从 Claude Code 切换吗?
Solopreneur
拆解一个人公司的 AI 与自动化技术栈:建站、设计、邮件、CRM、客服、记账和运营分别要花多少钱,以及哪些工作仍不能交给软件。