栏目档案 / Section Dossier
一人公司
记录产品、商业、创作与独立经营的实践判断。
这里会发布关于一人公司、个人品牌、产品化输出与独立经营的深度文章。
文章档案 / Writing Ledger
栏目文章
智谱GLM-5.1全测评:开源拿下SWE-Bench Pro全球第一,代价是什么
GLM-5.1在SWE-Bench Pro上以58.4分超越Claude Opus 4.6和GPT-5.4,成为首个开源登顶这一编程基准的模型。但这个「第一」有多少含金量?它的长程任务、多模态、推理能力真实水位在哪里?本文基于最新公开基准数据,给出一个不加滤镜的评测判断。
02一人、零员工、年入千万——关于「公司」的基本假设,正在失效
200年来,「做大一点的事就需要一群人」是商业世界最基本的假设。Pieter Levels一人年入数百万美元,Maor Shlomo六个月卖出8000万——这些案例指向同一个问题:这个假设,正在被什么东西系统性地拆解?
03当 AI 强大到连开发者都不敢放出来,接下来会发生什么?
4月7日,Anthropic 发布了一款模型,然后宣布任何人都不能用它。这是整个 AI 行业第一次:一家顶级实验室,主动封锁了自己最强的产品。而这背后的故事,比大多数人想象的更复杂。
04大模型如何被评判好坏?一文读懂 LLM 评测全体系
从评测维度、核心指标到权威机构和测评网站,系统梳理 AI 大模型能力评估的完整图景,帮你看穿各家榜单背后的逻辑与陷阱。
05从莫里斯蠕虫到 Mythos,人类和机器的这场猫鼠游戏,规则变了
人类与网络安全的猫鼠游戏打了整整半个世纪。攻击者是人,人会睡觉,会犯错,会在凌晨三点因为太困放弃某条攻击路径。这个逻辑在2026年4月7日,彻底失效了。
06AI大模型能力测评全指南:从入门到精通
一份系统化的AI大模型能力测评指南,涵盖测评维度、方法论、工具选择与实战案例,帮助你科学评估各类LLM的真实能力。
07用了两周 Claude Code,我再也回不去普通 AI 了
目前网上最完整的中文 Claude Code 使用指南(2026年4月版)。涵盖安装配置、CLAUDE.md、常用命令、Skills、MCP、Hooks、子代理、IDE集成、GitHub自动化全部核心功能。
08你的电脑,正在被一只龙虾偷偷接管
2026年最火的AI浪潮背后藏着你必须知道的真相:OpenClaw「小龙虾」三个月25万星标,腾讯阿里字节全面跟进,但20%的技能是恶意的,13万台设备正在裸奔。
09AI工程范式演进:从Prompt Engineering到Context Engineering到Harness Engineering
五年内三次范式迁移,揭示AI工程师驾驭语言模型方式的根本性升级
10OpenClaw龙虾AI助手:从爆红到争议的全景深度报告
25万星标、156个漏洞、全民养龙虾——2026年最具颠覆性AI代理框架的全景解析