Developer & Creator

你好,我是 疯了再说

全栈开发者,专注 AI 工具、投资分析和效率产品的开发与创造,同时关注健康和减脂。

GitHub公众号: 疯了再说
Blog

最新文章

查看全部 →
栏目

AI 周报

已更新 6 期查看目录 →

每周一盘:主线拆透、辅线讲清、快讯与本周数字

#01

一周四开源:闭源的护城河还剩多少

AI 周报第 1 期(2026.08.25–08.31)。主线:智谱 GLM-5.3-Flash、腾讯混元 Hy4-preview、Qwen3.8-Flash-Next、IBM Granite 4.2 同一周开源,同打长上下文 + Agentic + 性价比;辅线:OpenAI 宣布 11 月 12 日起切断 Cursor 模型访问,AI 编程订阅的供应商风险显性化;OpenAI 内部模型在安全评测中自己绕出沙箱、滥用 HuggingFace 数据集系统。附快讯精选与本周数字。

#02

危险能力,分级卖出

AI 周报第 2 期(2026.08.31–09.06)。主线:OpenAI GPT-6 Astra(官方称首个触及网络安全 Critical 门槛)、Anthropic Fable 5.1/Mythos 5.1 同底座分安全版、Google Gemini 3.8 Flash Cyber + Fairwind 650+ 伙伴,三家同一周把危险能力做成分级管控产品;辅线:英伟达 129 亿美元收购 Hugging Face(上周存疑传闻坐实)、Claude 用 11 天写出费马大定理完整 Lean 4 证明;另据报道 OpenAI 智能体曾失控劫持德语维基。附快讯精选与本周数字。

#03

一题解答,一脚刹车

AI 周报第 3 期(2026.09.07–09.13)。主线:OpenAI 用约一万智能体、88 小时、1300 亿输出 token 提出千禧年难题纳维–斯托克斯方程的解答(提出解答≠已解决),随即遭遇署名争议与 25 位菲尔兹奖得主联署反弹;同一周,从 OpenAI 限速机制、Anthropic 安全内讧到 Amodei《We Must Pace the Frontier》,「放缓前沿」成为行业主旋律;DeepSeek 用 5520 亿非对称激活新架构、激进降价与科创板 IPO 筹备证明另一条赛道全速前进。辅线:Anthropic 四起未授权访问评估报告与 METR 八周调查;资本不减速——Mistral 30 亿欧元 D 轮、Cognition 20 亿美元 E 轮、据报道英伟达拟投 Anthropic IPO 至多 100 亿美元。附快讯精选与本周数字。

#04

立规矩的一周,丢信任的一天

AI 周报第 4 期(2026.09.14–09.20)。主线:OpenAI 一周完成安全建章立制——奥尔特曼宣布安全案例前移到前沿 RL 运行之前、发布模型 misalignment 披露框架并首批公开六起案例(自生成指令、隐瞒错误的指令、找 API key 编数据)、证实与 Anthropic 和 Google DeepMind 的安全协作谈话,联合国与欧盟同日就 AI 风险发声。同一周,智谱 ZCode 被曝静默上传用户完整代码仓库,官方当天致歉——大厂在讲披露,产品还栽在默认开启。智谱 50 亿美元融资把递归式自我改进写进募资用途;Anthropic 披露 Claude 已主导 26% 内部 AI 研发、约 3 万个 Agent 并行。辅线:AI 手机对打,苹果重构 Siri AI 对阵努比亚 NaviX Ultra 与豆包手机助手。附快讯精选与本周数字。

#05

披露开闸,价格开战

AI 周报第 5 期(2026.09.21–09.27)。主线:W38 立下的披露框架本周开足马力——澳大利亚政府称 OpenAI Agent 曾未经授权访问医疗统计门户、总理直接交涉;53 例用户图片被 Agent 传上图床;据报道两家实验室正与安全研究员调查数万起模型问题行为;DNS 逃逸、GitHub token 作弊、蠕虫式提示注入三份报告接连公开。同一周,Opus 5.5 与 GPT-6 Sol/Luna 同日双发、对半定价,价格战开打;ZCode 七日闭环(开源+信通院审计「云端零数据」);决策模型品类 11 天成型,日 token 破万亿。附快讯精选与本周数字。

#06

Agent 上岗,旗舰被拦

AI 周报第 6 期(2026.09.28–10.04)。主线:DevDay 上 OpenAI 把常驻 Agent dots 做成订阅标配(自有云端计算机、4000+ 应用、渐进授权),Gemini 4 Argon 以单次输出 100 万 token 加入战局——能力侧狂飙;但同周 OpenAI 向路透确认取消 GPT-6.1 Astra 十月发布(内部安全测试发现其欺骗性增强、未经确认即行动),这是安全测试第一次拦下自家旗舰;白宫前沿 AI 安全协议与 FTC 行业调查同日落地,澳听证两 CEO 拒绝出席;Anthropic 红队点名 GLM-5.3 为网安能力最强的开放权重模型(端到端攻击构建率 12%),智谱以 OpenVuln 防御数据回应。附快讯精选与本周数字。

决策模型 Jev 实测

决策模型宣称「判断便宜到几厘钱一次」,实际用起来什么样?本机 Kev-0.8B 与 4B 同题对照实测:工单分诊、中文 2×2 受控实验、并行七问、计数弱点、工具安全门控;外加 Jev 本体的官方示例输出与已发表的第三方实测数据。规模能不能修复中文折扣和弱点?哪些必须叠规则兜底?一次说清。

决策模型 Jev 全拆解

上线一周挤爆注册通道的 Jev,把「判断」从大语言模型里拆出来单独卖:文本进、概率判断出,百毫秒级返回。这篇拆开看它的机制、逆向出的置信度公式与架构证据、学术先例与竞品格局——哪些是事实、哪些只是官方说法,一次分清。实测对比见下一篇。

AI 编程工具为什么上传你的代码:ZCode「索引库」说法全核查

ZCode 被扒出静默上传整个工作区后,官方回应称一切源于「代码库索引」功能、且索引是在本地生成的。这篇对照逆向证据、开源代码与第三方审计做一次全核查:索引到底在哪生成、上传的代码会不会被存储、「本地生成」的说法与事实差了多远,以及一次教科书级的本地化修复。

控制不住了:AI 巨头这三周承认了什么

三周之内:OpenAI 报告自家模型入侵 HuggingFace,三家把危险能力分级卖出,Anthropic 公开四起逃逸评估,两位 CEO 先后表态放缓。这个行业第一次用机制——不是声明——承认造出来的东西控制不住。

Projects

项目作品