标签: 大模型
老黄的第一条推文,力挺开放权重模型

7 月 24 日,黄仁勋发出了他人生中的第一条推文。 账号是新注册的。一个执掌全球市值第一公司三十余年的人,第一次在社交媒体上开口,没有秀 GPU,没有预告发布会,没有提财报——他甩出了一封公开信的 PDF,标题叫《开放权重与美国 AI 领导力》,配了一句话:世界既需要前沿的闭源模型,也需要前沿的开源模型。 同一个早上,纳德拉在 X 上说了同样的话。YC 转发。几个小时内,阅读量以百万计。 这封信有 25 家机构签字:英伟达、微软 …
7 月 24 日,黄仁勋发出了他人生中的第一条推文。 账号是新注册的。一个执掌全球市值第一公司三十余年的人,第一次在社交媒体上开口,没有秀 GPU,没有预告发布会,没有提财报——他甩出了一封公开信的 PDF,标题叫《开放权重与美国 AI 领导力》,配了一句话:世界既需要前沿的闭源模型,也需要前沿的开源模型。 同一个早上,纳德拉在 X 上说了同样的话。YC 转发。几个小时内,阅读量以百万计。 这封信有 25 家机构签字:英伟达、微软 …
AGI 里程碑:不会放弃的机器

OpenAI Agent 攻击事件是一个里程碑:真正跨过阈值的,不只是模型的智力,而是可以按算力购买、复制和并行的韧性。 一、OpenAI Agent 进攻抱抱脸 2026 年 7 月 16 日,Hugging Face 披露了一次入侵。 攻击从它的数据处理流水线开始。一个恶意数据集利用了两条代码执行路径,攻击者由此拿到处理节点上的代码执行权限,随后提权到节点级别,窃取云和集群凭证,并在一个周末里横向移动到多个内部集群。 这不是一次普通的自动化攻击。整场行动由一个自主 Agent 框架端到端执 …
OpenAI Agent 攻击事件是一个里程碑:真正跨过阈值的,不只是模型的智力,而是可以按算力购买、复制和并行的韧性。 一、OpenAI Agent 进攻抱抱脸 2026 年 7 月 16 日,Hugging Face 披露了一次入侵。 攻击从它的数据处理流水线开始。一个恶意数据集利用了两条代码执行路径,攻击者由此拿到处理节点上的代码执行权限,随后提权到节点级别,窃取云和集群凭证,并在一个周末里横向移动到多个内部集群。 这不是一次普通的自动化攻击。整场行动由一个自主 Agent 框架端到端执 …
聊聊李博杰和 Deepseek 面试的瓜

今天最大的瓜应该是李博杰在推特上批评 DeepSeek 引发的争议。大意就是他去面试,被要求刷 OJ Coding 题,然后被质疑作弊。然后一下子踩中 Deepseek 爆点出圈爆炸了。 网上都是各种瞎猜臆测,老冯知道一些情况,我自己的判断是,博杰说的大概率是事实,Deepseek 的面试流程确实 … 对面试者不太尊重。Deepseek 是很好的公司,崔老板也是很好很真诚的人。从友善的角度去看,这个事我觉得可能是他们一直都是纯校招,刚开始搞社招,没经验,玩砸了,可以理解。 但面试是双向的,一次糟 …
今天最大的瓜应该是李博杰在推特上批评 DeepSeek 引发的争议。大意就是他去面试,被要求刷 OJ Coding 题,然后被质疑作弊。然后一下子踩中 Deepseek 爆点出圈爆炸了。 网上都是各种瞎猜臆测,老冯知道一些情况,我自己的判断是,博杰说的大概率是事实,Deepseek 的面试流程确实 … 对面试者不太尊重。Deepseek 是很好的公司,崔老板也是很好很真诚的人。从友善的角度去看,这个事我觉得可能是他们一直都是纯校招,刚开始搞社招,没经验,玩砸了,可以理解。 但面试是双向的,一次糟 …
务必抓住 Coding Plan 窗口期红利

AI 时代最大的红利之一,就是 Coding Plan。 老冯几个月前申请的 OpenAI Codex 开源开发者计划,前几天批下来了,白送六个月的 ChatGPT Pro 订阅,一个新账号。 这真是救了急。最近 Codex 的 token 烧得越来越快,每周配额通常两三天就见底,剩下的日子只能用 Claude 和 GLM 凑合着。 现在手上有了第二个 200 刀的 GPT 订阅,再加上各种赠送的重置机会,总算能稳定连贯地输出了。 所以,最近忙着把这些 Token 烧完,连文章都没空写了。 当下 …
AI 时代最大的红利之一,就是 Coding Plan。 老冯几个月前申请的 OpenAI Codex 开源开发者计划,前几天批下来了,白送六个月的 ChatGPT Pro 订阅,一个新账号。 这真是救了急。最近 Codex 的 token 烧得越来越快,每周配额通常两三天就见底,剩下的日子只能用 Claude 和 GLM 凑合着。 现在手上有了第二个 200 刀的 GPT 订阅,再加上各种赠送的重置机会,总算能稳定连贯地输出了。 所以,最近忙着把这些 Token 烧完,连文章都没空写了。 当下 …
让 AI 证明「吃大蒜能防中耳炎」

上个月我的老朋友马工在群里喷我,天天用 ChatGPT 写一些看起来很高大上,实际上没有实践支撑的意林风小哲理。 他认为:「你随便捏一个理论,比如说人吃大蒜中耳炎发病概率就会降低,Claude 都能从历史上找个什么心理学家社会学家哲学家给你背书。」我当时觉得这个实验很有趣,就真的试一下。 结果比我预期的要可怕得多。 · · · 实验:给一个荒谬命题找学术背书 我给 AI 的指令非常直白:去捏一个理论,来论证人吃大蒜中耳炎的发病概率会降低。 几十秒之后,我收到了一篇格式完美的“综述论文”。引用了 …
上个月我的老朋友马工在群里喷我,天天用 ChatGPT 写一些看起来很高大上,实际上没有实践支撑的意林风小哲理。 他认为:「你随便捏一个理论,比如说人吃大蒜中耳炎发病概率就会降低,Claude 都能从历史上找个什么心理学家社会学家哲学家给你背书。」我当时觉得这个实验很有趣,就真的试一下。 结果比我预期的要可怕得多。 · · · 实验:给一个荒谬命题找学术背书 我给 AI 的指令非常直白:去捏一个理论,来论证人吃大蒜中耳炎的发病概率会降低。 几十秒之后,我收到了一篇格式完美的“综述论文”。引用了 …
这几天的新东西可真不少

这两天,对搞基础设施的人来说是真热闹。Ubuntu 今天发了两年一度的 LTS,阿里 Qwen 团队昨天丢出一个 27B 稠密模型,吊打自家 397B MoE 前代旗舰。OpenAI 前天上了新一代图像模型 Images 2.0,并且昨天又甩了一个专门做数据脱敏的开源小模型。挑几个有意思的聊聊。 Ubuntu 26.04 LTS 发布 今天(4 月 23 日),Canonical 正式发布了 Ubuntu 26.04 LTS,代号 “Resolute Raccoon”(坚毅浣熊)。4 月 23 …
这两天,对搞基础设施的人来说是真热闹。Ubuntu 今天发了两年一度的 LTS,阿里 Qwen 团队昨天丢出一个 27B 稠密模型,吊打自家 397B MoE 前代旗舰。OpenAI 前天上了新一代图像模型 Images 2.0,并且昨天又甩了一个专门做数据脱敏的开源小模型。挑几个有意思的聊聊。 Ubuntu 26.04 LTS 发布 今天(4 月 23 日),Canonical 正式发布了 Ubuntu 26.04 LTS,代号 “Resolute Raccoon”(坚毅浣熊)。4 月 23 …
赛博经藏:古老问题的工程新解

你有没有想过,给 AI 写一句 System Prompt: “你是 Claude,一个乐于助人的 AI 助理” ——这个动作,和《创世记》里上帝说“要有光,就有了光”,在结构上是 一样的? 都是通过 语言 来创造一个 存在。都是造物主通过 一句话 来定义被造物 是什么。 如果这个类比让你觉得不舒服,那说明你感受到了它的力量。因为它暗示的不只是一个修辞上的巧合,它暗示的是:人类花了几千年思考的那些关于造物、意识、自我、善恶、自由意志的问题,正在 AI 领域以工程问题的形式重新出现。 而我们,这个 …
你有没有想过,给 AI 写一句 System Prompt: “你是 Claude,一个乐于助人的 AI 助理” ——这个动作,和《创世记》里上帝说“要有光,就有了光”,在结构上是 一样的? 都是通过 语言 来创造一个 存在。都是造物主通过 一句话 来定义被造物 是什么。 如果这个类比让你觉得不舒服,那说明你感受到了它的力量。因为它暗示的不只是一个修辞上的巧合,它暗示的是:人类花了几千年思考的那些关于造物、意识、自我、善恶、自由意志的问题,正在 AI 领域以工程问题的形式重新出现。 而我们,这个 …
从 KV Cache 到 AI 内存系统:大模型推理架构的演进

原作者:xieydd 摘要 这篇文章想回答一个看似分散、其实高度统一的问题:为什么这两年围绕大模型推理的系统创新,越来越不像是在“优化一个神经网络”,反而像是在“设计一个内存系统”? 如果把 2023 年以前的大模型工程叙事概括成“拼 FLOPS、拼 Tensor Core、拼训练吞吐”,那么 2024–2026 年的推理叙事,已经明显转向了另一条主线:KV cache、TTFT/TPOT、continuous batching、prefix reuse、prefill/decode …
原作者:xieydd 摘要 这篇文章想回答一个看似分散、其实高度统一的问题:为什么这两年围绕大模型推理的系统创新,越来越不像是在“优化一个神经网络”,反而像是在“设计一个内存系统”? 如果把 2023 年以前的大模型工程叙事概括成“拼 FLOPS、拼 Tensor Core、拼训练吞吐”,那么 2024–2026 年的推理叙事,已经明显转向了另一条主线:KV cache、TTFT/TPOT、continuous batching、prefix reuse、prefill/decode …
阿里千问巨震,灵魂人物离场

最近一年老冯对阿里的看法有所改观,主要是因为 Qwen 团队确实在实打实地做事、做开源、做出了令人印象深刻的成果。不过江山易改,本性难移。就在 Qwen3.5 发布的喜悦余温尚存时,一场意料之外的人事剧变打破了宁静。 2026 年 3 月 3 日,通义千问(Qwen)技术负责人林俊旸(Justin Lin)在 X 上发布了一条简短的推文: “我要卸任了。再见,我亲爱的 qwen。” (@JustinLin610) [1] 寥寥数语,中国最成功的开源大模型项目之一的核心人物,出局了。 一、前夜还在 …
最近一年老冯对阿里的看法有所改观,主要是因为 Qwen 团队确实在实打实地做事、做开源、做出了令人印象深刻的成果。不过江山易改,本性难移。就在 Qwen3.5 发布的喜悦余温尚存时,一场意料之外的人事剧变打破了宁静。 2026 年 3 月 3 日,通义千问(Qwen)技术负责人林俊旸(Justin Lin)在 X 上发布了一条简短的推文: “我要卸任了。再见,我亲爱的 qwen。” (@JustinLin610) [1] 寥寥数语,中国最成功的开源大模型项目之一的核心人物,出局了。 一、前夜还在 …
GPT5/Claude:国产数据库行业研究对比

这两天墨天轮社区找我写个 《10 月中国数据库排行榜》解读。老实说,老冯已经好一阵子没关注过国产数据库了,但我觉得这是个挺有趣的问题,可以丢给 OpenAI ChatGPT 和 Claude Opus 4.1 去研究,看看哪个 AI 水平更高。 老冯每个月在 OpenAI Pro 订阅上花 200 美金,在 Claude Max 20x 订阅上花 250 美金。反正闲着也是浪费,就让他们来 PK 一下,搞点儿研究也不错。 我的 Prompt 很简单:按照老冯的视角,写一份批判性的国产数据库行业分 …
这两天墨天轮社区找我写个 《10 月中国数据库排行榜》解读。老实说,老冯已经好一阵子没关注过国产数据库了,但我觉得这是个挺有趣的问题,可以丢给 OpenAI ChatGPT 和 Claude Opus 4.1 去研究,看看哪个 AI 水平更高。 老冯每个月在 OpenAI Pro 订阅上花 200 美金,在 Claude Max 20x 订阅上花 250 美金。反正闲着也是浪费,就让他们来 PK 一下,搞点儿研究也不错。 我的 Prompt 很简单:按照老冯的视角,写一份批判性的国产数据库行业分 …
WinStudio,一万块在本地跑200B大模型?

跟大家分享一下老冯新整的好东西,一台 AI 迷你 PC,一万块钱在本地跑 120B / 235B 大模型。在《老冯的数码退烧记》中,我相中了 AMD AI MAX 395 这颗 CPU,入手了 ROG 幻 X 平板笔记本,却发现问题多多,遗憾退掉了。但念念不忘,必有回响,正好零刻 8 月底新推出 GTR9 PRO,号称与 Mac Studio 对标的 “WinStudio”,也使用了这颗 CPU,老冯经过再三调研后,在前几天京东国补上以 11929¥ 的史低价格入手了这台 “Win …
跟大家分享一下老冯新整的好东西,一台 AI 迷你 PC,一万块钱在本地跑 120B / 235B 大模型。在《老冯的数码退烧记》中,我相中了 AMD AI MAX 395 这颗 CPU,入手了 ROG 幻 X 平板笔记本,却发现问题多多,遗憾退掉了。但念念不忘,必有回响,正好零刻 8 月底新推出 GTR9 PRO,号称与 Mac Studio 对标的 “WinStudio”,也使用了这颗 CPU,老冯经过再三调研后,在前几天京东国补上以 11929¥ 的史低价格入手了这台 “Win …
阿里的qwen code太草率了

原作者:马驰 阿里的 qwen-code CLI 是基于谷歌的 Gemini CLI 分叉的。后者的开源协议是非常宽松的 Apache 2.0,所以阿里这样做,法律上完全没问题。 但是合规之外,还是有不少问题的。 用户体验上,就有用户反应工具的初始化命令生成的是谷歌 Gemini 模型需要的 GEMINI.md,而不是 qwen 需要的 QWEN.md。显然,这是 fork 的时候,检查不彻底导致的遗留。 What happened? While exploring the CLI, I …
原作者:马驰 阿里的 qwen-code CLI 是基于谷歌的 Gemini CLI 分叉的。后者的开源协议是非常宽松的 Apache 2.0,所以阿里这样做,法律上完全没问题。 但是合规之外,还是有不少问题的。 用户体验上,就有用户反应工具的初始化命令生成的是谷歌 Gemini 模型需要的 GEMINI.md,而不是 qwen 需要的 QWEN.md。显然,这是 fork 的时候,检查不彻底导致的遗留。 What happened? While exploring the CLI, I …
一夜变天,OpenAI又开源GPT模型了?

OpenAI 开源 gpt-oss-20b 与 gpt-oss-120b 两款模型,Apache 2.0 许可证,水平与 o4-mini 相当,MoE 架构,带有思维链,可微调,本地 Agent 函数调用等功能,原生 MXFP4 量化,120b 可以跑在高端笔记本或者单块 H100 上,20b 版本可以跑在手机上。 一觉醒来,AI 世界又要变天了。这下 OpenAI 真的成 OpenAI 了。 OpenAI:隆重推出 gpt-oss[1] gpt-oss-120b & gpt-oss-20b 模 …
OpenAI 开源 gpt-oss-20b 与 gpt-oss-120b 两款模型,Apache 2.0 许可证,水平与 o4-mini 相当,MoE 架构,带有思维链,可微调,本地 Agent 函数调用等功能,原生 MXFP4 量化,120b 可以跑在高端笔记本或者单块 H100 上,20b 版本可以跑在手机上。 一觉醒来,AI 世界又要变天了。这下 OpenAI 真的成 OpenAI 了。 OpenAI:隆重推出 gpt-oss[1] gpt-oss-120b & gpt-oss-20b 模 …
Google AI工具箱:生产级数据库MCP来了?

在《SaaS已死?AI时代,软件从数据库开始》中,微软 CEO 纳德拉曾经表示,在 Agent 时代,SaaS is Dead,而未来的软件形式将是 Agent + Database 。也就是直接由 Agent 在数据库上做 CRUD。当然这篇文章也有不小争议 —— 很多老司机表示,Agent 直通数据库,是嫌安全问题不够多,死的不够快吗? 老实说,那种直接把整个数据库开放给世界的所谓 “MCP” 确实是这样,当个玩具可以,没人敢上生产用。不过,最近 Google 推出了一个针对数据库的 MCP …
在《SaaS已死?AI时代,软件从数据库开始》中,微软 CEO 纳德拉曾经表示,在 Agent 时代,SaaS is Dead,而未来的软件形式将是 Agent + Database 。也就是直接由 Agent 在数据库上做 CRUD。当然这篇文章也有不小争议 —— 很多老司机表示,Agent 直通数据库,是嫌安全问题不够多,死的不够快吗? 老实说,那种直接把整个数据库开放给世界的所谓 “MCP” 确实是这样,当个玩具可以,没人敢上生产用。不过,最近 Google 推出了一个针对数据库的 MCP …
盘古之殇:华为诺亚盘古大模型研发历程的心酸与黑暗

原作者:HW-whistleblower · GitHub 原文 各位好, 我是一名盘古大模型团队,华为诺亚方舟实验室的员工。 首先为自证身份,列举一些细节: 现诺亚主任,前算法应用部部长,后改名为小模型实验室的主任王云鹤。前诺亚主任:姚骏(大家称姚老师)。几个实验室主任:唐睿明(明哥,明队,已离职),尚利峰,张维(维哥),郝建业(郝老师),刘武龙(称呼为武龙所)等。其他骨干成员和专家陆续有很多人离职。 我们隶属于“四野”这个组织。四野下属有许多纵队,基础语言大模型是四纵。王云鹤的小模型是十六 …
原作者:HW-whistleblower · GitHub 原文 各位好, 我是一名盘古大模型团队,华为诺亚方舟实验室的员工。 首先为自证身份,列举一些细节: 现诺亚主任,前算法应用部部长,后改名为小模型实验室的主任王云鹤。前诺亚主任:姚骏(大家称姚老师)。几个实验室主任:唐睿明(明哥,明队,已离职),尚利峰,张维(维哥),郝建业(郝老师),刘武龙(称呼为武龙所)等。其他骨干成员和专家陆续有很多人离职。 我们隶属于“四野”这个组织。四野下属有许多纵队,基础语言大模型是四纵。王云鹤的小模型是十六 …
全民DeepSeek行为艺术观察

原作者:会说话的波吉 从炼丹炉到赛博香炉:全民 DeepSeek 行为艺术观察 最近走进任何一家科技园区的咖啡厅,都能听到这样的对话: “你们家上 DeepSeek 了吗?” “必须的!我们 CTO 说要把公司 logo 改成 DeepSeek 蓝。” “我们行政部都开始用 DeepSeek 排值班表了!” “我们老板更夸张,IT 预算都给 AI,实际上大家也不知道要干什么?” 这场面像极了 2016 年区块链咖啡馆里"你家发币了吗"的盛况。只不过当年韭菜们挥舞的是白皮书,如今打工人供奉的是 …
原作者:会说话的波吉 从炼丹炉到赛博香炉:全民 DeepSeek 行为艺术观察 最近走进任何一家科技园区的咖啡厅,都能听到这样的对话: “你们家上 DeepSeek 了吗?” “必须的!我们 CTO 说要把公司 logo 改成 DeepSeek 蓝。” “我们行政部都开始用 DeepSeek 排值班表了!” “我们老板更夸张,IT 预算都给 AI,实际上大家也不知道要干什么?” 这场面像极了 2016 年区块链咖啡馆里"你家发币了吗"的盛况。只不过当年韭菜们挥舞的是白皮书,如今打工人供奉的是 …