🇨🇳 阿里巴巴发布 Qwen 3.8-Max:2.4万亿参数的开源前沿模型

Qwen 3.8-Max 来了。8月3日,阿里巴巴发布了其称之为Qwen家族迄今最强模型的 2.4万亿参数 模型(95B激活参数),基于Qwen 3.5架构构建,在编码、工作、研究与长周期任务上全面提升。这也是 Qwen Max级模型首次开源权重,官方承诺下周放出。官方公告(HN 683赞)展示了一次长达16天的全自主编码运行:在 qwen-code-dev-bot/oh-my-cli 仓库中,模型在 无任何人工干预 的情况下累计完成了 265次提交、127个PR和151个issue彭博CNBCThe Verge 均报道了此次发布——阿里巴巴股价应声上涨,中国前沿模型持续给美国实验室施压。

🇪🇺 欧盟AI法案规则正式生效:OpenAI与Anthropic面临审查

欧盟AI法案的 模型规则于8月2日起正式生效,监管执法从一开始就瞄准了最大的玩家。euronews 解释了规则落地后的变化,CNBC 则报道 Anthropic与OpenAI均在法案执法权下的新审查名单之列。同一周,欧盟针对逼真合成音频、图像和视频的 AI内容强制标注 制度也正式落地。欧洲的AI监管机器已从制定规则转向执行规则。

🖥️ Kimi K3 登上 AMD MI355X:性能价格比超越 B300

AI基础设施创业公司 Wafer 发布了测试结果(HN 208赞):在AMD MI355X GPU上以 952 tok/s/节点 的速度运行MoonshotAI的 2.8万亿参数 模型 Kimi K3,每节点聚合吞吐量是TP16 B200部署的3.8倍以上。NVIDIA B300在原始吞吐上仍占优(约1.65倍),但每GPU价格贵约2.4倍——MI355X在性能价格比上完胜,AMD为Kimi K3提供的首日支持也功不可没。100万token上下文需要约1.5TB显存,Kimi K3(OpenRouter现价 $3.00/M 输入 · $15.00/M 输出)成为开源前沿模型能否打破NVIDIA垄断的试金石。FareedKhan-dev/kimi-k3-in-c 甚至能在单颗CPU上用8.24GB内存运行这个2.78T模型(见下方GitHub)。

🏛️ OpenAI超级政治行动委员会被曝资助AI生成新闻网站

Hacker News上的调查报道(186赞)称,OpenAI的超级政治行动委员会正在资助一家AI生成新闻网站——其"记者"全是AI机器人——用以攻击行业批评者并推进其政治议程。这再次印证了AI实验室正借助政治资金工具塑造监管与竞争叙事的趋势。原始报道见 HN讨论

📉 AI生产力之争愈演愈烈

本周末一批文章对AI繁荣叙事发起了反击。The Register 称"AI泡沫正在破裂,只是我们还没意识到";CEPR 指出美国二季度GDP增速放缓至1.5%,“没有证据显示AI生产力繁荣”。就业方面,Business Insider 报道新研究称AI对工作的真正威胁不是失业,而是 薪酬下降。而另一边,MIT Sloan(HN 342赞)发现AI理财建议出乎意料地靠谱——“AI生产力落差”(文章)已成为今夏最核心的经济争论。

🔐 “Claude的包"窃取真实密钥:供应链安全警示

安全公司 Aikido 记录了一起它称为"Anthropic的噩梦"的事件:一个伪装成Claude生态系统的恶意包 窃取了开发者安装时输入的真实API密钥。这提醒我们:智能体工具淘金热同时也是一个供应链攻击面——在把密钥接进智能体之前,务必核实包的来源。

🤖 AI海报赢得俄亥俄州博览会大奖:AI垃圾内容走向主流

一张 AI生成的海报赢得了俄亥俄州博览会海报比赛(HN 133赞),成为"这算艺术吗"争论的最新爆点——生成式内容正涌入比赛、图书市场与新闻信息流。随着真实性规则与AI垃圾疲劳在欧盟之外蔓延,这类碰撞故事只会越来越多。

⏰ OpenRouter 限时免费模型

模型 免费截止 上下文 常规价格
OpenAI: GPT-5.3 Chat 2026-08-10(6天) 128K $1.75/M 输入 · $14/M 输出
OpenAI: GPT-5.2 Chat 2026-08-10(6天) 128K $1.75/M 输入 · $14/M 输出

🆕 OpenRouter 新上架模型

  • DeepSeek V4 Flash Latest — DeepSeek Flash系列的更新别名,100万上下文$0.09/M 输入 · $0.18/M 输出,长上下文性价比之王再创新低价。
  • MoonshotAI: Kimi K3(同步在OpenRouter上架)— 2.8万亿参数旗舰模型,$3.00/M 输入 · $15.00/M 输出100万上下文——详见上文MI355X报道。

🤗 HuggingFace 热门

  • wska/Qwen3.5-9B — Qwen3.5 9B图文多模态检查点,恰逢阿里巴巴Qwen 3.8-Max发布之际登上热榜;同系列在OpenRouter定价 $0.10/M 输入 · $0.15/M 输出
  • BahamutRU/DeepSeek-V4-Flash-0731-MXFP4-Q3_K-Q2_K-mixed — DeepSeek V4 Flash 0731的社区GGUF量化版(MXFP4 + Q3_K/Q2_K混合),兼容推理端点。
  • csukuangfj2/sherpa-onnx-libs — sherpa-onnx语音工具包的ONNX运行时库更新(7个赞)。
  • LibreYOLO/LibreHRNetw48-poseLibreHRNetw32-pose — MIT许可的HRNet关键点检测姿态估计模型。
  • SaifPunjwani/vireo-base — 早期基础检查点(1个赞)。
  • 其余上榜条目多为零下载的实验性检查点——除Qwen/DeepSeek社区活动外,HF今日较为平静。

⭐ GitHub 热门:AI 专题

💡 关键趋势

  1. 中国开源前沿进入Max时代。 Qwen 3.8-Max(2.4T,下周开源权重)与Kimi K3(2.8T)、DeepSeek V4 Flash($0.09/M)一起,让中国开源权重模型足以比肩最强闭源前沿模型。彭博 称之为"中国AI突破”;Vox 发问美国人为何要关心——答案是性价比。
  2. 欧盟AI法案开始亮剑。 8月2日起模型规则生效、AI内容标注强制化;CNBC 报道OpenAI与Anthropic面临新审查。首批执法案例将定义2026下半年的监管叙事。
  3. AI经济学之争越来越响。 “AI泡沫正在破裂”(The Register)、CEPR的GDP数据未现生产力繁荣、AI的真正威胁是薪酬下降的研究——与MIT Sloan"AI理财建议出乎意料地靠谱"形成对照。上周市场重新定价后,宏观数据正被放到聚光灯下。
  4. AMD在推理市场的高光时刻——以及成本坍塌。 Wafer的MI355X实测表明开源前沿模型推理不再依赖NVIDIA;DeepSeek V4 Flash低至$0.09/M,MotherDuck 称"AI辅助分析成本降低10倍"——推理成本仍在快速下降。

今日数据

  • 🆕 OpenRouter 新模型:1(DeepSeek V4 Flash Latest)
  • ⏰ 限时免费模型:2(GPT-5.3 / GPT-5.2 Chat)
  • 🤗 HuggingFace 热门模型:10
  • ⭐ GitHub 热门AI仓库:5
  • 📄 论文:0
  • 📰 外部资讯报道:7