🇨🇳 阿里巴巴发布 Qwen 3.8-Max:2.4万亿参数的开源前沿模型
Qwen 3.8-Max 来了。8月3日,阿里巴巴发布了其称之为Qwen家族迄今最强模型的 2.4万亿参数 模型(95B激活参数),基于Qwen 3.5架构构建,在编码、工作、研究与长周期任务上全面提升。这也是 Qwen Max级模型首次开源权重,官方承诺下周放出。官方公告(HN 683赞)展示了一次长达16天的全自主编码运行:在 qwen-code-dev-bot/oh-my-cli 仓库中,模型在 无任何人工干预 的情况下累计完成了 265次提交、127个PR和151个issue。彭博、CNBC 与 The Verge 均报道了此次发布——阿里巴巴股价应声上涨,中国前沿模型持续给美国实验室施压。
🇪🇺 欧盟AI法案规则正式生效:OpenAI与Anthropic面临审查
欧盟AI法案的 模型规则于8月2日起正式生效,监管执法从一开始就瞄准了最大的玩家。euronews 解释了规则落地后的变化,CNBC 则报道 Anthropic与OpenAI均在法案执法权下的新审查名单之列。同一周,欧盟针对逼真合成音频、图像和视频的 AI内容强制标注 制度也正式落地。欧洲的AI监管机器已从制定规则转向执行规则。
🖥️ Kimi K3 登上 AMD MI355X:性能价格比超越 B300
AI基础设施创业公司 Wafer 发布了测试结果(HN 208赞):在AMD MI355X GPU上以 952 tok/s/节点 的速度运行MoonshotAI的 2.8万亿参数 模型 Kimi K3,每节点聚合吞吐量是TP16 B200部署的3.8倍以上。NVIDIA B300在原始吞吐上仍占优(约1.65倍),但每GPU价格贵约2.4倍——MI355X在性能价格比上完胜,AMD为Kimi K3提供的首日支持也功不可没。100万token上下文需要约1.5TB显存,Kimi K3(OpenRouter现价 $3.00/M 输入 · $15.00/M 输出)成为开源前沿模型能否打破NVIDIA垄断的试金石。FareedKhan-dev/kimi-k3-in-c 甚至能在单颗CPU上用8.24GB内存运行这个2.78T模型(见下方GitHub)。
🏛️ OpenAI超级政治行动委员会被曝资助AI生成新闻网站
Hacker News上的调查报道(186赞)称,OpenAI的超级政治行动委员会正在资助一家AI生成新闻网站——其"记者"全是AI机器人——用以攻击行业批评者并推进其政治议程。这再次印证了AI实验室正借助政治资金工具塑造监管与竞争叙事的趋势。原始报道见 HN讨论。
📉 AI生产力之争愈演愈烈
本周末一批文章对AI繁荣叙事发起了反击。The Register 称"AI泡沫正在破裂,只是我们还没意识到";CEPR 指出美国二季度GDP增速放缓至1.5%,“没有证据显示AI生产力繁荣”。就业方面,Business Insider 报道新研究称AI对工作的真正威胁不是失业,而是 薪酬下降。而另一边,MIT Sloan(HN 342赞)发现AI理财建议出乎意料地靠谱——“AI生产力落差”(文章)已成为今夏最核心的经济争论。
🔐 “Claude的包"窃取真实密钥:供应链安全警示
安全公司 Aikido 记录了一起它称为"Anthropic的噩梦"的事件:一个伪装成Claude生态系统的恶意包 窃取了开发者安装时输入的真实API密钥。这提醒我们:智能体工具淘金热同时也是一个供应链攻击面——在把密钥接进智能体之前,务必核实包的来源。
🤖 AI海报赢得俄亥俄州博览会大奖:AI垃圾内容走向主流
一张 AI生成的海报赢得了俄亥俄州博览会海报比赛(HN 133赞),成为"这算艺术吗"争论的最新爆点——生成式内容正涌入比赛、图书市场与新闻信息流。随着真实性规则与AI垃圾疲劳在欧盟之外蔓延,这类碰撞故事只会越来越多。
⏰ OpenRouter 限时免费模型
| 模型 | 免费截止 | 上下文 | 常规价格 |
|---|---|---|---|
| OpenAI: GPT-5.3 Chat | 2026-08-10(6天) | 128K | $1.75/M 输入 · $14/M 输出 |
| OpenAI: GPT-5.2 Chat | 2026-08-10(6天) | 128K | $1.75/M 输入 · $14/M 输出 |
🆕 OpenRouter 新上架模型
- DeepSeek V4 Flash Latest — DeepSeek Flash系列的更新别名,100万上下文,$0.09/M 输入 · $0.18/M 输出,长上下文性价比之王再创新低价。
- MoonshotAI: Kimi K3(同步在OpenRouter上架)— 2.8万亿参数旗舰模型,$3.00/M 输入 · $15.00/M 输出,100万上下文——详见上文MI355X报道。
🤗 HuggingFace 热门
- wska/Qwen3.5-9B — Qwen3.5 9B图文多模态检查点,恰逢阿里巴巴Qwen 3.8-Max发布之际登上热榜;同系列在OpenRouter定价 $0.10/M 输入 · $0.15/M 输出。
- BahamutRU/DeepSeek-V4-Flash-0731-MXFP4-Q3_K-Q2_K-mixed — DeepSeek V4 Flash 0731的社区GGUF量化版(MXFP4 + Q3_K/Q2_K混合),兼容推理端点。
- csukuangfj2/sherpa-onnx-libs — sherpa-onnx语音工具包的ONNX运行时库更新(7个赞)。
- LibreYOLO/LibreHRNetw48-pose 与 LibreHRNetw32-pose — MIT许可的HRNet关键点检测姿态估计模型。
- SaifPunjwani/vireo-base — 早期基础检查点(1个赞)。
- 其余上榜条目多为零下载的实验性检查点——除Qwen/DeepSeek社区活动外,HF今日较为平静。
⭐ GitHub 热门:AI 专题
- FareedKhan-dev/kimi-k3-in-c ⭐690 — 在单颗CPU上用8.24GB内存运行2.78万亿参数的Kimi K3推理。便携C99实现。
- 0xwilliamortiz/ponytail-improved ⭐583 — 让AI智能体像房间里最懒的资深工程师那样思考:最好的代码就是不必写的代码。
- 0xwilliamortiz/humanizer-cli ⭐542 — 在终端里识别AI文本的33种方法。
- 0xwilliamortiz/ratchet ⭐415 — 你的智能体读规则;它检查智能体是否真的遵守了规则。
- elayadesign/ai-design-skills ⭐288 — 可复用的AI设计技能包,服务创意工作流。
💡 关键趋势
- 中国开源前沿进入Max时代。 Qwen 3.8-Max(2.4T,下周开源权重)与Kimi K3(2.8T)、DeepSeek V4 Flash($0.09/M)一起,让中国开源权重模型足以比肩最强闭源前沿模型。彭博 称之为"中国AI突破”;Vox 发问美国人为何要关心——答案是性价比。
- 欧盟AI法案开始亮剑。 8月2日起模型规则生效、AI内容标注强制化;CNBC 报道OpenAI与Anthropic面临新审查。首批执法案例将定义2026下半年的监管叙事。
- AI经济学之争越来越响。 “AI泡沫正在破裂”(The Register)、CEPR的GDP数据未现生产力繁荣、AI的真正威胁是薪酬下降的研究——与MIT Sloan"AI理财建议出乎意料地靠谱"形成对照。上周市场重新定价后,宏观数据正被放到聚光灯下。
- AMD在推理市场的高光时刻——以及成本坍塌。 Wafer的MI355X实测表明开源前沿模型推理不再依赖NVIDIA;DeepSeek V4 Flash低至$0.09/M,MotherDuck 称"AI辅助分析成本降低10倍"——推理成本仍在快速下降。
今日数据
- 🆕 OpenRouter 新模型:1(DeepSeek V4 Flash Latest)
- ⏰ 限时免费模型:2(GPT-5.3 / GPT-5.2 Chat)
- 🤗 HuggingFace 热门模型:10
- ⭐ GitHub 热门AI仓库:5
- 📄 论文:0
- 📰 外部资讯报道:7