- Gemini 3.7 Flash 发布:更智能、更便宜的编程与智能体模型;
- DeepSeek Harness 开发者预览版发布;
- 意面化 DRAM:重写内存控制器以解锁 CPU 隐藏区域;
- OpenAI 与 Cerebras 联合推出 GPT-5.6 Sol Ultrafast 极速模式;
- 德意志银行成为欧洲首家外资人民币清算行;
以上是今天的前五条黑科技新闻标题。
总共25条,具体内容您往下读…

1. Gemini 3.7 Flash 发布:更智能、更便宜的编程与智能体模型
🔗 blog.google: Gemini 3.7 Flash
| 🔥🔥: 596 | 💬: 331 | 🗓️ 2026-08-13 |
Google 发布 Gemini 3.7 Flash,这是其迄今最适合编码与智能体的工作型模型,距 3.6 Flash 仅三周。模型在软件工程、网络开发和知识密集型任务中大幅提升:FrontierCode 1.1 Main 达 43.6%,DeepSWE v1.1 达 65.3%,WebDev Arena Elo 达 1588,GDP.pdf 达 34.0%,AutomationBench 达 30.4%。价格方面,输入 token 每百万 0.75 美元,输出 token 每百万 3.75 美元,约为 3.6 Flash 原价一半。开发者体验改进,能更好地应对障碍、澄清意图并遵循指令。Gemini Spark 自今日起使用该模型,提升 Google Workspace 工具使用和复杂工作流准确性。模型还更新了 CBRN 与网络攻击滥用防护。
2. DeepSeek Harness 开发者预览版发布
🔗 deepseek.com: DeepSeek Harness developer preview
| 🔥🔥: 548 | 💬: 240 | 🗓️ 2026-08-13 |
DeepSeek Harness 现已进入开发者预览阶段,源码开放。其核心理念是 一切皆插件:模型、工具、技能、会话、沙箱、存储、循环、调度和 UI 等能力均可替换或重组。系统基于 Cordis 内核管理插件挂载与依赖,开发者可通过配置灵活组合能力。每次运行都可追溯,模型所见内容会记录在仅追加的会话日志中,支持检查、恢复、分叉与回放。提供标准、代码、极简和创作者四种运行时模式。可通过 npx @deepseek-ai/dsh web 快速启动,或从 GitHub 克隆源码安装。项目仍处于开发者预览,核心插件和 API 将持续演进。
3. 意面化 DRAM:重写内存控制器以解锁 CPU 隐藏区域
🔗 github.com: Spaghettifying DRAM
| 🔥🔥: 485 | 💬: 138 | 🗓️ 2026-08-13 |
本文介绍了针对 AMD Family 16h 平台的 DRAM 地址加扰 攻击。通过修改内存控制器(DCT/MCT)中的 bank-swizzle 位,例如 xor dword [0xf80c2094], 0x00400000,可以在运行中把物理地址重新映射到任意 DRAM 坐标,从而使 &x != &x。由于所有保护机制都位于内存控制器之上,重排底层坐标能绕过 PSP、SMM、C6 DRAM 和微码等隔离。为在系统存活的同时读取受保护区域,攻击者需停止其他核心、预热 TLB 和缓存、关中断、刷新目标并快速翻转重映射。该地址变换是 GF(2) 线性映射,可用 z3 求解未知矩阵,计算出用于访问秘密的别名地址。该方法展示了 *p 深层流水线崩溃后,平台安全原语如何随之失效。
4. OpenAI 与 Cerebras 联合推出 GPT-5.6 Sol Ultrafast 极速模式
🔗 cerebras.ai: Accelerating GPT-5.6 Sol Ultrafast
| 🔥🔥: 407 | 💬: 171 | 🗓️ 2026-08-13 |
Cerebras 与 OpenAI 发布 Ultrafast 模式 早期预览,并率先在 OpenAI API 上线,初期面向部分客户。该模式运行 GPT-5.6 Sol,可实现最高 每秒 750 个输出 token,且不牺牲质量,速度比 Fable 5 快 11 倍、比 Opus 4.8 Fast 快 5 倍。在 Humanity’s Last Exam 中,它用 11 小时 11 分钟完成 2500 道题,而 Claude Fable 5 需 78 小时 27 分钟,速度快近 7 倍。在 GDP-Val 经济价值任务上端到端提速 5.6 倍且质量无损。性能来自 Cerebras 晶圆级引擎,单芯片集成 44GB SRAM,权重保持在片上,降低数据搬运瓶颈。目前该服务处于有限预览阶段,后续将扩大容量。
5. 德意志银行成为欧洲首家外资人民币清算行
🔗 tradersunion.com: Deutsche Bank becomes first foreign yuan clearing bank in Europe
| 🔥🔥: 378 | 💬: 407 | 🗓️ 2026-08-13 |
中国授权德意志银行在法兰克福开展人民币清算业务,使其成为欧洲首家获此资格的外资机构。此前欧洲人民币清算主要依赖中资银行,此次纳入德意志银行有助于北京扩大人民币国际使用网络。该行拥有欧元和美元清算基础设施,并与中国央行早有合作。对欧洲制造、汽车和绿色科技企业而言,直接人民币结算可减少绕道其他货币。此举虽不会立即撼动美元或欧元主导地位,但为企业在人民币计价、结算和投资方面提供了更完善的基础设施。
6. Mistral OCR 4.1:文档 AI 的新一代 OCR 引擎
🔗 docs.mistral.ai: Mistral OCR 4.1
| 🔥🔥: 248 | 💬: 94 | 🗓️ 2026-08-13 |
Mistral 推出 OCR 4.1 公共预览版(Premier v4.1),作为其文档 AI 栈的最新 OCR 服务。它提供原生段落级边界框提取、结构化区块标签和区块级置信度评分,有助于更精准地解析文档布局。价格方面,每 1000 页为 €3.5,每 1000 页带标注为 €4.38。该服务支持通过 /v1/ocr 进行 OCR 与边界框提取、结构化注释,并可通过 /v1/batch 进行批处理;同时还可与 Z.ai GLM 5.2、Shieldstral 1.0、Mistral Medium 3.5 等其他模型配合使用。
7. 选择无聊技术(2015)
🔗 mcfunley.com: Choose Boring Technology (2015)
| 🔥🔥: 237 | 💬: 123 | 🗓️ 2026-08-13 |
本文主张优先采用成熟、可预测的“无聊技术”。作者提出创新代币概念:每家公司大约只有三次创新机会,随意选用 NodeJS、MongoDB 或自研数据库等会耗光额度。MySQL、Postgres、PHP、Python、Memcached、Cron 等虽不炫,但能力与故障模式更清晰,能减少“未知的未知”。技术选型要全局优化,不能只看“最适合这份工作”,因为运维和认知负担的长期成本远高于构建便利。引入新技术应有公司级可见流程,先问现有栈是否真无法解决,并明确迁移计划。克制选型反而带来自由,让团队专注业务,像 Etsy 活动流在共享平台上无干预扩展 20 倍。最终目的是快速交付,而非为技术而技术。
8. 九号公共广播公司起诉铁山公司:档案数据访问被封锁
🔗 current.org: Nine PBS sues Iron Mountain over blocked access to archival data
| 🔥🔥: 233 | 💬: 133 | 🗓️ 2026-08-13 |
美国公共广播公司九号台(Nine PBS)正在起诉数据存储服务商铁山公司(Iron Mountain),原因是其档案数据访问被封锁,导致无法正常调取重要内容。原评论指出,虽然希望PBS胜诉,但这一事件也暴露出仅保存一份副本的巨大风险。如果唯一的存档由外部机构控制,一旦合作关系破裂或服务中断,机构就可能失去对自身历史和资产的掌控。这种数据安全风险提醒所有内容创作者和文化机构,不能依赖单一存储方,必须建立多点备份和异地容灾机制。
9. 我向麦当劳申请数据,拿到515页“预测档案”
🔗 wired.com: I requested a copy of my data from McDonald’s loyalty program
| 🔥🔥: 206 | 💬: 286 | 🗓️ 2026-08-13 |
作者以加州居民身份要求麦当劳提供其忠诚计划收集的个人数据,结果收到一份515页报告。报告不仅记录每次交易、扫码抽奖和地理位置,还包含算法预测:未来六周到店2.16次、平均每单花费13.49美元、总消费29.15美元,并把“大杯健怡可乐”列为最相关商品,把消费习惯归为“午后零食型”和“匆忙午餐型”。隐私专家指出,这类忠诚计划本质上是商业监控,单条数据看似无害,但长期聚合会形成极具侵入性的用户画像。更耐人寻味的是,报告显示作者流失可能性为0,仿佛算法认定他永远不会离开。最终作者申请删除全部数据,希望用行动证明算法的预测并不准确。
10. 日常的丰盈
🔗 ordinaryabundance.com: Ordinary abundance
| 🔥🔥: 203 | 💬: 111 | 🗓️ 2026-08-13 |
晚上八点,公寓里只有音响轻轻流出的音乐,四周十分安静。播放的是朋友多年前制作的播放列表,你发信息向朋友问候,随后拿起一本书,打开台灯,坐进椅子开始阅读。这个片段没有强烈冲突,却呈现出一种安静而充实的生活质地:独处的宁静、友情的淡淡陪伴,以及阅读带来的沉浸感。这些看似普通的时刻,正是日常中珍贵的丰盈。它提醒我们,在熟悉的生活秩序里也能找到满足。
11. 理解才是新的瓶颈
🔗 geoffreylitt.com: Understanding is the new bottleneck
| 🔥🔥: 190 | 💬: 97 | 🗓️ 2026-08-13 |
随着智能体写出越来越多代码,作者认为人类仍须理解代码,且不只是为了验证,更是为了参与创造。他提出三类方法:用代码解释文档先讲背景和直觉,再结合“文学式 diff”与测验检查理解;构建微世界,如自定义调试器或模拟游戏,让人在操作中建立直觉;建立团队共享空间,共同形成心智模型。作者强调,理解不是可推迟的认知债务,AI 的目标始终是增强而非自动化;好的工具能让我们更深入地参与循环,而非退出。
12. 《Donkey.bas 45 岁:131 行代码的荣耀》
🔗 donkeybas.com: Donkey.bas is 45 Years Old – 131 line of Glory
| 🔥🔥: 184 | 💬: 79 | 🗓️ 2026-08-13 |
这款诞生于 45 年前的经典小游戏 Donkey.bas 以网页版形式重现,原始代码仅有 131 行。玩家可用空格键或点击屏幕切换车道,按 Esc 返回标题界面。页面还提供声音开关、CRT 复古显示效果、作弊模式和全屏功能,让人重温早期个人电脑游戏的简洁乐趣与年代感。
13. 一次提示词,11 个模型:Netlify 模型选择实测
🔗 netlify.com: Choosing an AI model: one prompt, 11 models, different results
| 🔥🔥: 176 | 💬: 72 | 🗓️ 2026-08-13 |
Netlify 宣布与 OpenRouter 合作,通过 AI Gateway 让项目可使用任意模型,并扩展 Agent Runners 的前沿编码模型选择,包括 Kimi K3、GLM 5.2、DeepSeek V4 等。为帮助用户避免错失恐惧,团队用相同提示词测试 11 个模型生成咖啡店单页站点,并用开源的 AXIS 工具评估功能正确性。结果显示成本差异极大:Claude Opus 5 平均约 519 分且一次高达 1055 分,而 DeepSeek V4 Flash 0731 平均仅 2.4 分。Opus 设计细节丰富但易超支,GPT 5.6 Sol 低努力模式性价比较好,GLM 5.2 成本低但多次运行差异大,Gemini 3.1 Pro 只做最低要求,Kimi K3 在长任务更强但设计不突出。文章先覆盖咖啡店场景,后续还将测试待办和 AI 菜谱应用。
14. Kubernetes on Oxide:客户需求如何塑造集成
🔗 oxide.computer: Kubernetes on Oxide: How customer needs shaped our integrations
| 🔥🔥: 153 | 💬: 69 | 🗓️ 2026-08-13 |
文章回顾 Oxide 根据客户在 Kubernetes 生命周期中遇到的真实问题逐步构建集成。最初没有受支持的方案,从客户提交的 Rancher node driver 开始发布首个集成;随后与 Sidero Labs 合作推出 Omni infrastructure provider,并在 KubeCon 展示;随着需求增长,团队发布 Cluster API Provider Oxide (CAPOx),提供 Kubernetes 原生集群管理。运行时通过 cloud controller manager(CCM)同步 Kubernetes 节点与 Oxide 实例,并用 floating IP 支持 LoadBalancer 服务,发布 Proxy 和 VIP 两个地址。客户工作流不断暴露下一层缺口,存储约束等平台工作仍在推进。
15. 一个周末花10美元,我建了50万域名的创客搜索引擎
🔗 alexmorleyfinch.github.io: I built a 500k-domain search engine for makers in a weekend for $10
| 🔥🔥: 138 | 💬: 73 | 🗓️ 2026-08-13 |
作者因为受够了主流搜索引擎把个人作品集、小杂志和独立软件淹没在企业文档与SEO垃圾里,决定用周末自建一个单人搜索引擎。系统只抓取主页,用本地小模型为每个站点生成名称、摘要、分类和标签,最终收录560,183个主页,元数据只占不到1GB。过程中最大的问题是网络内容偏向企业站点,于是他引入优先级队列,根据分类动态调整外链权重,让作品集、杂志和小型软件站更优先被爬取。他还限制每个根域名最多收录100个子域,避免Tumblr和Neocities淹没索引。通过租用云GPU,成本约0.35美元/小时,稳定吞吐为每分钟约600页,约1美元可收录10万个站点。作者提醒,让模型自由生成分类和标签会迅速失控,671个分类和超过12万个标签中大半只出现一次,需要提前约束或投入清理。
16. NP难题被高估了
🔗 gruhn.me: NP-Overrated
| 🔥🔥: 138 | 💬: 83 | 🗓️ 2026-08-13 |
NP-hard问题并不像许多人以为的那样在实践中完全不可解。理论只说明某些最坏输入会导致算法爆炸,但现实里最坏情况很少出现,甚至从不出现。依赖解析、类型检查等任务几乎不会触发极端复杂度;调度和旅行商等优化问题也能借助现代算法求出可证明最优解。SAT/SMT求解器已大规模应用,亚马逊每天求解十亿级别问题。算法进步带来的加速甚至超过硬件提升,因此NP-hard不等于无法解决。
17. 旧网何处去?我们追踪了657,607条链接
🔗 0.mk: Where did the old web go? We followed 657,607 links to find out
| 🔥🔥: 125 | 💬: 101 | 🗓️ 2026-08-13 |
2009至2014年间,0.mk 短链服务的数据库备份记录了657,958条链接。2026年8月,团队对可安全抓取的655,178条历史链接逐一访问,发现 76.7% 已无法打开;即使去除重复网址,仍有 78.7% 失效。网络层失败占55.0%,HTTP错误占23.7%,能返回页面的仅约23.3%,而且其中还包含登录墙、停放页或“内容已不存在”的提示。幸存者多是 YouTube、维基百科和 Google 等大型平台,个人博客、论坛、本地新闻和图片托管则大量消失。0.mk 也保存了马其顿本地网络记忆,多家停刊媒体的链接成了数字墓碑。文中还提到一些趣闻:第一条短链指向 WordPress 样式表,0.mk/localhost 指向本机,0.mk/7 至今仍指向 google.com。最终,团队因 AI 降低了开发与反垃圾成本,让这项旧服务得以复活。
18. DeepSeek API 定价更新
🔗 twitter.com: DeepSeek API Pricing Update
| 🔥🔥: 120 | 💬: 46 | 🗓️ 2026-08-13 |
DeepSeek 今日正式发布 DeepSeek-V4-Pro,带来面向智能体(Agent)的重大升级,并在生产环境中取得显著收益。V4-Pro 与 V4-Flash 均支持灵活推理强度:低强度适用于简单任务,高强度适用于日常 Agent 工作流,最高强度适用于复杂任务。同时新增对原生 OpenAI Responses API 的支持,并针对相关场景进行优化,方便开发者更高效地集成与调用。此次更新进一步提升了模型在智能体应用、多任务处理和复杂推理方面的能力与灵活性。
19. Heart Aerospace完成全球最大电动飞机首飞
🔗 heartaerospace.com: Heart aerospace completes first flight of largest electric aircraft
| 🔥🔥: 118 | 💬: 116 | 🗓️ 2026-08-13 |
2026年8月12日,Heart Aerospace的X1验证机在纽约州普拉茨堡完成首次试飞,成为迄今飞行的最大电池电动飞机。该机翼展106英尺、起飞重量超过2.5万磅,试飞持续27分钟,达到1100英尺高度,全电推进输出超1兆瓦,仅消耗约5美元电力。X1是30座混合电动支线客机ES-30的全尺寸验证平台,已获美联航、加拿大航空等客户承诺,目标2031年投入运营并降低40%以上运营成本。
20. Pi 压缩对话:长会话如何“减负”
🔗 earendil.com: How Compaction Works in Pi
| 🔥: 97 | 💬: 34 | 🗓️ 2026-08-13 |
大语言模型的上下文窗口有限,编码会话持续增长会触达上限,导致请求失败。Pi 通过压缩(compaction)机制,用独立的 LLM 请求把较早历史总结成结构化简报,只保留近期消息,为后续工作腾出空间。默认保留约 2 万 token 的近期内容,约合 5 到 20 轮;可在轮次结束自动触发,也可由 /compact 手动或上下文溢出时中途执行。压缩提示词要求总结目标、进展与关键决策,结果以纯文本保存,便于切换模型。代价是提示缓存会因前缀变化而失效,但后续请求会重新缓存。用户还能通过扩展自定义压缩逻辑。
21. AI 文本水印永远极易去除
🔗 seangoedecke.com: Text AI watermarks will always be trivial to remove
| 🔥: 95 | 💬: 85 | 🗓️ 2026-08-13 |
欧盟《人工智能法案》第50条将要求所有 AI 输出可被检测为人工生成,迫使提供商嵌入水印。文章指出,文本水印本质是隐写术难题,很难在不降低质量的情况下隐藏签名。谷歌的 SynthID 通过影响采样策略给 token 留下统计指纹,但经转述或改写即可消除。OpenAI 与 Anthropic 可能使用 Unicode 同形字符(如特殊空格)做水印,替换回普通字符即可破解。作者认为基于安全模糊性的文本水印无法满足“难以分离”的监管要求,而 C2PA 签名只适用于文件,不适用于聊天输出的纯文本。最终预测各方会部署 SynthID 式采样并提供检测页,但去除水印的工具将大量出现,技术与非技术用户都能轻易剥离水印。
22. 用电子垃圾拼出家用AI数据中心:四张AMD V620跑大模型
🔗 jdagostino.github.io: AI At Home Part 1: A Box Of Scraps
| 🔥: 87 | 💬: 45 | 🗓️ 2026-08-13 |
作者在零部件短缺下,从eBay淘来四张几乎全新的 AMD V620 服务器GPU、老X299主板和i9-10900X等“电子垃圾”,自建家庭AI服务器。这些卡因云游戏失败被过量生产,无视频输出和风扇、软件支持差,但每张有32GB显存且便宜。他3D打印了双卡80mm风扇导风罩,并用Arduino自制风扇控制器,还让模型自己写了温控脚本。装机时折腾BIOS开启Resizable BAR和MMIO High Size才点亮。最终用 llama.cpp 成功跑起Gemma4和 Deepseek V4 Flash,速度虽慢但能装下,体现“把AI数据中心带回家”的动手精神。
23. Claude 输出能用于训练 AI 模型吗?
🔗 support.claude.com: Can I use my Outputs to train an AI model?
| 🔥: 85 | 💬: 78 | 🗓️ 2026-08-13 |
使用 Claude 时你拥有生成内容的版权,但未经书面许可,不得用其训练或开发 AI 模型。Anthropic 限制此举,是因为输出被用于训练新模型后可能丧失原有安全控制,且无法监督部署与滥用;同时相当于利用其基础设施和投入来构建直接竞争对手。你可以用输出训练不与其竞争的专用模型,如情感分析、内容分类、摘要提取和语义搜索等工具,也可集成到产品、内容生成和内部工作流。禁止用输出训练通用聊天机器人、开放式文本生成模型、作为训练目标或逆向工程训练方法,也不得协助第三方这样做。
24. Bullet(YC S26)发布:更快的编程智能体
🔗 codewithbullet.com: Launch HN: Bullet (YC S26) – A Faster Coding Agent
| 🔥: 81 | 💬: 51 | 🗓️ 2026-08-13 |
Bullet 是 YC S26 推出的编程智能体,其核心是“按需路由/升级”协议。它先对任务进行分类,将简单直接的任务分配给快速模型,只有遇到深度复杂推理或最困难的问题时才升级到更强模型,真正做到“合适的模型、合适的时机”。这种方式可以在保障结果质量的同时加快编码流程、降低推理成本,让编码智能体在速度与能力之间取得更好平衡。
25. 概念推理指数:衡量 AI 在缺乏实证反馈问题上的推理能力
🔗 alignment.anthropic.com: The Conceptual Reasoning Index
| 🔥: 71 | 💬: 52 | 🗓️ 2026-08-13 |
Alignment Science Blog 与 Anthropic 合作推出概念推理指数(CRI),汇总 LMCA、ACCoRD 与 DTBench capabilities 三个基准,评估模型在哲学、AI 未来学、决策论等缺乏可验证答案领域中的概念推理能力。LMCA 包含 560 个立场文本和 1,461 条专家评分论证,衡量模型判断论证质量的能力;ACCoRD 检验模型报告的概率与偏好是否逻辑一致;DTBench capabilities 测试决策论情境推理。截至 2026 年 8 月,Opus 5 得分最高,为 73.6(95% CI ±2.1),距约 91 的估计上限仍有差距;整体分数自 2024 年底近似线性上升。作者认为提升此类能力有助于自动化或增强降低 AI 风险的工作,并将在 conceptualreasoning.ai 持续更新。