- 谷歌发布 Gemini 3.8 Flash 与网络安全版 Flash Cyber;
- LWN 订阅价格上调:优质独立技术新闻的艰难生存与读者支持;
- 如何退出 Mistral 模型训练?;
- Commodore 64:1982年9月1日问世的传奇计算机;
- AI“最佳软件”引用背后:三个网站生成21万页,模型大量采信;
以上是今天的前五条黑科技新闻标题。
总共25条,具体内容您往下读…

1. 谷歌发布 Gemini 3.8 Flash 与网络安全版 Flash Cyber
🔗 blog.google: Gemini 3.8 Flash and 3.8 Flash Cyber
| 🔥🔥: 760 | 💬: 457 | 🗓️ 2026-09-02 |
谷歌于2026年9月2日推出新一代模型 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber。前者作为主力推理与编程模型,在软件工程、智能体任务和多步推理上较3.7 Flash显著提升,价格保持每百万输入token 0.75美元、输出3.75美元,并在DeepSWE v1.1、HLE-Verified(54.9%)等基准中接近或超越更大规模的前沿模型。后者面向 Fairwind 计划 的可信防御者,专注漏洞自主发现与自动修补,在CyberGym、CWE-Bench等测试中表现前沿,并在Chrome安全、Wiz及谷歌云漏洞研究等真实场景中显示出更高修复率与更低成本。两款模型均强化了提示注入防御与安全框架,兼顾能力与安全部署。
2. LWN 订阅价格上调:优质独立技术新闻的艰难生存与读者支持
🔗 lwn.net: A note on subscription prices from LWN
| 🔥🔥: 662 | 💬: 133 | 🗓️ 2026-09-02 |
LWN 宣布自 9月15日 起订阅价格上涨约 20%,以应对自2022年以来近20%的通胀和成本上升。新价格从“饥饿黑客”每月6美元到“狂热支持者”每月55美元不等,团体订阅同步调整;此前已购订阅在到期前有效,活跃月度订阅可享六个月旧费率。LWN表示,订阅模式自2002年确立以来仅第三次提价,但近年订阅增长停滞,此次调价是维持独立运营的短期措施。2026年1月LWN将进入第30年,文章强调 读者支持是它存续的唯一原因。读者评论普遍表示理解和愿意继续付费,也有人希望增加加密货币支付选项,编辑回应会考虑提高优先级。
3. 如何退出 Mistral 模型训练?
🔗 help.mistral.ai: Can I opt out of my input or output data being used for training?
| 🔥🔥: 352 | 💬: 153 | 🗓️ 2026-09-02 |
Mistral 允许用户随时退出输入输出数据被用于模型训练。Vibe 用户默认未退出,可在设置中关闭;企业版默认退出,由管理员控制。通过管理面板进入 Vibe 隐私设置,禁用“允许互动用于训练模型”即可,注意上传的文档也属于输入数据。移动端需在“数据与账户控制”中取消数据共享。Studio 和 API 需在隐私菜单中关闭匿名改进数据。Vibe 与 API 的退出开关相互独立,必须分别配置,确认后 Mistral 将不再使用相关数据训练模型。
4. Commodore 64:1982年9月1日问世的传奇计算机
🔗 dfarq.homeip.net: Commodore 64 released September 1, 1982
| 🔥🔥: 314 | 💬: 163 | 🗓️ 2026-09-02 |
1982年9月1日,Commodore 64正式发布,凭借64KB内存和低于600美元的价格,成为当时极具性价比的选择。早期虽遇品控问题并转由日本Kentron代工,但半年内售出50万台,最终累计销量约1230万台,跻身史上最畅销计算机之一。其成功并非偶然:16色图形、8个硬件精灵和三声道SID芯片虽有妥协却恰到好处,程序员也不断挖掘出超乎设计者想象的影音效果。作者回忆自己在这台机器上学习BASIC和汇编、维修、恢复数据,甚至多年后靠它重新找回编程感觉,顺利转向Python。C64还启发了他的复古科技博客;2025年FPGA复刻版售出约1.9万台,足见其持久影响力。
5. AI“最佳软件”引用背后:三个网站生成21万页,模型大量采信
🔗 trellner.com: Three sites made 215,128 “best software” pages for AI. Perplexity cites them
| 🔥🔥: 270 | 💬: 123 | 🗓️ 2026-09-02 |
研究人员用380个软件采购类别测试 perplexity/sonar 与 sonar-pro,收集7534条引用,发现 59.8%的引用指向Tranco排名十万以下的域名,23.4%甚至未进入前百万。最高频引用中,guideflow.com 只是产品演示厂商的营销博客,却成为第三大证据源。wifitalents.com、worldmetrics.org 和 gitnux.org 疑似同一运营方,共发布 **215,128个机器生成的“best <类别> software”页面**,并把主页标题写成面向检索系统的 **“Facts & Grounding Page”**。三个站对同一类别的排名互相矛盾,还残留模板变量。模型给出的供应商主页多数可访问,少数跳转到赌博或赌场网站。研究仅覆盖 Perplexity,并说明低排名不等于劣质,但揭示了证据库被制造页面填充的问题。类别>
6. 荷兰央行将百亿欧元黄金从美加转运伦敦
🔗 nltimes.nl: Dutch central bank moves share of gold from U.S., Canada to London
| 🔥🔥: 217 | 💬: 212 | 🗓️ 2026-09-02 |
荷兰中央银行9月2日宣布,因担忧日益加剧的地缘政治不稳定,已将价值超过100亿欧元、重约86吨的黄金从美国和加拿大转移至伦敦的英格兰银行。央行表示,伦敦是全球黄金最易交易的市场,此举旨在提升危机应对能力,确保紧急情况下黄金储备能更快变现。目前荷兰黄金储备共612.4吨,约32%存放于伦敦,31%在泽斯特,纽约和渥太华各约18.5%。此次调整包括出售纽约59吨黄金并在伦敦买入等量黄金,以及将部分黄金在泽斯特与伦敦之间转移,以平衡风险。荷兰央行称,更均衡地分布于北美、英国和荷兰有助于分散风险。近期美国与伊朗、加拿大、古巴等地的冲突加剧了全球紧张局势。
7. 走出洞穴,活在真实世界
🔗 turtlespace.blog: Exit the Cave
| 🔥🔥: 195 | 💬: 61 | 🗓️ 2026-09-02 |
作者反思了“洞穴”式私下苦练的浪漫化:智能设备、推荐算法和 AI 让我们更舒适地活在自己的泡泡里。他用自己的摔跤经历说明,多年里把可衡量的努力误认为进步,其实是在逃避失败与羞耻,而非真正追求胜利。摔跤场这个真实世界暴露了他的自我欺骗:技术与体能之外,更需要敢赢的心。与其在私下无限训练、打磨产品,不如在公开中冒险——发布产品、分享故事、走进竞技场、接受被拒绝的风险。即使失败,也是在真实世界里失败。
8. 我没有智能手机,至少我希望如此
🔗 ploum.net: I Don’t Have a Smartphone
| 🔥🔥: 191 | 💬: 185 | 🗓️ 2026-09-02 |
作者普卢姆表示,他常对外声称“我没有智能手机”,以此拒绝商家强制装应用或扫码。实际上他用的是去谷歌化的电子墨水屏手机 Mudita Kompakt,只装 Signal、骑行导航等自选工具;另有一部刷 /e/OS 的 FairPhone 处理银行等被迫用应用的场景,还有一部旧 OnePlus 5 作为最后备份。他指出,要求用户装 App 隐含 十项假设:拥有手机、有电、有存储、有网络、有可用的谷歌或苹果账号等。他批评欧洲社会默认人人依赖 谷歌和 Meta,学校、银行、政府都在推强制应用,这种集中控制令人恐惧。他呼吁支持欧洲替代方案,并以“我没有智能手机”作为日常抵抗。
9. 衰老的大脑不只会遗忘,还会把记忆混在一起
🔗 studyfinds.com: Aging brains blend memories together instead of just forgetting them
| 🔥🔥: 177 | 💬: 82 | 🗓️ 2026-09-02 |
一项发表于《Cerebral Cortex》的研究发现,人在青年期后记忆准确性明显下降,但中老年之间差异不大。年轻人回忆时若能重现学习阶段的海马体活动模式,表现更好;而老年人同样的脑活动重合却不再预测准确率,反而与跨类别混淆错误相关,例如把本该配物体的面孔错配成场景。研究还指出,脑萎缩和注意力差异并不能完全解释这种转变。这说明衰老大脑并非单纯丢失记忆,而是重放过程变得过于宽泛,把相似经验织成错误连接。
10. GrapheneOS 改口:Pixel 11 确实支持 MTE
🔗 grapheneos.social: GrapheneOS says Pixel 11 has MTE support after all
| 🔥🔥: 168 | 💬: 135 | 🗓️ 2026-09-02 |
该页面并未提供完整文章内容,仅显示 Mastodon 网页应用需启用 JavaScript,或建议使用原生应用。因此,实际可读信息只有标题:GrapheneOS 表示 Pixel 11 最终支持 MTE(内存标记扩展)。正文缺失,没有技术细节、测试数据或官方说明可以验证这一说法,读者暂时无法确认其可信度。
11. Quasar 438B:欧洲领先 AI 模型,企业级推理新旗舰
🔗 multiversecomputing.com: Quasar 438B: Europe’s Leading AI Model
| 🔥🔥: 157 | 💬: 101 | 🗓️ 2026-09-02 |
Multiverse Computing 推出旗舰推理模型 Quasar 438B,支持英语和西班牙语,定位企业级智能体与编程。它在 Artificial Analysis Intelligence Index v4.1.1 综合评测中获得 43 分,是欧洲模型的最高成绩,领先 Mistral Medium 3.5(30 分)、NVIDIA Nemotron 3 Ultra(38 分)和 Inkling(42 分),与前沿模型 Claude Opus 5(63 分)仍有差距。速度方面,Quasar 输出 500 个 token 仅需 15.3 秒(含思考时间),在相近能力模型中响应非常快;只有 Gemini 3.7 Flash 同时更快且得分更高。其长上下文推理 AA-LCR 得分 75.0,接近 Claude Opus 5 等前沿水平;Terminal-Bench v2.1 得分 69.3,在欧洲模型中领先,但仍是后续提升重点。该模型通过 CompactifAI API 提供,便于团队快速测试,适合软件开发智能体、技术助手、研究系统和流程自动化等场景。
12. 我想活成NPC:不在乎,才能好好生活
🔗 signalundefied.bearblog.dev: I wanna live an NPC life
| 🔥🔥: 155 | 💬: 148 | 🗓️ 2026-09-02 |
作者认为,NPC生活并非放弃自主,而是一种终极的“不在乎”心态。就像《上古卷轴5》里的铁匠,无论玩家屠龙或偷窃,他仍专注打铁,不为外界所动。真正重要的不是当主角,而是做自己的事:开无聊的车、做普通工作、下班后什么也不做都行。当你不执着于主角光环,才真正开始活出自己。
13. OpenAI与Anthropic零发现后,AISLE挖出六个curl CVE
🔗 aisle.com: Six curl CVEs after OpenAI and Anthropic came back with zero
| 🔥🔥: 148 | 💬: 51 | 🗓️ 2026-09-02 |
2026年8月,curl创始人Daniel Stenberg公开表示,Anthropic Mythos和OpenAI Codex Security对curl的分析均返回零漏洞。AISLE随后运行自主AI系统,次日提交29份报告,其中6份被curl安全团队认定为真实漏洞并分配六个CVE,涉及OpenSSL provider使用后释放、证书固定绕过等低严重度问题。这些漏洞均在curl 8.22.0中修复,报告者被官方署名为AISLE的Stanislav Fort。此次对比的独特之处在于,前沿AI系统的零结果先被公开且带时间戳,随后才出现AISLE的发现。Linux稳定版维护者Greg Kroah-Hartman也回应称在Linux内核中看到类似模式。AISLE认为这支持其“系统胜过模型”的论点,即专用AI系统在真实零日漏洞发现上可超越前沿实验室的通用模型。
14. 检查文件是否由 Claude 制作
🔗 claude.com: Check if a file was made with Claude
| 🔥🔥: 143 | 💬: 107 | 🗓️ 2026-09-02 |
该工具可在浏览器中检测文件是否带有 Claude 内容凭证。它支持 JPG、PNG、MP4、WAV 等常见格式,文件最大 100 MB,且不会离开你的设备。Claude 生成文件时会附加符合 C2PA 开放标准的签名元数据,工具读取该凭证判断文件是否由 Claude 制作或处理。它无法识别内容本身是否由 Claude 创作,也不含用户身份信息。文本水印则需通过面向合规机构的检测 API 获取,目前为私有预览。
15. Perplexity 三分之一的引用来源不含所引数字
🔗 hausresearch.com: A third of Perplexity’s citations don’t contain the number they’re cited for
| 🔥🔥: 124 | 💬: 44 | 🗓️ 2026-09-02 |
一项对 Perplexity 两个搜索模型、310 个科技公司事实问题的审计显示,在 1,826 条附着于数字句子的引用中,34.7% 指向无法打开或完全不含句中任何数字的页面;按声明计,14.4% 的 872 个数字声明无法通过。失败主要不是死链,死链仅 1.3%,更大问题是付费墙、登录墙、反爬页面或可读但内容不支撑引用。高价模型 sonar-pro 相较 sonar 并无改善。被引来源中约四分之一来自 B2B 目录和销售线索网站,其中不少页面事后 404/410 或从未被 Wayback Machine 存档,导致引用无法长期核查。报告强调,这衡量的是引用能否作为证据,而非答案本身是否正确。
16. 泊松盘采样:高效生成“随机但不过近”的点分布
🔗 stripeacross.com: Poisson Disk Sampling
| 🔥🔥: 115 | 💬: 17 | 🗓️ 2026-09-02 |
2007年 Bridson 提出了一种一页纸算法,解决图形与模拟中常见的泊松盘采样问题:随机放置点,但任意两点间保持最小距离。算法将空间划分为网格,维护活跃点列表,围绕活跃点在环形区域内最多尝试 k 次采样,并利用网格加速碰撞检测;失败则移除该活跃点。后续改进包括利用父点信息排除无效角度,以及调整半径采样指数 c 来改变点距分布,从而在密度与随机感之间取得平衡。此外,最小距离 r 还可以随图像亮度动态变化,用于黑白或彩色点画效果。2022 年 Mitchell 提出一种新算法,能保证结果最大化、均匀且确定,无需拒绝采样,性能接近优化后的 Bridson 算法,但实现更复杂。
17. 优步宣布裁员10%:简化组织、聚焦未来
🔗 uber.com: Uber is laying off 10% of staff
| 🔥🔥: 109 | 💬: 53 | 🗓️ 2026-09-02 |
优步CEO达拉·科斯罗萨西在2026年9月2日致员工信中宣布,公司将裁员10%,受影响员工已收到通知。此次调整针对快速增长带来的层级过多、决策缓慢和职责分散,重点是精简管理层、合并重复团队,让组织更简单、更快速。同时,优步将把团队集中到纽约、旧金山等关键枢纽,并要求绝大多数远程员工回归办公室,未来仅约1%员工可远程办公。节省下来的资金将重新投入增长、创新和自动驾驶等领域。
18. 把垃圾埋了吧:回收未必更环保
🔗 worksinprogress.news: Just Bury Your Trash
| 🔥: 95 | 💬: 154 | 🗓️ 2026-09-02 |
我们常被教导填埋最糟、回收最环保,但本文认为这一印象有误。现代卫生填埋场有衬层、压实覆盖和甲烷收集,环境风险远低于想象;许多一次性用品因为生产能耗低,反而比所谓耐用品更划算,例如棉布袋需重复使用 173 次才能胜过塑料袋。金属回收确实省能且经济,但多数塑料回收流程复杂、污染率高、成本昂贵,减排效果甚至不如直接空气捕碳。海洋塑料主要来自少数发展中地区,发达国家居民把垃圾放进哪个桶对海洋几乎无影响。因此,与其盲目追求回收率,不如在合适场景下坦然地填埋垃圾。
19. Fable 5.1 世界建模:用代码重建可探索的真实街区
🔗 github.com: Fable 5.1 World Modeling
| 🔥: 93 | 💬: 36 | 🗓️ 2026-09-02 |
该项目通过自主 Claude Fable 5.1 智能体集群完成研究、建模与质检,并以纯 Three.js 应用交付代码生成的浏览器原生世界。它不依赖游戏引擎或专有 3D 瓦片,所有建筑、店招、树木和信号灯均源自开放数据与公共参考影像。以旧金山联合广场为例,覆盖 453 个 OSM 足迹、129 家命名店铺、220 名行人与 109 辆车,并包含苹果与任天堂两处可探索室内。流水线涵盖侦察、基于 Blender bpy 的离线资产生成、Three.js 运行时组装,以及用 Playwright 和独立评审员完成的相机匹配质检。代码与资产以 MIT 许可发布,几何源自 OpenStreetMap 与 USGS。
20. WebLLM:高性能浏览器内大语言模型推理引擎
🔗 github.com: WebLLM: high-performance in-browser LLM inference engine
| 🔥: 81 | 💬: 17 | 🗓️ 2026-09-02 |
WebLLM 是一个高性能浏览器内 LLM 推理引擎,通过 WebGPU 实现硬件加速,无需服务器即可在网页中直接运行语言模型。它完全兼容 OpenAI API,支持流式输出、JSON 模式、函数调用等功能,方便开发者将开源模型本地化部署到浏览器中。WebLLM 原生支持 Llama 3、Phi 3、Gemma、Mistral、Qwen 等多种模型,并允许集成自定义 MLC 格式模型。用户可以通过 npm、yarn、pnpm 或 CDN 快速接入,使用 MLCEngine 接口加载模型和进行对话生成。该引擎还支持多种缓存后端(Cache API、IndexedDB、OPFS 等),并可配合 Web Worker、Service Worker 和 Chrome 扩展优化性能与离线体验。此外,WebLLM 提供模型完整性校验功能,确保下载的配置文件、WASM 和分词器安全可靠。开发者可参考官方示例快速构建聊天机器人或更复杂的 AI 助手应用。
21. 谷歌发布 Gemini 3.8 Flash 与 Flash Cyber:强化智能体与网络防御
🔗 blog.google: Gemini 3.8 Flash and 3.8 Flash Cyber
| 🔥: 76 | 💬: 0 | 🗓️ 2026-09-02 |
谷歌推出 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,这是六周内第三个 Flash 版本。3.8 Flash 在软件工程、智能体任务与多步推理上显著提升,价格与 3.7 Flash 持平;在 DeepSWE、金融与法律智能体基准上接近或超越更大前沿模型,并在 HLE-Verified 达到 54.9%。Flash Cyber 通过 Fairwind 计划 面向可信防御者,专注漏洞发现与自动修补,在 CyberGym 与内部 20 种语言基准中表现领先,CWE-Bench 修补成功率约 47.2%,成本更低。实际部署中,Chrome 正确补丁提升 2.6 倍,Wiz 召回率更高,Google Cloud 漏洞研究团队数小时内发现通常需数月的关键漏洞。模型内置 CBRN 与网络攻击防护,并增强提示注入鲁棒性。
22. 告别 Elixir 探索性写作:不再把想象力喂给机器
🔗 lucassifoni.info: Ending my elixir exploratory writing
| 🔥: 71 | 💬: 46 | 🗓️ 2026-09-02 |
作者回顾了三年半以来围绕 Elixir 与 BEAM 的探索性写作带来的收获,也仍认可 BEAM 平台的价值。但他决定停止公开的编程实验性写作,因为 LLM 已大量取代人工编写代码,社区讨论萎缩,开源也越来越像“开发者从头重新生成一切”。许多博客、帖子和讨论由机器代写,甚至有人让 Claude 顶替自己的名字和头像互动,令他感到不安。既然用文字和代码模拟构思的过程已可被完全替代,他不想再把自己仅剩的 想象力 与创意交给机器。未来他仍会写其他主题及非实验性的 Elixir 内容。
23. ZSvirt:轻量级开源虚拟化平台,企业级能力与社区驱动
🔗 github.com: Show HN: ZSvirt – A lightweight, scalable open source virtualization platform
| 🔥: 71 | 💬: 9 | 🗓️ 2026-09-02 |
ZSvirt 是由 ZStack 支持、基于企业级 ZSphere 引擎的开源虚拟化平台,定位为轻量级、可扩展的虚拟机管理与运行方案,避免厂商锁定。用户可安装管理节点并接入 KVM 主机,通过 Web UI、RESTful API(含 Terraform 与 Go/Python/Java SDK)或 CLI 统一管理虚拟机、集群、存储和网络。平台内置VMware 迁移工具,支持在线迁移、OVF 导入和 VMDK 上传。架构采用异步、无状态、插件化与工作流引擎设计,覆盖计算、网络、存储虚拟化及管理平面。项目提供在线演示、快速入门、迁移指南,并欢迎社区贡献,采用 GPL v3.0 许可。
24. 硬编码功能开关也没问题(2025)
🔗 code.mendhak.com: It’s OK to hardcode feature flags (2025)
| 🔥: 69 | 💬: 47 | 🗓️ 2026-09-02 |
文章指出,功能开关管理软件看似强大,却常带来复杂性和风险。架构上它们不过是运行在独立进程中的 if 语句,需要额外的基础设施;开发中会引入 非确定性行为,长期存在的开关还容易形成技术债务,使代码库僵化;安全上也扩大了攻击面。相比之下,硬编码功能开关 更简单、可靠、安全,是最“无聊”也最好的方案。只需在启动时读取 JSON 文件,通过正常评审、测试和部署流程修改,并及时清理失效开关。对多数团队和产品来说已经足够;等到真正需要大规模运行时切换时,团队自然会意识到。过早优化是糟糕的设计与工程。
25. LLM:智能与成本之争
🔗 openteams.com: LLMs: Intelligence vs. Cost
| 🔥: 67 | 💬: 38 | 🗓️ 2026-09-02 |
文章围绕大语言模型的智能与成本平衡展开,并介绍在 UBI-micro 上使用 pixi 实现多阶段容器构建的工程方法。通过精简运行时依赖、利用分层缓存和最小化攻击面,构建过程显著缩小了镜像体积,降低了资源消耗与供应链风险。这一实践表明,在追求更强模型能力的同时,可以借助轻量基础镜像和可复现构建流程来缓解成本压力,实现更安全、更高效的部署。