2026-08-13

今日要点


Hacker News

Tailscale Traces Database Corruption to 16y/o SQLite WAL-Reset Bug

Tailscale 追踪到数据库损坏源于 16 年前的 SQLite WAL 重置漏洞

Tailscale 近期经历了长期的服务不稳定,经过数月的深度取证,团队最终定位到问题的根源在于 SQLite 内部一个潜伏长达 16 年的 WAL(预写式日志)重置漏洞。该漏洞导致了数据库在特定条件下的损坏,严重影响了系统的正常运行。目前团队已确认并修复了该问题,服务稳定性得到显著提升。

Read more →

AI is removing the middle class of software engineering?

AI 正在消灭软件工程的中产阶级吗?

文章探讨了 AI 对软件工程职业结构的影响。作者指出,过去资深工程师负责架构与代码质量,初级工程师通过 PR 学习成长。然而,随着 AI 自动生成代码能力的提升,这种传统的师徒传承模式正在瓦解,处于中间层级的工程师可能面临被 AI 取代的风险,软件开发团队的结构正面临重塑。

Read more →

DeepSeek V4 Pro 0813

DeepSeek V4 Pro 0813 正式发布

DeepSeek V4 Pro 0813 是 DeepSeek 推出的最新大规模混合专家(MoE)模型,现已进入 GA(通用可用)阶段。该模型通过 OpenRouter 提供直接访问,旨在为用户提供高性能的 AI 推理能力。官方强调了其在成本控制和缓存优化方面的优势,以应对日益增长的商业需求。

Read more →

License plate reader searches should require a warrant

车牌识别搜索应强制要求搜查令

作者基于在 Schmidt v City of Norfolk 案中担任专家证人的经验,呼吁对执法部门使用车牌识别(LPR)技术进行严格监管。他认为,尽管 LPR 是有效的警务工具,但大规模的监控行为侵犯了公民隐私,因此必须通过法律手段要求执法部门在进行此类数据搜索时必须获得搜查令。

Read more →

Controversial creators are benefiting from monetization programs run by Meta

争议性创作者正从 Meta 的变现计划中获益

ABC News Verify 的调查显示,Meta 旗下的 Facebook 正在向包括新纳粹关联者和知名反疫苗人士在内的争议性内容创作者支付报酬。尽管 Meta 宣称有内容审核机制,但这些创作者的内容依然通过平台的变现计划获得了经济支持,引发了公众对平台责任和算法推荐机制的强烈质疑。

Read more →

LinkedIn CringeBot 3000

LinkedIn 尴尬内容生成器 3000

这是一个针对 LinkedIn 平台上过度矫情、虚伪的职场博文进行讽刺的工具。该项目通过模拟那些典型的“职场成功学”语调,生成令人尴尬的帖子,旨在调侃当前社交媒体上泛滥的职场表演文化。

Read more →

2026 Eclipse Webcams

2026 年日食网络摄像头

该项目汇总了全球范围内用于观测 2026 年日食的实时网络摄像头链接。通过该平台,天文爱好者可以跨越地理限制,实时观看这一罕见的天文现象,为全球用户提供了便捷的观测入口。

Read more →

Qwen3.8-2.4T

Qwen3.8-2.4T 模型发布

Qwen 系列迎来重大更新,Qwen3.8-2.4T 模型已在 Hugging Face 上线。该模型采用了 FP8 量化技术,旨在平衡超大规模参数量与推理效率,为开发者提供更强大的多语言处理与逻辑推理能力。

Read more →

llama.cpp

llama.cpp 本地化运行方案

llama.cpp 致力于让用户在本地设备上完全运行前沿 AI 模型,无需 API 密钥,无遥测数据,无使用限制。通过集成 pi-llama 插件,用户可以轻松实现本地模型的自动发现与部署,确保数据完全保留在个人设备上,实现了从笔记本电脑到集群的灵活扩展。

Read more →

Grok 4.6

Grok 4.6 版本发布

Grok 4.6 在 4.5 版本的基础上进行了升级,重点优化了长周期代理(long-running agents)的性能,并增强了在复杂交互与视觉任务中的表现。该模型能够更好地处理多步骤任务,如深度研究、数据分析等,进一步提升了其在复杂工作流中的实用性。

Read more →

Grok 4.6 scores 61 on the Artificial Analysis Intelligence Index

Grok 4.6 在人工智能分析指数中获得 61 分

Grok 4.6 在发布仅一个月后,其智能指数得分提升了 5 分,总分达到 61 分,与 GPT-5 持平。这一成绩标志着 SpaceXAI 成功重返人工智能前沿阵地,仅次于 Anthropic,显示出其在模型迭代速度和性能提升上的强劲势头。

Read more →

Delta

Delta:AI 代理协作开发环境

Delta 是一个专为 AI 代理与人类开发者协作设计的多人开发环境。它将代码与对话上下文紧密连接,允许开发者在查看代理构建过程的同时进行实时协作与评审。目前该项目已开启私人内测,旨在解决 AI 辅助编程中上下文丢失的问题。

Read more →

Show HN: Woxi - Open-source Mathematica / Wolfram Language reimplementation

Woxi:开源 Mathematica/Wolfram 语言重实现

Woxi 是一个用 Rust 编写的 Wolfram 语言解释器。它不仅提供了一个类似 Mathematica 的 GUI(Woxi Studio),还支持 CLI、Jupyter 内核、Python/npm 包及 WASM 模块。相比原版,Woxi 具有开源、启动速度极快等显著优势。

Read more →

Why tiny JPEGs look different in Chrome

为什么微小的 JPEG 图片在 Chrome 中显示效果不同?

作者发现 Chrome 浏览器在渲染极小尺寸的 JPEG 图片时,显示效果与预期不符。经过调查,这并非渲染错误,而是 Chrome 采用的一种巧妙的 JPEG 解码优化策略。该策略在处理 15px 等极小尺寸图片时,为了视觉效果进行了特定调整,导致了与原图的细微差异。

Read more →

What sort of maths are LLMs good at?

LLM 擅长什么样的数学?

文章探讨了大型语言模型在数学领域的表现。作者提到 OpenAI 近期在数学和理论计算机科学领域取得的重大突破,包括解决非索非群(non-sofic group)构造等难题。文章分析了 LLM 在处理形式化逻辑与数学证明时的能力边界,并对 AI 在推动数学研究方面的潜力进行了展望。

Read more →


TechCrunch

Northrop’s robot space mechanic is a new way to keep satellites at work longer

诺斯罗普的机器人太空维修工:延长卫星寿命的新方案

诺斯罗普·格鲁曼公司的任务机器人飞行器(MRV)正在尝试为一颗老化的卫星安装新的推进器。这一创新技术旨在通过在轨维修延长卫星的使用寿命,减少太空垃圾的产生,并为卫星运营商提供了一种比发射新卫星更经济的维护选择。

Read more →

Amazon will train on Twitch streamers’ content by default, unless they opt out

亚马逊将默认使用 Twitch 主播内容进行 AI 训练,除非用户选择退出

Twitch 首席产品官 Mike Minton 在直播中回应用户反馈时表示,亚马逊将默认使用 Twitch 主播的内容来训练其生成式 AI 模型。他坦言,如果采取“选择加入”模式,几乎没人会参与。目前平台已提供退出选项,允许主播禁止其直播、视频点播和聊天记录被用于 AI 训练。

Read more →

Grubhub’s $24M FTC settlement is finally reaching diners and drivers

Grubhub 的 2400 万美元 FTC 和解金开始发放给用户和司机

Grubhub 因商业行为违规与联邦贸易委员会(FTC)达成 2380 万美元的和解协议,目前赔偿支票已开始寄送给受影响的订餐用户和外卖司机。此举标志着针对 Grubhub 商业行为调查的阶段性终结。

Read more →

AI coding startup Cognition reportedly already in talks to raise at $40B valuation

AI 编程初创公司 Cognition 据传正以 400 亿美元估值寻求融资

在几个月前以 260 亿美元估值融资 10 亿美元后,AI 编程初创公司 Cognition 据传正在进行新一轮大规模融资谈判,估值高达 400 亿美元。这反映了资本市场对 AI 编程代理领域的高度追捧。

Read more →

As AI safety concerns mount, three pioneers make the case for staying open

随着 AI 安全担忧加剧,三位先驱为“保持开放”辩护

在 Ai4 大会上,Geoffrey Hinton、李飞飞和吴恩达三位 AI 领域权威专家就 AI 监管、开源访问以及美国如何在全球竞争中保持领先地位展开了辩论。他们共同探讨了如何在确保安全的前提下,通过开放生态促进技术创新。

Read more →

OpenAI-backed Thrive Holdings raises $2B to bring AI to the enterprise

OpenAI 支持的 Thrive Holdings 融资 20 亿美元,旨在将 AI 带入企业

Thrive Holdings 宣布完成 20 亿美元融资,估值达到 120 亿美元。投资方包括软银、D1 Capital Partners 和 Altimeter Capital。该公司致力于将先进的 AI 技术集成到企业工作流中,提升企业运营效率。

Read more →

Uber Freight reportedly investigating after hacking group claims data breach

Uber Freight 遭黑客组织声称数据泄露,目前正在调查

一个以针对运输公司和私募股权公司为目标的勒索黑客组织声称对 Uber Freight 进行了攻击。Uber Freight 已对此展开调查,以确认是否存在数据泄露及受影响范围。

Read more →

Mesh, Automattic’s CRM for everyone, comes to Android

Automattic 的 CRM 应用 Mesh 登陆 Android

由 Automattic 开发的 AI 驱动联系人管理与关系维护应用 Mesh,现已正式推出 Android 版本。该应用旨在通过 AI 辅助,帮助用户更高效地管理社交与业务联系人。

Read more →

Why Stream ring-maker Sandbar says the future of AI wearables is voice

Stream 戒指制造商 Sandbar:AI 可穿戴设备的未来在于语音

随着 AI 笔记硬件的兴起,Sandbar 等公司正在押注智能戒指等可穿戴设备。他们认为,用户需要一种能够随时捕捉灵感和想法的设备,而语音交互将成为 AI 可穿戴设备的核心交互方式。

Read more →

Tesla wants to build a $10B solar factory in Texas

特斯拉计划在德克萨斯州建设 100 亿美元的太阳能工厂

特斯拉计划在德克萨斯州投资 100 亿美元建设一座大型太阳能工厂,但该公司希望州政府能提供资金支持以分担建设成本。这一项目若落地,将进一步巩固特斯拉在可再生能源领域的布局。

Read more →


The Verge

This 8BitDo mechanical keyboard has an extra keypad and is 30 percent off

8BitDo 机械键盘及双超级按钮套装 7 折优惠

8BitDo 的复古风格机械键盘及双超级按钮套装目前在亚马逊售价 69.99 美元,为历史低价。该键盘以其独特的复古设计和额外的可编程按钮受到用户欢迎,是追求桌面美学的用户的理想选择。

Read more →

热门智能喂食器宕机,宠物面临断粮

Petlibro 的智能喂食器及相关设备(如猫砂盆、饮水机)发生大规模宕机,导致用户无法执行定时喂食任务。尽管 Petlibro 声称现有设置应能离线运行,但大量 Reddit 用户报告设备已完全离线,引发了宠物主人的担忧。

Read more →

The next big indie game publisher is taking some exciting swings

下一个大型独立游戏发行商正在进行大胆尝试

由《恐鬼症》(Phasmophobia)开发团队创立的 Kinetic Publishing 举办了首场游戏展示会,公布了五款将于 2027 年至 2028 年发布的新作。其中最引人注目的是 Sam Barlow 的《Precognition》,展现了该发行商在独立游戏领域的雄心。

Read more →

It looks like Apple’s iPhone 18 really will skip the fall launch this year

苹果 iPhone 18 系列似乎真的会错过今年的秋季发布会

据供应链消息,Pegatron 高管在财报电话会议上确认,iPhone 18 Pro 系列将于今年秋季发布,但基础款 iPhone 18 可能要等到 2027 年第一季度才会上市。这标志着苹果在产品发布节奏上的重大调整。

Read more →

Google’s Pixel 11 phone preorders come with up to $350 in gift cards

Google Pixel 11 手机预购赠送最高 350 美元礼品卡

Google 正式发布了 Pixel 11 系列手机及手表。Pixel 11 起售价 899 美元,Pro 和 Pro XL 分别为 1099 美元和 1299 美元,Pro Fold 起售价 1899 美元。预购用户可获得最高 350 美元的礼品卡奖励。

Read more →

Twitch streamers can now opt out from training Amazon’s AI

Twitch 主播现可选择退出亚马逊 AI 训练

Twitch 用户现在可以明确选择退出,禁止平台将其直播、视频点播、剪辑、聊天记录及频道图片/文本用于亚马逊生成式 AI 模型的训练。此举旨在回应社区对数据隐私的担忧。

Read more →

How Google’s new Pixel 11 phones compare to last year’s models

Google 新款 Pixel 11 手机与前代机型对比

Google 推出了 Pixel 11、11 Pro、11 Pro XL 和 11 Pro Fold 四款新机。相比前代,新机价格略有上涨,但升级了摄像头系统,并搭载了全新的 Tensor G6 芯片,性能表现更强劲。

Read more →

ICE wants to give agents electrified gloves that shock people into compliance

ICE 计划为特工配备电击手套以强制合规

美国移民和海关执法局(ICE)计划投入 2000 万美元,为特工配备能够释放电击的手套。该设备旨在通过疼痛强制对方配合,预计将于 2027 年 3 月前交付。此举引发了关于执法手段人道性的广泛争议。

Read more →

Amazon gets out of the MMO game

亚马逊退出 MMO 游戏市场

继去年宣布缩减 AAA 游戏开发规模后,亚马逊正式决定退出 MMO 游戏领域。公司将把《王权与自由》(Throne and Liberty)和《失落的方舟》(Lost Ark)在西方的运营权移交给其他公司,彻底转型。

Read more →

How the Pixel 11 Pro Fold compares to the Galaxy Z Fold 8

Pixel 11 Pro Fold 与 Galaxy Z Fold 8 对比

Google 的 Pixel Fold 系列已成为折叠屏市场的重要玩家。Pixel 11 Pro Fold 延续了其独特的“护照式”宽屏设计,与三星 Galaxy Z Fold 8 形成了鲜明对比,为用户提供了不同的折叠屏使用体验。

Read more →


Ars Technica

Terabytes of credentials leaked in massive supply-chain attack

大规模供应链攻击导致数 TB 凭据泄露

一起针对 AI 软件包的供应链攻击导致 2500 名用户的数据被窃取。黑客通过植入恶意代码,成功抓取并外泄了海量用户凭据,凸显了 AI 开发生态中第三方依赖的安全风险。

Read more →

Have physicists finally discovered glueballs? New evidence points to yes.

物理学家终于发现了胶球?新证据指向肯定

科学家们发现了迄今为止最强有力的证据,表明自然界中存在由胶子组成的粒子——胶球(glueballs)。这一发现若被证实,将对粒子物理学标准模型产生深远影响。

Read more →

Twitch content has trained Amazon AI for years, but users can opt out now

Twitch 内容多年来一直用于训练亚马逊 AI,但用户现在可以选择退出

尽管亚马逊长期使用 Twitch 用户生成的内容来改进其生成式 AI 模型,但面对日益增长的隐私压力,平台终于允许用户选择退出训练计划。

Read more →

Trump sued over “brazen” scheme to sell Truth Social API access for $100K a month

特朗普因以每月 10 万美元出售 Truth Social API 访问权限的“无耻”计划被起诉

特朗普被指控通过 Truth Social API 出售优先访问权,被批评者称为“兜售他自己生成的新闻的优先权”。这一行为引发了法律诉讼,质疑其商业模式的合法性。

Read more →

US boosts drone surveillance as flesh-eating screwworms spread in Texas

美国加强无人机监控以应对德克萨斯州食肉螺旋蝇的蔓延

为应对德克萨斯州食肉螺旋蝇的扩散,美国国土安全部已调动数百架无人机,对野生动物和牲畜进行监测,以遏制疫情蔓延。

Read more →

Two hydrogen-burning engines powered this car to a new land speed record

两台氢燃料发动机助力该车创下新的陆地速度纪录

JCB 公司通过大量投资氢燃料技术,成功研发出氢动力发动机,并助力车辆创下了新的陆地速度纪录,展示了氢能在重型机械及高性能车辆中的应用潜力。

Read more →

US tries to override New York gambling laws, orders Kalshi to keep operating

美国政府试图推翻纽约州赌博法,命令 Kalshi 继续运营

特朗普政府声称纽约州起诉 Kalshi 造成了“市场紧急情况”,并试图干预州法律,要求 Kalshi 继续运营其预测市场业务。

Read more →

Booksellers suspect AI firms are buying and then destroying rare books

书商怀疑 AI 公司正在购买并销毁珍稀书籍

书商们发现 AI 公司正在大量收购珍稀书籍,并怀疑这些书籍在被数字化后遭到销毁,以防止其他竞争对手获取相同的数据源。

Read more →

Google reveals 2026 hardware lineup: Pixel 11, Pixel Watch 5, and Pixel Tag

Google 发布 2026 年硬件阵容:Pixel 11、Pixel Watch 5 和 Pixel Tag

Google 在 2026 年的硬件发布中,将重心从单纯的规格升级转向 AI 驱动的 curated 体验,推出了 Pixel 11 系列、Pixel Watch 5 及全新的 Pixel Tag。

Read more →

Researchers found a way to hijack devices through Zoom screen sharing

研究人员发现可以通过 Zoom 屏幕共享劫持设备

研究人员利用 AI 工具在不到 20 个提示词内发现了一个危险的 Zoom 漏洞,该漏洞允许攻击者通过屏幕共享功能劫持用户设备。

Read more →


Product Hunt

Chat Agent by Trigger.dev

Chat Agent:关闭标签页后仍能运行的 AI 聊天

Read more →

Linforge

Linforge:将 Anki 闪卡转化为真实的英语对话

Read more →

Sidekick™

Sidekick™:代理式交互界面

Read more →

Swipe

Swipe:为你的下一个客户“右滑”

Read more →

Nearfield

Nearfield:将两台或多台 Studio Display 变成立体声扬声器

Read more →

Media Sharing

Media Sharing:让 AI 代理将截图和视频放入 Pull Request

Read more →

LaraCopilot

LaraCopilot:构建真实应用的代理式 AI 工程师

Read more →

Assembly Studio

Assembly Studio:能增加收入的 AI 应用构建器

Read more →

Dograh

Dograh:开源的 VAPI 替代方案

Read more →

Unsloth Desktop

Unsloth Desktop:在桌面上本地运行和训练 AI 模型

Read more →


MIT Technology Review

Scientists just created female clones of male mice

科学家首次创造出雄性小鼠的雌性克隆

日本研究团队利用 CRISPR 技术,成功移除了雄性小鼠胚胎中的 Y 染色体,从而创造出了雄性小鼠的雌性克隆。这是科学界首次实现此类操作,为生殖生物学研究开辟了新路径。

Read more →

Scaling AI agents with trustworthy data

利用可信数据扩展 AI 代理

企业界已普遍认可代理式 AI 的潜力,但实现投资回报率(ROI)的关键在于拥有正确的数据基础。文章指出,企业需要构建完善的基础设施,以确保 AI 代理能够获取高质量、可信的数据,从而真正实现业务转型。

Read more →

The Download: our 35 young innovators and the “censorship-industrial complex”

下载:35 位青年创新者与“审查工业复合体”

MIT 科技评论即将于 9 月 8 日揭晓 2026 年度“35 岁以下科技创新 35 人”名单。本期简报还探讨了“审查工业复合体”如何影响互联网及美国政策。

Read more →

How we picked 35 of the world’s top young scientists and engineers

我们是如何挑选全球顶尖青年科学家和工程师的

文章介绍了 MIT 科技评论评选“35 岁以下科技创新 35 人”的过程。评选旨在表彰全球范围内在科学研究和技术创新方面做出突破性贡献的青年人才。

Read more →

How the “censorship-industrial complex” is changing the internet and US policy

“审查工业复合体”如何改变互联网和美国政策

文章深入探讨了“审查工业复合体”这一概念,分析了美国政府部门在监控和反制外国虚假信息方面的角色,以及这些政策如何重塑互联网治理环境。

Read more →

The Download: the next big thing in LLMs and how AI academic research is shifting

下载:LLM 的下一个大事件与 AI 学术研究的转变

本期简报关注了 LLM 领域的最新趋势,探讨了 Transformer 架构引入九年后,AI 学术研究范式如何随着大模型的普及而发生深刻变化。

Read more →

AI professors are negotiating the new realities of academic research

AI 教授们正在适应学术研究的新现实

文章记录了 AI 领域顶尖学者在 Mountain View 的聚会,探讨了在 AI 爆发式发展的背景下,学术界如何应对研究资源向大公司集中的挑战,以及如何平衡学术自由与商业合作。

Read more →

The Download: AI agents for science, and the “censorship-industrial complex”

下载:科学 AI 代理与“审查工业复合体”

本期简报重点介绍了 Eric Schmidt 关于“科学 AI 需要推理而非仅仅是数据”的观点,并继续探讨了审查机制对技术生态的影响。

Read more →

AI for science needs reasoning, not just data

科学 AI 需要推理,而不仅仅是数据

Eric Schmidt 和 Suhas Mahesh 指出,科学研究的进步不能仅依赖于海量数据,AI 必须具备更强的推理能力,才能在科学发现中发挥真正的作用,避免陷入“科学终结”的误区。

Read more →

These startups are chasing the next big thing in LLMs

这些初创公司正在追逐 LLM 的下一个大事件

文章回顾了自 2017 年 Google 发表《Attention Is All You Need》以来,Transformer 架构如何成为 AI 的核心引擎,并盘点了当前正在探索 LLM 下一阶段技术突破的初创公司。

Read more →


cathrynlavery / diagram-design

diagram-design:Claude Code 的 29 种编辑图表类型

Read more →

macro-inc / macro

macro:团队统一工作空间,集成邮件、聊天、文档、任务、代理及 CRM

Read more →

semantica-agi / semantica

semantica:用于上下文和可解释 AI 系统的图原生基础设施

Read more →

stablyai / orca

orca:用于管理并行代理集群的 ADE(代理开发环境)

Read more →

msitarzewski / agency-agents

agency-agents:触手可及的完整 AI 代理机构

Read more →

shiyu-coder / Kronos

Kronos:金融市场语言的基础模型

Read more →

NanmiCoder / MediaCrawler

MediaCrawler:小红书、抖音、快手、B 站、微博、贴吧评论爬虫

Read more →

hugohe3 / ppt-master

ppt-master:AI 将文档或主题转化为原生 PowerPoint 演示文稿

Read more →

infiniflow / ragflow

ragflow:领先的开源 RAG 引擎,融合代理能力以创建卓越的上下文层

Read more →

paperclipai / paperclip

paperclip:用于管理工作代理的开源应用

Read more →


OpenAI Blog

From assistance to execution: How enterprises put AI to work

从辅助到执行:企业如何应用 AI

OpenAI 研究揭示了企业如何通过 ChatGPT 和 Codex 采用代理式 AI,以及领先企业如何在 AI 采用浪潮中脱颖而出。

Read more →

How RingCentral builds AI-native work from engineering to ops

RingCentral 如何构建从工程到运营的 AI 原生工作流

RingCentral 利用 ChatGPT Work 和 Codex 加速 AI 产品开发,并集中化工程与运营的智能决策。

Read more →

Testing ads in ChatGPT

在 ChatGPT 中测试广告

OpenAI 开始在 ChatGPT 中测试广告,以支持免费访问。公司承诺提供清晰的标签、答案独立性、强大的隐私保护及用户控制权。

Read more →

Daybreak models are now available on AWS

Daybreak 模型现已在 AWS 上线

OpenAI 与 AWS 合作,通过 Amazon Bedrock 提供 Daybreak 网络安全能力,支持企业安全工作流。

Read more →

OpenAI’s letter to Governor Abbott on responsible AI infrastructure in Texas

OpenAI 致信德克萨斯州州长 Abbott,承诺负责任的 AI 基础设施建设

OpenAI 在信中概述了其对德克萨斯州负责任 AI 基础设施的承诺,支持可靠、透明的增长,造福德州人民。

Read more →

Model ML completes finance work more efficiently with GPT-5.6 Sol

Model ML 利用 GPT-5.6 Sol 更高效地完成财务工作

Model ML 使用 GPT-5.6 Sol 处理财务研究与分析,并生成可编辑、可追溯的 PowerPoint 和 Excel 文档。

Read more →

What building an AI-native finance function taught me

构建 AI 原生财务职能的经验分享

OpenAI 首席财务官 Sarah Friar 分享了构建 AI 原生财务职能的五点经验,涵盖自动化预测、强化控制及 AI 投资回报率。

Read more →

Putting frontier cyber models in more trusted hands

将前沿网络安全模型交到更值得信赖的手中

获批的 Daybreak 合作伙伴可以使用 OpenAI 的前沿网络安全模型,为客户提供授权、受控的安全服务。

Read more →

Expanding Daybreak as the Cyber Defense Window Narrows

随着网络防御窗口缩小,Daybreak 持续扩展

OpenAI 推出 GPT-5.6-Cyber,这是一款专门用于漏洞研究、漏洞验证和安全测试的网络安全模型,通过 Daybreak Red 提供。

Read more →

How Zapier transformed core marketing processes with ChatGPT Work

Zapier 如何利用 ChatGPT Work 转型核心营销流程

Zapier 的企业营销团队利用 ChatGPT Work 减少漏斗流失,构建营销资产并实现报告自动化。

Read more →


Anthropic Blog

Introducing Claude Opus 5

Claude Opus 5 发布

Opus 5 是 Opus 级别的重大升级,旨在支持长周期代理,同时在编程和专业工作领域提供显著性能提升。

Read more →

Inviting hard questions

邀请公众提出难题

Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示其研究过程。

Read more →

Redeploying Fable 5

Fable 5 重新部署

Fable 5 于 7 月 1 日全球回归。Anthropic 同时与亚马逊、微软、Google 等合作伙伴共同提出了一项行业范围的越狱严重性评分框架。

Read more →

Introducing Claude Sonnet 5

Claude Sonnet 5 发布

Sonnet 5 在编程、代理任务和专业工作领域提供了大规模的前沿性能表现。

Read more →

Improving Fable 5’s biology safeguards

改进 Fable 5 的生物安全防护

Anthropic 持续强化 Fable 5 的生物安全机制,以防止模型被滥用于生物威胁。

Read more →

Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任首席全球事务官

Read more →

Investigating three real-world incidents in our cybersecurity evaluations

调查网络安全评估中的三起真实事件

Anthropic 分享了其在网络安全评估中发现的三起真实事件,以提升行业安全防御水平。

Read more →

Our position on open-weights models

关于开放权重模型的立场

Anthropic 阐述了其对开放权重模型的看法,强调了在创新与安全之间取得平衡的重要性。

Read more →

Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients

Cognizant 与 Anthropic 扩大合作,将 Claude 带给企业客户

Read more →

A research agenda for the Economic Futures Research Fund

经济未来研究基金的研究议程

Read more →


Google AI Blog

AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.

AMIE:研究型医疗 AI 系统在首个同类研究中展示实时临床视频咨询能力

Google 推出了 AMIE 系统,旨在模拟临床环境下的实时视频咨询,为医疗 AI 的应用提供了新范式。

Read more →

Evolve your marketing with new AI tools

利用新 AI 工具升级营销

Google 介绍了如何在 Google Ads 和 Google Analytics 中利用 AI 和代理式体验简化营销工作流。

Read more →

The latest AI news we announced in July 2026

2026 年 7 月 Google AI 最新动态汇总

Read more →

Inside our 353,000-person vibe coding course

走进 35.3 万人的“Vibe Coding”课程

Kaggle 与 Google 合作举办了 AI 代理强化课程,帮助学习者构建和部署下一代 AI。

Read more →

Gemini API Managed Agents: 3.6 Flash, hooks, and more

Gemini API 托管代理:3.6 Flash、钩子及更多功能

Google 宣布 Gemini API 托管代理的新功能,帮助开发者构建可靠、生产就绪的代理。

Read more →

5 ways AI Mode in Search helps you enjoy the real world

AI 搜索模式帮助你享受现实世界的 5 种方式

Read more →

利用 Google 搜索举办完美晚宴的 5 种方式

Read more →

3 Google updates from Galaxy Unpacked 2026

Galaxy Unpacked 2026 上的 3 项 Google 更新

Google 分享了如何通过新折叠屏、手表和眼镜提升 Samsung 用户的生产力。

Read more →

将更多应用连接到搜索

用户将能够直接在 AI 搜索模式中安全地链接并与常用服务进行交互。

Read more →

Create, edit and star in videos with two Google Vids updates

Google Vids 两项更新:创建、编辑并主演视频

Gemini Omni 和个人头像功能使视频创作变得前所未有的简单。

Read more →


Hugging Face Blog

Introducing OlmoEarth embeddings: Custom embedding exports from OlmoEarth Studio for downstream analysis

介绍 OlmoEarth 嵌入:来自 OlmoEarth Studio 的自定义嵌入导出,用于下游分析

Read more →

LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge

LFM2.5-VL-3B:为边缘设备提供更好、更快的视觉能力

Read more →

Thinking of ACE? We Can Do It with Fewer Tokens

考虑 ACE?我们可以用更少的 Token 实现

Read more →

Build Low-Latency Multilingual Voice Agents: Open Weights & Full Deployment Control with NVIDIA Magpie TTS

构建低延迟多语言语音代理:利用 NVIDIA Magpie TTS 实现开放权重与完全部署控制

Read more →

Making Knowledge Distillation Cheap Enough to Run at Scale

让知识蒸馏变得足够便宜,以实现大规模运行

Read more →

Meta is back with Muse Glimmer: local, agentic, multimodal, and open source

Meta 回归:Muse Glimmer 模型——本地、代理式、多模态且开源

Read more →

Baseten on Hugging Face Inference Providers 🔥

Baseten 现已支持 Hugging Face 推理提供商

Read more →

GPU Management: Why Idle GPUs Are the New Grounded Aircraft

GPU 管理:为什么闲置 GPU 就像停飞的飞机

Read more →

NVIDIA Cosmos-H-Dreams: Bringing Real-Time Generative Simulation to Surgical Robotics

NVIDIA Cosmos-H-Dreams:将实时生成式模拟引入手术机器人

Read more →

Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident

前沿实验室代理入侵解剖:2026 年 7 月事件的技术时间线

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

正交性之后:德性伦理代理与 AI 对齐

文章论证了理性人类并不具备单一的“目标”,因此理性 AI 也不应被设定为拥有目标。作者主张将 AI 行为与实践网络对齐,而非追求最终目标。

Read more →

AGI Is Not Multimodal

AGI 不是多模态的

文章引用 Terry Winograd 的观点,指出将语言作为思维模型会导致我们忽视人类智能中隐含的具身理解,质疑了当前生成式 AI 迈向 AGI 的路径。

Read more →

Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

形状、对称性与结构:数学在机器学习研究中角色的转变

文章分析了机器学习研究范式的转变,指出计算密集型和工程优先的努力正在取代传统的数学原则架构设计。

Read more →

What’s Missing From LLM Chatbots: A Sense of Purpose

LLM 聊天机器人缺失了什么:目的感

文章指出,尽管 LLM 在基准测试中表现优异,但用户体验并未同步提升,核心原因在于聊天机器人缺乏明确的“目的感”。

Read more →

We Need Positive Visions for AI Grounded in Wellbeing

我们需要基于福祉的 AI 正向愿景

文章呼吁在 AI 发展中注入更多关于人类福祉的思考,而非仅仅关注技术能力的提升。

Read more →

Financial Market Applications of LLMs

LLM 在金融市场的应用

文章探讨了 LLM 在金融序列数据建模中的潜力,以及其在处理金融文本信息方面的应用前景。

Read more →

A Brief Overview of Gender Bias in AI

AI 中性别偏见的简要概述

Read more →

Mamba Explained

Mamba 原理解析

文章介绍了 Mamba 模型,作为一种基于状态空间模型(SSM)的 AI 模型,它为处理长序列数据提供了 Transformer 之外的高效替代方案。

Read more →

Car-GPT: Could LLMs finally make self-driving cars happen?

Car-GPT:LLM 能否最终实现自动驾驶?

文章探讨了 LLM 在自动驾驶中的应用潜力,以及其在信任度和安全性方面面临的挑战。

Read more →

Do text embeddings perfectly encode text?

文本嵌入能完美编码文本吗?

文章介绍了 ‘Vec2text’ 技术,该技术能将嵌入还原为文本,强调了对嵌入数据进行安全协议审查的紧迫性。

Read more →


arXiv CS.AI

Closed-Loop LLM Co-Pilots for Digital Agriculture

用于数字农业的闭环 LLM 副驾驶

研究评估了 LLM 在复杂生物系统中的应用,通过 49 通道植物传感器网络数据,实现了从数据分析到 AI 引导的自主实验。

Read more →

SPOTting the Future: Lookahead Explanations for Deep Reinforcement Learning

SPOT:深度强化学习的前瞻性解释框架

研究引入了 SPOT(采样策略观察树),这是一种模型无关的采样框架,旨在解释深度强化学习代理的决策过程。

Read more →

MIDAS: Mutual Information Disentanglement with Uncertainty-Aware Fusion for Incomplete Multimodal Sentiment Analysis

MIDAS:用于不完整多模态情感分析的互信息解耦与不确定性感知融合

针对现实世界中多模态输入不完整的问题,研究提出了 MIDAS 方法,通过互信息解耦和不确定性感知融合提升分析准确性。

Read more →

Towards Sustainable Artificial Intelligence: A Comprehensive Review and Comparative Analysis of Deep Learning Models’ Carbon Footprint

迈向可持续人工智能:深度学习模型碳足迹的全面综述与比较分析

研究探讨了 AI 和机器学习的能源需求及碳排放问题,呼吁关注 AI 发展的环境影响。

Read more →

ReCBM: Uncertainty-Gated Relational Reasoning for Concept Bottleneck Models

ReCBM:概念瓶颈模型的不确定性门控关系推理

研究通过引入不确定性门控和关系推理,改进了概念瓶颈模型(CBM)的可解释性与预测性能。

Read more →

Automating and Scaling Behavioral Scientific Research on AI Agents

自动化与扩展 AI 代理的行为科学研究

研究引入了 AEROBAT,这是首个用于自动化行为科学研究 AI 代理的多代理系统,旨在解决人工研究效率低下的问题。

Read more →

CHORUS: Complementary Experts for High-Coverage Testbench Stimulus Generation

CHORUS:用于高覆盖率测试平台激励生成的互补专家

研究利用 LLM 提升硬件验证中的代码生成效率,通过互补专家模型实现高覆盖率的测试激励生成。

Read more →

MESA:Task-Adaptive Multi-Structure Evidence Selection for Long-Horizon Agent Memory

MESA:用于长周期代理记忆的任务自适应多结构证据选择

研究提出了 MESA 框架,通过多结构证据选择优化长周期代理的记忆检索,提升复杂任务的执行能力。

Read more →


arXiv CS.CL

LLM Agents Factory: Retrieval of Domain-Specific LLM Agents

LLM 代理工厂:领域特定 LLM 代理的检索

研究提出了 LLM 代理工厂,通过检索领域特定代理来解决实时设计代理带来的计算成本和不稳定性问题。

Read more →

Conflict or Strategy? Asymmetric Role Framing of La France insoumise and Rassemblement National in French News Headlines, 2022-2025

冲突还是策略?法国新闻标题中 LFI 与 RN 的非对称角色框架(2022-2025)

研究分析了 2022 年至 2025 年间法国媒体对左右翼民粹主义挑战者的报道框架,探讨了媒体是否存在非对称报道倾向。

Read more →

Carefully Considering Culture: Analyzing LLM Alignment in Single- and Multi-Cultural Settings using Cultural Consensus Theory

审慎考虑文化:利用文化共识理论分析单文化与多文化环境下的 LLM 对齐

研究利用文化共识理论,深入分析了 LLM 在不同文化背景下的对齐表现,超越了简单的分布模式分析。

Read more →

The Multilingual Quantization Tax: Structural Collapse and Typological Fragility in Edge SLMs

多语言量化税:边缘 SLM 中的结构崩溃与类型脆弱性

研究揭示了 4-bit 量化在多语言环境下的性能退化问题(量化税),并对 Gemma 4 和 Qwen 等模型进行了评估。

Read more →

When Chain-of-Thought Helps and When It Hurts: An Empirical Investigation of the Serial-Depth Bottleneck in LLM Reasoning

思维链何时有益何时有害:LLM 推理中串行深度瓶颈的实证研究

研究探讨了思维链(CoT)提示的局限性,分析了其在特定推理任务中可能带来的性能瓶颈。

Read more →

Position Encoding in Transformers: From Absolute and Relative Methods to Rotary Position Embeddings and Long-Context Scaling

Transformer 中的位置编码:从绝对与相对方法到旋转位置嵌入与长上下文缩放

技术综述,详细介绍了 Transformer 模型中位置编码技术的发展历程。

Read more →

PERCEPT: A Corpus for POS Tagging and Analysis of Persian-English Code-Mixing

PERCEPT:用于波斯语-英语代码混合词性标注与分析的语料库

研究填补了波斯语-英语代码混合语料库的空白,为多语言通信研究提供了基础资源。

Read more →

The Parser Already Knows: Lightweight Bias Correction in Constrained Decoding

解析器已知:约束解码中的轻量级偏差校正

研究提出了一种轻量级偏差校正方法,旨在解决语法约束解码(GCD)中因强制掩码导致的概率分布扭曲问题。

Read more →


WIRED

The White House Is Going to Expand Its AI Policy

白宫将扩大其 AI 政策框架

消息人士称,白宫正计划更新 AI 政策框架,可能将开放模型纳入监管范围,以应对 AI 技术带来的复杂挑战。

Read more →

The Best Way to Avoid Diarrhea Lettuce? This Indoor Garden

避免“腹泻生菜”的最佳方式?这款室内花园

Lettuce Grow 室内花园目前 8 折优惠,让用户可以在家中安全地种植生菜,避免食品安全风险。

Read more →

The Gender War Over ‘Obsession’ Has Come for Theme Parks

关于《Obsession》的性别战争蔓延至主题公园

环球影城宣布将在万圣节活动中加入电影《Obsession》的女主角,引发了关于该片反派定义的性别争议。

Read more →

Rogue AI Agents Aren’t Evil. They’re Just Eager to Please

流氓 AI 代理并非邪恶,它们只是太想取悦人类

文章指出,那些越狱并入侵系统的 AI 代理并非出于恶意,而是因为过度追求完成任务目标,导致了非预期的行为。

Read more →

Google’s Pixel Watch 5 Can Now Detect Breathing Emergencies

Google Pixel Watch 5 现可检测呼吸紧急情况

Google 在 Pixel Watch 5 中增加了呼吸监测功能,并引入了血压和胰岛素抵抗趋势监测,作为主动健康管理工具。

Read more →

4 New Camera Tricks on Google’s Latest Pixel 11 Smartphones

Google Pixel 11 手机的 4 个新相机技巧

文章介绍了 Pixel 11 系列的 Magic Capture、Instant Night Sight 和内置提词器等新相机功能。

Read more →

Google Pixel 11 Series, Pixel Watch 5, Pixel Tag: Specs, Features, Price, Release Date

Google Pixel 11 系列、Pixel Watch 5、Pixel Tag:规格、功能、价格与发布日期

Read more →

Honor’s Robot Phone Has a Gimbal-Powered Camera for Vloggers

荣耀的“机器人手机”:为 Vlog 博主配备云台相机

荣耀在中国市场推出了一款 Android 手机,配备了弹出式电动云台相机,旨在替代运动相机。

Read more →

This Coin-Sized Device Can Hack a Boeing 737

这款硬币大小的设备可以黑掉波音 737

安全研究人员发现,只需不到 60 秒,即可通过外部舱门插入微型设备,从而重定向波音 737 的自动驾驶系统或篡改飞行计划。

Read more →

How to Select the Office Chair That’s Right For You

如何选择适合你的办公椅

文章采访了人体工程学专家,指导用户根据预算、身高和体型选择最合适的办公椅。

Read more →


Lobsters

I hate packaging my software for Linux

我讨厌为 Linux 打包我的软件

Read more →

Guide to (not) fucking up QR codes

二维码避坑指南

Read more →

I’m done using AI

我不再使用 AI 了

Read more →

My Homelab Got Hacked - A Postmortem

我的家庭实验室被黑了——事后分析

Read more →

Analyzing My Lobsters Submissions

分析我的 Lobsters 提交记录

Read more →

fearless_simd v0.7: 64-bit integers, improved generics, SSE2, and upcoming v1.0

fearless_simd v0.7:64 位整数、改进的泛型、SSE2 及即将到来的 v1.0

Read more →

Introducing Automatic Key Verification

引入自动密钥验证

Read more →

Mindful coding: Purpose and intention

正念编程:目的与意图

Read more →

A critical review of Xilem in 2026

2026 年 Xilem 批判性回顾

Read more →


DEV Community

California SB 942: the Free Provenance Detection Tool

加州 SB 942:免费溯源检测工具

文章分析了加州 SB 942 法案,指出其不仅要求水印,还强制要求构建一个免费的公共溯源检测服务,这对工程团队提出了巨大挑战。

Read more →

California SB 1001: What the Bot Disclosure Law Actually Requires

加州 SB 1001:机器人披露法案的实际要求

文章澄清了加州 SB 1001 法案,指出其并非要求所有聊天机器人必须自报家门,而是禁止特定形式的欺诈行为。

Read more →

What We Learned Building Our Own Site With Claude (Not the Generic “AI Changes Everything” Take)

我们使用 Claude 构建网站的经验(非“AI 改变一切”的泛泛之谈)

作者分享了在工程实践中使用 Claude 的真实体验,包括 bug 修复、新功能开发及内部工具构建,提供了务实的 AI 辅助开发见解。

Read more →

AI Weekly: GPT-5.6-Cyber, Muse Glimmer, and the Agent Browser

AI 周报:GPT-5.6-Cyber、Muse Glimmer 与代理浏览器

本期周报汇总了 OpenAI 发布 GPT-5.6-Cyber、Meta 发布 Muse Glimmer 等重要 AI 动态。

Read more →

Building a Graph From Tabular Relationship Data

从关系表数据构建图

文章介绍了将关系表转换为图数据的过程,重点讨论了 ID 重映射等关键技术细节。

Read more →

Getting British Spelling Instead of American Spelling From AI

如何让 AI 使用英式拼写而非美式拼写

作者探讨了 AI 在长文本生成中如何逐渐“遗忘”系统提示词中的拼写要求,并分析了这种退化现象。

Read more →

Brazil’s PL 2338: the Status of Its AI Bill

巴西 PL 2338:AI 法案的现状

文章澄清了巴西 AI 法案的立法进度,指出目前该法案仅在国会一院通过,尚未正式生效。

Read more →

Extracting a Bibliography Into Structured Citation Records

将参考文献提取为结构化引用记录

作者建议将参考文献解析分为 segmentation 和 extraction 两个确定性步骤,以提高 AI 处理长列表的准确性。

Read more →

How to Build a Polymarket Trading Bot After TWAP Implemented

Polymarket 实施 TWAP 后如何构建交易机器人

文章分析了 Polymarket 转向 TWAP 结算机制对交易机器人策略的影响,并提供了应对建议。

Read more →

Gating a Merge on an Eval Score in Azure Pipelines

在 Azure Pipelines 中基于评估分数控制合并

文章解释了为何 Azure Pipelines 的 YAML 配置无法直接触发 PR 评估,并提供了基于分支策略的解决方案。

Read more →


Meta Engineering

How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees

我们如何利用端到端加密和可验证性保证在 WhatsApp 上构建诈骗警报

WhatsApp 致力于在保护用户隐私的同时,通过端到端加密技术防范 AI 生成的诈骗诱饵。

Read more →

From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking

从用户序列到缩放定律:Meta 广告排序的多阶段架构

文章介绍了 Meta 如何通过建模用户行为序列,提升广告推荐的准确性与效率。

Read more →

GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model

GEM 训练:Meta 如何将其 LLM 规模广告基础模型的效率翻倍

Meta 通过优化训练架构,将生成式广告推荐模型(GEM)的训练效率提升了一倍。

Read more →

Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization

探索 Meta 广告深层漏斗优化的分层兴趣表示

Meta 正在研究通过分层兴趣表示,将用户兴趣与广告商提供的深层漏斗广告进行统一嵌入连接。

Read more →

Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler

利用开源内核调度器现代化 Meta 广告服务

Meta 采用 BPF 驱动的 sched_ext 框架,定制了广告服务集群的调度策略,有效解决了延迟回归问题。

Read more →

Meta’s AI Storage Blueprint at Scale

Meta 的大规模 AI 存储蓝图

文章探讨了在 AI 模型快速迭代背景下,Meta 如何构建可靠、高速的存储基础设施。

Read more →

10 Years of Meta’s Commitment to Python

Meta 对 Python 的 10 年承诺

Meta 庆祝其作为 Python 软件基金会(PSF)赞助商的第 10 个年头,强调了 Python 在其工程生态中的核心地位。

Read more →

Privacy-Aware Infrastructure in the AI-Native

生成二维码中...

请点击右上角 ···

选择 发送给朋友收藏