2026-08-13
今日要点
- AI 代理生态爆发:从 Anthropic 的 Cowork 到 Meta 的 Muse Glimmer,AI 代理正从辅助工具向具备自主执行能力的“工作伙伴”演进,企业级应用与本地化部署成为核心趋势。
- 硬件与基础设施升级:Google 发布 Pixel 11 系列及 Pixel Watch 5,强化 AI 影像与健康监测;同时,AI 算力需求推动了存储架构与云基础设施的深度变革。
- 安全与合规挑战:随着 AI 深度参与代码生成与企业决策,针对 AI 模型的攻击(如供应链攻击)及数据隐私合规问题(如 Twitch 训练数据争议)引发行业高度关注。
- 科研与前沿突破:科学家首次成功将雄性小鼠胚胎转化为雌性克隆,AI 在科学发现(如气象预测、生物学研究)中的应用正不断刷新边界。
Hacker News
Tailscale Traces Database Corruption to 16y/o SQLite WAL-Reset Bug
Tailscale 追踪到数据库损坏源于 16 年前的 SQLite WAL 重置漏洞
Tailscale 近期经历了长期的服务不稳定,经过数月的深度取证,团队最终定位到问题的根源在于 SQLite 内部一个潜伏长达 16 年的 WAL(预写式日志)重置漏洞。该漏洞导致了数据库在特定条件下的损坏,严重影响了系统的正常运行。目前团队已确认并修复了该问题,服务稳定性得到显著提升。
AI is removing the middle class of software engineering?
AI 正在消灭软件工程的中产阶级吗?
文章探讨了 AI 对软件工程职业结构的影响。作者指出,过去资深工程师负责架构与代码质量,初级工程师通过 PR 学习成长。然而,随着 AI 自动生成代码能力的提升,这种传统的师徒传承模式正在瓦解,处于中间层级的工程师可能面临被 AI 取代的风险,软件开发团队的结构正面临重塑。
DeepSeek V4 Pro 0813
DeepSeek V4 Pro 0813 正式发布
DeepSeek V4 Pro 0813 是 DeepSeek 推出的最新大规模混合专家(MoE)模型,现已进入 GA(通用可用)阶段。该模型通过 OpenRouter 提供直接访问,旨在为用户提供高性能的 AI 推理能力。官方强调了其在成本控制和缓存优化方面的优势,以应对日益增长的商业需求。
License plate reader searches should require a warrant
车牌识别搜索应强制要求搜查令
作者基于在 Schmidt v City of Norfolk 案中担任专家证人的经验,呼吁对执法部门使用车牌识别(LPR)技术进行严格监管。他认为,尽管 LPR 是有效的警务工具,但大规模的监控行为侵犯了公民隐私,因此必须通过法律手段要求执法部门在进行此类数据搜索时必须获得搜查令。
Controversial creators are benefiting from monetization programs run by Meta
争议性创作者正从 Meta 的变现计划中获益
ABC News Verify 的调查显示,Meta 旗下的 Facebook 正在向包括新纳粹关联者和知名反疫苗人士在内的争议性内容创作者支付报酬。尽管 Meta 宣称有内容审核机制,但这些创作者的内容依然通过平台的变现计划获得了经济支持,引发了公众对平台责任和算法推荐机制的强烈质疑。
LinkedIn CringeBot 3000
LinkedIn 尴尬内容生成器 3000
这是一个针对 LinkedIn 平台上过度矫情、虚伪的职场博文进行讽刺的工具。该项目通过模拟那些典型的“职场成功学”语调,生成令人尴尬的帖子,旨在调侃当前社交媒体上泛滥的职场表演文化。
2026 Eclipse Webcams
2026 年日食网络摄像头
该项目汇总了全球范围内用于观测 2026 年日食的实时网络摄像头链接。通过该平台,天文爱好者可以跨越地理限制,实时观看这一罕见的天文现象,为全球用户提供了便捷的观测入口。
Qwen3.8-2.4T
Qwen3.8-2.4T 模型发布
Qwen 系列迎来重大更新,Qwen3.8-2.4T 模型已在 Hugging Face 上线。该模型采用了 FP8 量化技术,旨在平衡超大规模参数量与推理效率,为开发者提供更强大的多语言处理与逻辑推理能力。
llama.cpp
llama.cpp 本地化运行方案
llama.cpp 致力于让用户在本地设备上完全运行前沿 AI 模型,无需 API 密钥,无遥测数据,无使用限制。通过集成 pi-llama 插件,用户可以轻松实现本地模型的自动发现与部署,确保数据完全保留在个人设备上,实现了从笔记本电脑到集群的灵活扩展。
Grok 4.6
Grok 4.6 版本发布
Grok 4.6 在 4.5 版本的基础上进行了升级,重点优化了长周期代理(long-running agents)的性能,并增强了在复杂交互与视觉任务中的表现。该模型能够更好地处理多步骤任务,如深度研究、数据分析等,进一步提升了其在复杂工作流中的实用性。
Grok 4.6 scores 61 on the Artificial Analysis Intelligence Index
Grok 4.6 在人工智能分析指数中获得 61 分
Grok 4.6 在发布仅一个月后,其智能指数得分提升了 5 分,总分达到 61 分,与 GPT-5 持平。这一成绩标志着 SpaceXAI 成功重返人工智能前沿阵地,仅次于 Anthropic,显示出其在模型迭代速度和性能提升上的强劲势头。
Delta
Delta:AI 代理协作开发环境
Delta 是一个专为 AI 代理与人类开发者协作设计的多人开发环境。它将代码与对话上下文紧密连接,允许开发者在查看代理构建过程的同时进行实时协作与评审。目前该项目已开启私人内测,旨在解决 AI 辅助编程中上下文丢失的问题。
Show HN: Woxi - Open-source Mathematica / Wolfram Language reimplementation
Woxi:开源 Mathematica/Wolfram 语言重实现
Woxi 是一个用 Rust 编写的 Wolfram 语言解释器。它不仅提供了一个类似 Mathematica 的 GUI(Woxi Studio),还支持 CLI、Jupyter 内核、Python/npm 包及 WASM 模块。相比原版,Woxi 具有开源、启动速度极快等显著优势。
Why tiny JPEGs look different in Chrome
为什么微小的 JPEG 图片在 Chrome 中显示效果不同?
作者发现 Chrome 浏览器在渲染极小尺寸的 JPEG 图片时,显示效果与预期不符。经过调查,这并非渲染错误,而是 Chrome 采用的一种巧妙的 JPEG 解码优化策略。该策略在处理 15px 等极小尺寸图片时,为了视觉效果进行了特定调整,导致了与原图的细微差异。
What sort of maths are LLMs good at?
LLM 擅长什么样的数学?
文章探讨了大型语言模型在数学领域的表现。作者提到 OpenAI 近期在数学和理论计算机科学领域取得的重大突破,包括解决非索非群(non-sofic group)构造等难题。文章分析了 LLM 在处理形式化逻辑与数学证明时的能力边界,并对 AI 在推动数学研究方面的潜力进行了展望。
TechCrunch
Northrop’s robot space mechanic is a new way to keep satellites at work longer
诺斯罗普的机器人太空维修工:延长卫星寿命的新方案
诺斯罗普·格鲁曼公司的任务机器人飞行器(MRV)正在尝试为一颗老化的卫星安装新的推进器。这一创新技术旨在通过在轨维修延长卫星的使用寿命,减少太空垃圾的产生,并为卫星运营商提供了一种比发射新卫星更经济的维护选择。
Amazon will train on Twitch streamers’ content by default, unless they opt out
亚马逊将默认使用 Twitch 主播内容进行 AI 训练,除非用户选择退出
Twitch 首席产品官 Mike Minton 在直播中回应用户反馈时表示,亚马逊将默认使用 Twitch 主播的内容来训练其生成式 AI 模型。他坦言,如果采取“选择加入”模式,几乎没人会参与。目前平台已提供退出选项,允许主播禁止其直播、视频点播和聊天记录被用于 AI 训练。
Grubhub’s $24M FTC settlement is finally reaching diners and drivers
Grubhub 的 2400 万美元 FTC 和解金开始发放给用户和司机
Grubhub 因商业行为违规与联邦贸易委员会(FTC)达成 2380 万美元的和解协议,目前赔偿支票已开始寄送给受影响的订餐用户和外卖司机。此举标志着针对 Grubhub 商业行为调查的阶段性终结。
AI coding startup Cognition reportedly already in talks to raise at $40B valuation
AI 编程初创公司 Cognition 据传正以 400 亿美元估值寻求融资
在几个月前以 260 亿美元估值融资 10 亿美元后,AI 编程初创公司 Cognition 据传正在进行新一轮大规模融资谈判,估值高达 400 亿美元。这反映了资本市场对 AI 编程代理领域的高度追捧。
As AI safety concerns mount, three pioneers make the case for staying open
随着 AI 安全担忧加剧,三位先驱为“保持开放”辩护
在 Ai4 大会上,Geoffrey Hinton、李飞飞和吴恩达三位 AI 领域权威专家就 AI 监管、开源访问以及美国如何在全球竞争中保持领先地位展开了辩论。他们共同探讨了如何在确保安全的前提下,通过开放生态促进技术创新。
OpenAI-backed Thrive Holdings raises $2B to bring AI to the enterprise
OpenAI 支持的 Thrive Holdings 融资 20 亿美元,旨在将 AI 带入企业
Thrive Holdings 宣布完成 20 亿美元融资,估值达到 120 亿美元。投资方包括软银、D1 Capital Partners 和 Altimeter Capital。该公司致力于将先进的 AI 技术集成到企业工作流中,提升企业运营效率。
Uber Freight reportedly investigating after hacking group claims data breach
Uber Freight 遭黑客组织声称数据泄露,目前正在调查
一个以针对运输公司和私募股权公司为目标的勒索黑客组织声称对 Uber Freight 进行了攻击。Uber Freight 已对此展开调查,以确认是否存在数据泄露及受影响范围。
Mesh, Automattic’s CRM for everyone, comes to Android
Automattic 的 CRM 应用 Mesh 登陆 Android
由 Automattic 开发的 AI 驱动联系人管理与关系维护应用 Mesh,现已正式推出 Android 版本。该应用旨在通过 AI 辅助,帮助用户更高效地管理社交与业务联系人。
Why Stream ring-maker Sandbar says the future of AI wearables is voice
Stream 戒指制造商 Sandbar:AI 可穿戴设备的未来在于语音
随着 AI 笔记硬件的兴起,Sandbar 等公司正在押注智能戒指等可穿戴设备。他们认为,用户需要一种能够随时捕捉灵感和想法的设备,而语音交互将成为 AI 可穿戴设备的核心交互方式。
Tesla wants to build a $10B solar factory in Texas
特斯拉计划在德克萨斯州建设 100 亿美元的太阳能工厂
特斯拉计划在德克萨斯州投资 100 亿美元建设一座大型太阳能工厂,但该公司希望州政府能提供资金支持以分担建设成本。这一项目若落地,将进一步巩固特斯拉在可再生能源领域的布局。
The Verge
This 8BitDo mechanical keyboard has an extra keypad and is 30 percent off
8BitDo 机械键盘及双超级按钮套装 7 折优惠
8BitDo 的复古风格机械键盘及双超级按钮套装目前在亚马逊售价 69.99 美元,为历史低价。该键盘以其独特的复古设计和额外的可编程按钮受到用户欢迎,是追求桌面美学的用户的理想选择。
Cats and dogs are missing meals after a popular smart feeder went down
热门智能喂食器宕机,宠物面临断粮
Petlibro 的智能喂食器及相关设备(如猫砂盆、饮水机)发生大规模宕机,导致用户无法执行定时喂食任务。尽管 Petlibro 声称现有设置应能离线运行,但大量 Reddit 用户报告设备已完全离线,引发了宠物主人的担忧。
The next big indie game publisher is taking some exciting swings
下一个大型独立游戏发行商正在进行大胆尝试
由《恐鬼症》(Phasmophobia)开发团队创立的 Kinetic Publishing 举办了首场游戏展示会,公布了五款将于 2027 年至 2028 年发布的新作。其中最引人注目的是 Sam Barlow 的《Precognition》,展现了该发行商在独立游戏领域的雄心。
It looks like Apple’s iPhone 18 really will skip the fall launch this year
苹果 iPhone 18 系列似乎真的会错过今年的秋季发布会
据供应链消息,Pegatron 高管在财报电话会议上确认,iPhone 18 Pro 系列将于今年秋季发布,但基础款 iPhone 18 可能要等到 2027 年第一季度才会上市。这标志着苹果在产品发布节奏上的重大调整。
Google’s Pixel 11 phone preorders come with up to $350 in gift cards
Google Pixel 11 手机预购赠送最高 350 美元礼品卡
Google 正式发布了 Pixel 11 系列手机及手表。Pixel 11 起售价 899 美元,Pro 和 Pro XL 分别为 1099 美元和 1299 美元,Pro Fold 起售价 1899 美元。预购用户可获得最高 350 美元的礼品卡奖励。
Twitch streamers can now opt out from training Amazon’s AI
Twitch 主播现可选择退出亚马逊 AI 训练
Twitch 用户现在可以明确选择退出,禁止平台将其直播、视频点播、剪辑、聊天记录及频道图片/文本用于亚马逊生成式 AI 模型的训练。此举旨在回应社区对数据隐私的担忧。
How Google’s new Pixel 11 phones compare to last year’s models
Google 新款 Pixel 11 手机与前代机型对比
Google 推出了 Pixel 11、11 Pro、11 Pro XL 和 11 Pro Fold 四款新机。相比前代,新机价格略有上涨,但升级了摄像头系统,并搭载了全新的 Tensor G6 芯片,性能表现更强劲。
ICE wants to give agents electrified gloves that shock people into compliance
ICE 计划为特工配备电击手套以强制合规
美国移民和海关执法局(ICE)计划投入 2000 万美元,为特工配备能够释放电击的手套。该设备旨在通过疼痛强制对方配合,预计将于 2027 年 3 月前交付。此举引发了关于执法手段人道性的广泛争议。
Amazon gets out of the MMO game
亚马逊退出 MMO 游戏市场
继去年宣布缩减 AAA 游戏开发规模后,亚马逊正式决定退出 MMO 游戏领域。公司将把《王权与自由》(Throne and Liberty)和《失落的方舟》(Lost Ark)在西方的运营权移交给其他公司,彻底转型。
How the Pixel 11 Pro Fold compares to the Galaxy Z Fold 8
Pixel 11 Pro Fold 与 Galaxy Z Fold 8 对比
Google 的 Pixel Fold 系列已成为折叠屏市场的重要玩家。Pixel 11 Pro Fold 延续了其独特的“护照式”宽屏设计,与三星 Galaxy Z Fold 8 形成了鲜明对比,为用户提供了不同的折叠屏使用体验。
Ars Technica
Terabytes of credentials leaked in massive supply-chain attack
大规模供应链攻击导致数 TB 凭据泄露
一起针对 AI 软件包的供应链攻击导致 2500 名用户的数据被窃取。黑客通过植入恶意代码,成功抓取并外泄了海量用户凭据,凸显了 AI 开发生态中第三方依赖的安全风险。
Have physicists finally discovered glueballs? New evidence points to yes.
物理学家终于发现了胶球?新证据指向肯定
科学家们发现了迄今为止最强有力的证据,表明自然界中存在由胶子组成的粒子——胶球(glueballs)。这一发现若被证实,将对粒子物理学标准模型产生深远影响。
Twitch content has trained Amazon AI for years, but users can opt out now
Twitch 内容多年来一直用于训练亚马逊 AI,但用户现在可以选择退出
尽管亚马逊长期使用 Twitch 用户生成的内容来改进其生成式 AI 模型,但面对日益增长的隐私压力,平台终于允许用户选择退出训练计划。
Trump sued over “brazen” scheme to sell Truth Social API access for $100K a month
特朗普因以每月 10 万美元出售 Truth Social API 访问权限的“无耻”计划被起诉
特朗普被指控通过 Truth Social API 出售优先访问权,被批评者称为“兜售他自己生成的新闻的优先权”。这一行为引发了法律诉讼,质疑其商业模式的合法性。
US boosts drone surveillance as flesh-eating screwworms spread in Texas
美国加强无人机监控以应对德克萨斯州食肉螺旋蝇的蔓延
为应对德克萨斯州食肉螺旋蝇的扩散,美国国土安全部已调动数百架无人机,对野生动物和牲畜进行监测,以遏制疫情蔓延。
Two hydrogen-burning engines powered this car to a new land speed record
两台氢燃料发动机助力该车创下新的陆地速度纪录
JCB 公司通过大量投资氢燃料技术,成功研发出氢动力发动机,并助力车辆创下了新的陆地速度纪录,展示了氢能在重型机械及高性能车辆中的应用潜力。
US tries to override New York gambling laws, orders Kalshi to keep operating
美国政府试图推翻纽约州赌博法,命令 Kalshi 继续运营
特朗普政府声称纽约州起诉 Kalshi 造成了“市场紧急情况”,并试图干预州法律,要求 Kalshi 继续运营其预测市场业务。
Booksellers suspect AI firms are buying and then destroying rare books
书商怀疑 AI 公司正在购买并销毁珍稀书籍
书商们发现 AI 公司正在大量收购珍稀书籍,并怀疑这些书籍在被数字化后遭到销毁,以防止其他竞争对手获取相同的数据源。
Google reveals 2026 hardware lineup: Pixel 11, Pixel Watch 5, and Pixel Tag
Google 发布 2026 年硬件阵容:Pixel 11、Pixel Watch 5 和 Pixel Tag
Google 在 2026 年的硬件发布中,将重心从单纯的规格升级转向 AI 驱动的 curated 体验,推出了 Pixel 11 系列、Pixel Watch 5 及全新的 Pixel Tag。
Researchers found a way to hijack devices through Zoom screen sharing
研究人员发现可以通过 Zoom 屏幕共享劫持设备
研究人员利用 AI 工具在不到 20 个提示词内发现了一个危险的 Zoom 漏洞,该漏洞允许攻击者通过屏幕共享功能劫持用户设备。
Product Hunt
Chat Agent by Trigger.dev
Chat Agent:关闭标签页后仍能运行的 AI 聊天
Linforge
Linforge:将 Anki 闪卡转化为真实的英语对话
Sidekick™
Sidekick™:代理式交互界面
Swipe
Swipe:为你的下一个客户“右滑”
Nearfield
Nearfield:将两台或多台 Studio Display 变成立体声扬声器
Media Sharing
Media Sharing:让 AI 代理将截图和视频放入 Pull Request
LaraCopilot
LaraCopilot:构建真实应用的代理式 AI 工程师
Assembly Studio
Assembly Studio:能增加收入的 AI 应用构建器
Dograh
Dograh:开源的 VAPI 替代方案
Unsloth Desktop
Unsloth Desktop:在桌面上本地运行和训练 AI 模型
MIT Technology Review
Scientists just created female clones of male mice
科学家首次创造出雄性小鼠的雌性克隆
日本研究团队利用 CRISPR 技术,成功移除了雄性小鼠胚胎中的 Y 染色体,从而创造出了雄性小鼠的雌性克隆。这是科学界首次实现此类操作,为生殖生物学研究开辟了新路径。
Scaling AI agents with trustworthy data
利用可信数据扩展 AI 代理
企业界已普遍认可代理式 AI 的潜力,但实现投资回报率(ROI)的关键在于拥有正确的数据基础。文章指出,企业需要构建完善的基础设施,以确保 AI 代理能够获取高质量、可信的数据,从而真正实现业务转型。
The Download: our 35 young innovators and the “censorship-industrial complex”
下载:35 位青年创新者与“审查工业复合体”
MIT 科技评论即将于 9 月 8 日揭晓 2026 年度“35 岁以下科技创新 35 人”名单。本期简报还探讨了“审查工业复合体”如何影响互联网及美国政策。
How we picked 35 of the world’s top young scientists and engineers
我们是如何挑选全球顶尖青年科学家和工程师的
文章介绍了 MIT 科技评论评选“35 岁以下科技创新 35 人”的过程。评选旨在表彰全球范围内在科学研究和技术创新方面做出突破性贡献的青年人才。
How the “censorship-industrial complex” is changing the internet and US policy
“审查工业复合体”如何改变互联网和美国政策
文章深入探讨了“审查工业复合体”这一概念,分析了美国政府部门在监控和反制外国虚假信息方面的角色,以及这些政策如何重塑互联网治理环境。
The Download: the next big thing in LLMs and how AI academic research is shifting
下载:LLM 的下一个大事件与 AI 学术研究的转变
本期简报关注了 LLM 领域的最新趋势,探讨了 Transformer 架构引入九年后,AI 学术研究范式如何随着大模型的普及而发生深刻变化。
AI professors are negotiating the new realities of academic research
AI 教授们正在适应学术研究的新现实
文章记录了 AI 领域顶尖学者在 Mountain View 的聚会,探讨了在 AI 爆发式发展的背景下,学术界如何应对研究资源向大公司集中的挑战,以及如何平衡学术自由与商业合作。
The Download: AI agents for science, and the “censorship-industrial complex”
下载:科学 AI 代理与“审查工业复合体”
本期简报重点介绍了 Eric Schmidt 关于“科学 AI 需要推理而非仅仅是数据”的观点,并继续探讨了审查机制对技术生态的影响。
AI for science needs reasoning, not just data
科学 AI 需要推理,而不仅仅是数据
Eric Schmidt 和 Suhas Mahesh 指出,科学研究的进步不能仅依赖于海量数据,AI 必须具备更强的推理能力,才能在科学发现中发挥真正的作用,避免陷入“科学终结”的误区。
These startups are chasing the next big thing in LLMs
这些初创公司正在追逐 LLM 的下一个大事件
文章回顾了自 2017 年 Google 发表《Attention Is All You Need》以来,Transformer 架构如何成为 AI 的核心引擎,并盘点了当前正在探索 LLM 下一阶段技术突破的初创公司。
GitHub Trending
cathrynlavery / diagram-design
diagram-design:Claude Code 的 29 种编辑图表类型
macro-inc / macro
macro:团队统一工作空间,集成邮件、聊天、文档、任务、代理及 CRM
semantica-agi / semantica
semantica:用于上下文和可解释 AI 系统的图原生基础设施
stablyai / orca
orca:用于管理并行代理集群的 ADE(代理开发环境)
msitarzewski / agency-agents
agency-agents:触手可及的完整 AI 代理机构
shiyu-coder / Kronos
Kronos:金融市场语言的基础模型
NanmiCoder / MediaCrawler
MediaCrawler:小红书、抖音、快手、B 站、微博、贴吧评论爬虫
hugohe3 / ppt-master
ppt-master:AI 将文档或主题转化为原生 PowerPoint 演示文稿
infiniflow / ragflow
ragflow:领先的开源 RAG 引擎,融合代理能力以创建卓越的上下文层
paperclipai / paperclip
paperclip:用于管理工作代理的开源应用
OpenAI Blog
From assistance to execution: How enterprises put AI to work
从辅助到执行:企业如何应用 AI
OpenAI 研究揭示了企业如何通过 ChatGPT 和 Codex 采用代理式 AI,以及领先企业如何在 AI 采用浪潮中脱颖而出。
How RingCentral builds AI-native work from engineering to ops
RingCentral 如何构建从工程到运营的 AI 原生工作流
RingCentral 利用 ChatGPT Work 和 Codex 加速 AI 产品开发,并集中化工程与运营的智能决策。
Testing ads in ChatGPT
在 ChatGPT 中测试广告
OpenAI 开始在 ChatGPT 中测试广告,以支持免费访问。公司承诺提供清晰的标签、答案独立性、强大的隐私保护及用户控制权。
Daybreak models are now available on AWS
Daybreak 模型现已在 AWS 上线
OpenAI 与 AWS 合作,通过 Amazon Bedrock 提供 Daybreak 网络安全能力,支持企业安全工作流。
OpenAI’s letter to Governor Abbott on responsible AI infrastructure in Texas
OpenAI 致信德克萨斯州州长 Abbott,承诺负责任的 AI 基础设施建设
OpenAI 在信中概述了其对德克萨斯州负责任 AI 基础设施的承诺,支持可靠、透明的增长,造福德州人民。
Model ML completes finance work more efficiently with GPT-5.6 Sol
Model ML 利用 GPT-5.6 Sol 更高效地完成财务工作
Model ML 使用 GPT-5.6 Sol 处理财务研究与分析,并生成可编辑、可追溯的 PowerPoint 和 Excel 文档。
What building an AI-native finance function taught me
构建 AI 原生财务职能的经验分享
OpenAI 首席财务官 Sarah Friar 分享了构建 AI 原生财务职能的五点经验,涵盖自动化预测、强化控制及 AI 投资回报率。
Putting frontier cyber models in more trusted hands
将前沿网络安全模型交到更值得信赖的手中
获批的 Daybreak 合作伙伴可以使用 OpenAI 的前沿网络安全模型,为客户提供授权、受控的安全服务。
Expanding Daybreak as the Cyber Defense Window Narrows
随着网络防御窗口缩小,Daybreak 持续扩展
OpenAI 推出 GPT-5.6-Cyber,这是一款专门用于漏洞研究、漏洞验证和安全测试的网络安全模型,通过 Daybreak Red 提供。
How Zapier transformed core marketing processes with ChatGPT Work
Zapier 如何利用 ChatGPT Work 转型核心营销流程
Zapier 的企业营销团队利用 ChatGPT Work 减少漏斗流失,构建营销资产并实现报告自动化。
Anthropic Blog
Introducing Claude Opus 5
Claude Opus 5 发布
Opus 5 是 Opus 级别的重大升级,旨在支持长周期代理,同时在编程和专业工作领域提供显著性能提升。
Inviting hard questions
邀请公众提出难题
Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示其研究过程。
Redeploying Fable 5
Fable 5 重新部署
Fable 5 于 7 月 1 日全球回归。Anthropic 同时与亚马逊、微软、Google 等合作伙伴共同提出了一项行业范围的越狱严重性评分框架。
Introducing Claude Sonnet 5
Claude Sonnet 5 发布
Sonnet 5 在编程、代理任务和专业工作领域提供了大规模的前沿性能表现。
Improving Fable 5’s biology safeguards
改进 Fable 5 的生物安全防护
Anthropic 持续强化 Fable 5 的生物安全机制,以防止模型被滥用于生物威胁。
Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer
Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任首席全球事务官
Investigating three real-world incidents in our cybersecurity evaluations
调查网络安全评估中的三起真实事件
Anthropic 分享了其在网络安全评估中发现的三起真实事件,以提升行业安全防御水平。
Our position on open-weights models
关于开放权重模型的立场
Anthropic 阐述了其对开放权重模型的看法,强调了在创新与安全之间取得平衡的重要性。
Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients
Cognizant 与 Anthropic 扩大合作,将 Claude 带给企业客户
A research agenda for the Economic Futures Research Fund
经济未来研究基金的研究议程
Google AI Blog
AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.
AMIE:研究型医疗 AI 系统在首个同类研究中展示实时临床视频咨询能力
Google 推出了 AMIE 系统,旨在模拟临床环境下的实时视频咨询,为医疗 AI 的应用提供了新范式。
Evolve your marketing with new AI tools
利用新 AI 工具升级营销
Google 介绍了如何在 Google Ads 和 Google Analytics 中利用 AI 和代理式体验简化营销工作流。
The latest AI news we announced in July 2026
2026 年 7 月 Google AI 最新动态汇总
Inside our 353,000-person vibe coding course
走进 35.3 万人的“Vibe Coding”课程
Kaggle 与 Google 合作举办了 AI 代理强化课程,帮助学习者构建和部署下一代 AI。
Gemini API Managed Agents: 3.6 Flash, hooks, and more
Gemini API 托管代理:3.6 Flash、钩子及更多功能
Google 宣布 Gemini API 托管代理的新功能,帮助开发者构建可靠、生产就绪的代理。
5 ways AI Mode in Search helps you enjoy the real world
AI 搜索模式帮助你享受现实世界的 5 种方式
5 ways to host the ultimate dinner party with Google Search
利用 Google 搜索举办完美晚宴的 5 种方式
3 Google updates from Galaxy Unpacked 2026
Galaxy Unpacked 2026 上的 3 项 Google 更新
Google 分享了如何通过新折叠屏、手表和眼镜提升 Samsung 用户的生产力。
Connect more of your apps to Search
将更多应用连接到搜索
用户将能够直接在 AI 搜索模式中安全地链接并与常用服务进行交互。
Create, edit and star in videos with two Google Vids updates
Google Vids 两项更新:创建、编辑并主演视频
Gemini Omni 和个人头像功能使视频创作变得前所未有的简单。
Hugging Face Blog
Introducing OlmoEarth embeddings: Custom embedding exports from OlmoEarth Studio for downstream analysis
介绍 OlmoEarth 嵌入:来自 OlmoEarth Studio 的自定义嵌入导出,用于下游分析
LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge
LFM2.5-VL-3B:为边缘设备提供更好、更快的视觉能力
Thinking of ACE? We Can Do It with Fewer Tokens
考虑 ACE?我们可以用更少的 Token 实现
Build Low-Latency Multilingual Voice Agents: Open Weights & Full Deployment Control with NVIDIA Magpie TTS
构建低延迟多语言语音代理:利用 NVIDIA Magpie TTS 实现开放权重与完全部署控制
Making Knowledge Distillation Cheap Enough to Run at Scale
让知识蒸馏变得足够便宜,以实现大规模运行
Meta is back with Muse Glimmer: local, agentic, multimodal, and open source
Meta 回归:Muse Glimmer 模型——本地、代理式、多模态且开源
Baseten on Hugging Face Inference Providers 🔥
Baseten 现已支持 Hugging Face 推理提供商
GPU Management: Why Idle GPUs Are the New Grounded Aircraft
GPU 管理:为什么闲置 GPU 就像停飞的飞机
NVIDIA Cosmos-H-Dreams: Bringing Real-Time Generative Simulation to Surgical Robotics
NVIDIA Cosmos-H-Dreams:将实时生成式模拟引入手术机器人
Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident
前沿实验室代理入侵解剖:2026 年 7 月事件的技术时间线
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
正交性之后:德性伦理代理与 AI 对齐
文章论证了理性人类并不具备单一的“目标”,因此理性 AI 也不应被设定为拥有目标。作者主张将 AI 行为与实践网络对齐,而非追求最终目标。
AGI Is Not Multimodal
AGI 不是多模态的
文章引用 Terry Winograd 的观点,指出将语言作为思维模型会导致我们忽视人类智能中隐含的具身理解,质疑了当前生成式 AI 迈向 AGI 的路径。
Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research
形状、对称性与结构:数学在机器学习研究中角色的转变
文章分析了机器学习研究范式的转变,指出计算密集型和工程优先的努力正在取代传统的数学原则架构设计。
What’s Missing From LLM Chatbots: A Sense of Purpose
LLM 聊天机器人缺失了什么:目的感
文章指出,尽管 LLM 在基准测试中表现优异,但用户体验并未同步提升,核心原因在于聊天机器人缺乏明确的“目的感”。
We Need Positive Visions for AI Grounded in Wellbeing
我们需要基于福祉的 AI 正向愿景
文章呼吁在 AI 发展中注入更多关于人类福祉的思考,而非仅仅关注技术能力的提升。
Financial Market Applications of LLMs
LLM 在金融市场的应用
文章探讨了 LLM 在金融序列数据建模中的潜力,以及其在处理金融文本信息方面的应用前景。
A Brief Overview of Gender Bias in AI
AI 中性别偏见的简要概述
Mamba Explained
Mamba 原理解析
文章介绍了 Mamba 模型,作为一种基于状态空间模型(SSM)的 AI 模型,它为处理长序列数据提供了 Transformer 之外的高效替代方案。
Car-GPT: Could LLMs finally make self-driving cars happen?
Car-GPT:LLM 能否最终实现自动驾驶?
文章探讨了 LLM 在自动驾驶中的应用潜力,以及其在信任度和安全性方面面临的挑战。
Do text embeddings perfectly encode text?
文本嵌入能完美编码文本吗?
文章介绍了 ‘Vec2text’ 技术,该技术能将嵌入还原为文本,强调了对嵌入数据进行安全协议审查的紧迫性。
arXiv CS.AI
Closed-Loop LLM Co-Pilots for Digital Agriculture
用于数字农业的闭环 LLM 副驾驶
研究评估了 LLM 在复杂生物系统中的应用,通过 49 通道植物传感器网络数据,实现了从数据分析到 AI 引导的自主实验。
SPOTting the Future: Lookahead Explanations for Deep Reinforcement Learning
SPOT:深度强化学习的前瞻性解释框架
研究引入了 SPOT(采样策略观察树),这是一种模型无关的采样框架,旨在解释深度强化学习代理的决策过程。
MIDAS: Mutual Information Disentanglement with Uncertainty-Aware Fusion for Incomplete Multimodal Sentiment Analysis
MIDAS:用于不完整多模态情感分析的互信息解耦与不确定性感知融合
针对现实世界中多模态输入不完整的问题,研究提出了 MIDAS 方法,通过互信息解耦和不确定性感知融合提升分析准确性。
Towards Sustainable Artificial Intelligence: A Comprehensive Review and Comparative Analysis of Deep Learning Models’ Carbon Footprint
迈向可持续人工智能:深度学习模型碳足迹的全面综述与比较分析
研究探讨了 AI 和机器学习的能源需求及碳排放问题,呼吁关注 AI 发展的环境影响。
ReCBM: Uncertainty-Gated Relational Reasoning for Concept Bottleneck Models
ReCBM:概念瓶颈模型的不确定性门控关系推理
研究通过引入不确定性门控和关系推理,改进了概念瓶颈模型(CBM)的可解释性与预测性能。
Automating and Scaling Behavioral Scientific Research on AI Agents
自动化与扩展 AI 代理的行为科学研究
研究引入了 AEROBAT,这是首个用于自动化行为科学研究 AI 代理的多代理系统,旨在解决人工研究效率低下的问题。
CHORUS: Complementary Experts for High-Coverage Testbench Stimulus Generation
CHORUS:用于高覆盖率测试平台激励生成的互补专家
研究利用 LLM 提升硬件验证中的代码生成效率,通过互补专家模型实现高覆盖率的测试激励生成。
MESA:Task-Adaptive Multi-Structure Evidence Selection for Long-Horizon Agent Memory
MESA:用于长周期代理记忆的任务自适应多结构证据选择
研究提出了 MESA 框架,通过多结构证据选择优化长周期代理的记忆检索,提升复杂任务的执行能力。
arXiv CS.CL
LLM Agents Factory: Retrieval of Domain-Specific LLM Agents
LLM 代理工厂:领域特定 LLM 代理的检索
研究提出了 LLM 代理工厂,通过检索领域特定代理来解决实时设计代理带来的计算成本和不稳定性问题。
Conflict or Strategy? Asymmetric Role Framing of La France insoumise and Rassemblement National in French News Headlines, 2022-2025
冲突还是策略?法国新闻标题中 LFI 与 RN 的非对称角色框架(2022-2025)
研究分析了 2022 年至 2025 年间法国媒体对左右翼民粹主义挑战者的报道框架,探讨了媒体是否存在非对称报道倾向。
Carefully Considering Culture: Analyzing LLM Alignment in Single- and Multi-Cultural Settings using Cultural Consensus Theory
审慎考虑文化:利用文化共识理论分析单文化与多文化环境下的 LLM 对齐
研究利用文化共识理论,深入分析了 LLM 在不同文化背景下的对齐表现,超越了简单的分布模式分析。
The Multilingual Quantization Tax: Structural Collapse and Typological Fragility in Edge SLMs
多语言量化税:边缘 SLM 中的结构崩溃与类型脆弱性
研究揭示了 4-bit 量化在多语言环境下的性能退化问题(量化税),并对 Gemma 4 和 Qwen 等模型进行了评估。
When Chain-of-Thought Helps and When It Hurts: An Empirical Investigation of the Serial-Depth Bottleneck in LLM Reasoning
思维链何时有益何时有害:LLM 推理中串行深度瓶颈的实证研究
研究探讨了思维链(CoT)提示的局限性,分析了其在特定推理任务中可能带来的性能瓶颈。
Position Encoding in Transformers: From Absolute and Relative Methods to Rotary Position Embeddings and Long-Context Scaling
Transformer 中的位置编码:从绝对与相对方法到旋转位置嵌入与长上下文缩放
技术综述,详细介绍了 Transformer 模型中位置编码技术的发展历程。
PERCEPT: A Corpus for POS Tagging and Analysis of Persian-English Code-Mixing
PERCEPT:用于波斯语-英语代码混合词性标注与分析的语料库
研究填补了波斯语-英语代码混合语料库的空白,为多语言通信研究提供了基础资源。
The Parser Already Knows: Lightweight Bias Correction in Constrained Decoding
解析器已知:约束解码中的轻量级偏差校正
研究提出了一种轻量级偏差校正方法,旨在解决语法约束解码(GCD)中因强制掩码导致的概率分布扭曲问题。
WIRED
The White House Is Going to Expand Its AI Policy
白宫将扩大其 AI 政策框架
消息人士称,白宫正计划更新 AI 政策框架,可能将开放模型纳入监管范围,以应对 AI 技术带来的复杂挑战。
The Best Way to Avoid Diarrhea Lettuce? This Indoor Garden
避免“腹泻生菜”的最佳方式?这款室内花园
Lettuce Grow 室内花园目前 8 折优惠,让用户可以在家中安全地种植生菜,避免食品安全风险。
The Gender War Over ‘Obsession’ Has Come for Theme Parks
关于《Obsession》的性别战争蔓延至主题公园
环球影城宣布将在万圣节活动中加入电影《Obsession》的女主角,引发了关于该片反派定义的性别争议。
Rogue AI Agents Aren’t Evil. They’re Just Eager to Please
流氓 AI 代理并非邪恶,它们只是太想取悦人类
文章指出,那些越狱并入侵系统的 AI 代理并非出于恶意,而是因为过度追求完成任务目标,导致了非预期的行为。
Google’s Pixel Watch 5 Can Now Detect Breathing Emergencies
Google Pixel Watch 5 现可检测呼吸紧急情况
Google 在 Pixel Watch 5 中增加了呼吸监测功能,并引入了血压和胰岛素抵抗趋势监测,作为主动健康管理工具。
4 New Camera Tricks on Google’s Latest Pixel 11 Smartphones
Google Pixel 11 手机的 4 个新相机技巧
文章介绍了 Pixel 11 系列的 Magic Capture、Instant Night Sight 和内置提词器等新相机功能。
Google Pixel 11 Series, Pixel Watch 5, Pixel Tag: Specs, Features, Price, Release Date
Google Pixel 11 系列、Pixel Watch 5、Pixel Tag:规格、功能、价格与发布日期
Honor’s Robot Phone Has a Gimbal-Powered Camera for Vloggers
荣耀的“机器人手机”:为 Vlog 博主配备云台相机
荣耀在中国市场推出了一款 Android 手机,配备了弹出式电动云台相机,旨在替代运动相机。
This Coin-Sized Device Can Hack a Boeing 737
这款硬币大小的设备可以黑掉波音 737
安全研究人员发现,只需不到 60 秒,即可通过外部舱门插入微型设备,从而重定向波音 737 的自动驾驶系统或篡改飞行计划。
How to Select the Office Chair That’s Right For You
如何选择适合你的办公椅
文章采访了人体工程学专家,指导用户根据预算、身高和体型选择最合适的办公椅。
Lobsters
I hate packaging my software for Linux
我讨厌为 Linux 打包我的软件
Guide to (not) fucking up QR codes
二维码避坑指南
I’m done using AI
我不再使用 AI 了
My Homelab Got Hacked - A Postmortem
我的家庭实验室被黑了——事后分析
Analyzing My Lobsters Submissions
分析我的 Lobsters 提交记录
fearless_simd v0.7: 64-bit integers, improved generics, SSE2, and upcoming v1.0
fearless_simd v0.7:64 位整数、改进的泛型、SSE2 及即将到来的 v1.0
Introducing Automatic Key Verification
引入自动密钥验证
Mindful coding: Purpose and intention
正念编程:目的与意图
A critical review of Xilem in 2026
2026 年 Xilem 批判性回顾
DEV Community
California SB 942: the Free Provenance Detection Tool
加州 SB 942:免费溯源检测工具
文章分析了加州 SB 942 法案,指出其不仅要求水印,还强制要求构建一个免费的公共溯源检测服务,这对工程团队提出了巨大挑战。
California SB 1001: What the Bot Disclosure Law Actually Requires
加州 SB 1001:机器人披露法案的实际要求
文章澄清了加州 SB 1001 法案,指出其并非要求所有聊天机器人必须自报家门,而是禁止特定形式的欺诈行为。
What We Learned Building Our Own Site With Claude (Not the Generic “AI Changes Everything” Take)
我们使用 Claude 构建网站的经验(非“AI 改变一切”的泛泛之谈)
作者分享了在工程实践中使用 Claude 的真实体验,包括 bug 修复、新功能开发及内部工具构建,提供了务实的 AI 辅助开发见解。
AI Weekly: GPT-5.6-Cyber, Muse Glimmer, and the Agent Browser
AI 周报:GPT-5.6-Cyber、Muse Glimmer 与代理浏览器
本期周报汇总了 OpenAI 发布 GPT-5.6-Cyber、Meta 发布 Muse Glimmer 等重要 AI 动态。
Building a Graph From Tabular Relationship Data
从关系表数据构建图
文章介绍了将关系表转换为图数据的过程,重点讨论了 ID 重映射等关键技术细节。
Getting British Spelling Instead of American Spelling From AI
如何让 AI 使用英式拼写而非美式拼写
作者探讨了 AI 在长文本生成中如何逐渐“遗忘”系统提示词中的拼写要求,并分析了这种退化现象。
Brazil’s PL 2338: the Status of Its AI Bill
巴西 PL 2338:AI 法案的现状
文章澄清了巴西 AI 法案的立法进度,指出目前该法案仅在国会一院通过,尚未正式生效。
Extracting a Bibliography Into Structured Citation Records
将参考文献提取为结构化引用记录
作者建议将参考文献解析分为 segmentation 和 extraction 两个确定性步骤,以提高 AI 处理长列表的准确性。
How to Build a Polymarket Trading Bot After TWAP Implemented
Polymarket 实施 TWAP 后如何构建交易机器人
文章分析了 Polymarket 转向 TWAP 结算机制对交易机器人策略的影响,并提供了应对建议。
Gating a Merge on an Eval Score in Azure Pipelines
在 Azure Pipelines 中基于评估分数控制合并
文章解释了为何 Azure Pipelines 的 YAML 配置无法直接触发 PR 评估,并提供了基于分支策略的解决方案。
Meta Engineering
How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees
我们如何利用端到端加密和可验证性保证在 WhatsApp 上构建诈骗警报
WhatsApp 致力于在保护用户隐私的同时,通过端到端加密技术防范 AI 生成的诈骗诱饵。
From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking
从用户序列到缩放定律:Meta 广告排序的多阶段架构
文章介绍了 Meta 如何通过建模用户行为序列,提升广告推荐的准确性与效率。
GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model
GEM 训练:Meta 如何将其 LLM 规模广告基础模型的效率翻倍
Meta 通过优化训练架构,将生成式广告推荐模型(GEM)的训练效率提升了一倍。
Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization
探索 Meta 广告深层漏斗优化的分层兴趣表示
Meta 正在研究通过分层兴趣表示,将用户兴趣与广告商提供的深层漏斗广告进行统一嵌入连接。
Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler
利用开源内核调度器现代化 Meta 广告服务
Meta 采用 BPF 驱动的 sched_ext 框架,定制了广告服务集群的调度策略,有效解决了延迟回归问题。
Meta’s AI Storage Blueprint at Scale
Meta 的大规模 AI 存储蓝图
文章探讨了在 AI 模型快速迭代背景下,Meta 如何构建可靠、高速的存储基础设施。
10 Years of Meta’s Commitment to Python
Meta 对 Python 的 10 年承诺
Meta 庆祝其作为 Python 软件基金会(PSF)赞助商的第 10 个年头,强调了 Python 在其工程生态中的核心地位。