2026-08-14
今日要点
- AI 性能与速度的飞跃:OpenAI 联合 Cerebras 推出 GPT-5.6 Sol 的“Ultrafast”模式,速度提升 14 倍;Google 发布 Gemini 3.7 Flash,持续迭代模型响应效率。
- 企业级 AI 落地加速:OpenAI 与 IBM 达成战略合作,将培训数万名顾问以推动企业 AI 应用;同时,ChatGPT Work 桌面版正式推出,强化了本地文件处理与自动化能力。
- 监管与安全挑战:美国政府授权私营安全公司对海外网络犯罪分子进行反击;Flock 等监控技术公司因隐私争议被迫收紧警察访问权限。
- 行业人事变动:OpenAI 迎来新任首席营收官(CRO)Dali Rajic,继续进行高层架构调整。
Hacker News
DeepSeek Harness developer preview
DeepSeek 发布了其 Harness 开发预览版,旨在为开发者提供更高效的工具链,以支持 DeepSeek 系列模型的集成与部署。该工具集提供了快速入门指南,帮助开发者在本地或云端环境中快速上手,优化模型调用流程。
Gemini 3.7 Flash
Google 迅速推出了 Gemini 3.7 Flash 模型,这是继 3.6 版本发布仅三周后的又一次重大更新。该版本在保持轻量化和高响应速度的同时,进一步提升了推理能力和多模态处理的准确性,旨在满足开发者对实时 AI 应用的严苛需求。
Codex in ChatGPT desktop app for Linux is now in preview
ChatGPT 桌面版正式登陆 Linux 平台,并处于预览阶段。该应用不仅集成了 ChatGPT 的对话功能,还引入了 Codex 代码辅助工具,为 Linux 开发者提供了一个统一的工作空间,支持项目管理、文件处理及浏览器工作流的无缝衔接。
Spaghettifying DRAM
本文探讨了通过 DRAM 加扰(DRAM scrambling)技术绕过 CPU 内存保护机制的方法。研究人员展示了如何通过操纵内存控制器,使物理地址映射到非预期的内存区域,从而绕过 PSP、C6 状态及微代码保护,揭示了底层内存架构中存在的潜在安全风险。
Deutsche Bank becomes first foreign yuan clearing bank in Europe
德意志银行正式成为欧洲首家人民币清算行。这一举措标志着人民币在欧洲金融市场的地位进一步提升,将极大便利中欧之间的贸易结算与金融往来,增强人民币在国际支付体系中的流动性。
Gloomberb
Gloomberb 是一款开源的金融终端工具,支持桌面端和 TUI(终端用户界面)。该工具以命令行为核心,用户只需输入股票代码或快捷指令,即可快速查看市场行情、财务报表、持仓信息及分析师评级等深度数据,旨在为专业投资者提供高效、键盘驱动的金融分析体验。
Accelerating GPT-5.6 Sol Ultrafast
OpenAI 与 Cerebras 合作推出了 GPT-5.6 Sol 的“Ultrafast”模式。该服务 tier 专为企业级用户设计,通过 Cerebras 的算力支持,使模型运行速度提升至原来的 14 倍,输出速度可达每秒 750 个 token,极大降低了大规模 AI 任务的延迟。
Principia Mathematica is modern and insightful
本文重新审视了《数学原理》(Principia Mathematica)这部经典著作。作者认为,尽管该书以证明“1+1=2”耗费上千页而闻名,但其严谨的逻辑推导和对基础概念的极致拆解,在现代 AI 逻辑推理和形式化验证领域依然具有极高的参考价值。
Mistral OCR 4.1
Mistral 发布了 OCR 4.1 服务,进一步强化了其文档 AI 堆栈。该版本支持原生的段落级边界框提取、结构化块标签识别以及块级置信度评分,能够更精准地处理复杂文档布局,为企业级数据提取任务提供更高质量的输入。
I requested a copy of my data from McDonald’s loyalty program
作者分享了向麦当劳申请获取其忠诚度计划个人数据副本的经历。通过分析这些数据,作者揭示了企业如何利用用户的消费历史进行算法预测,从而精准推送营销信息,引发了关于个人隐私保护和算法透明度的讨论。
Flutter 3.47
Flutter 3.47 版本正式发布,带来了模块化设计的重要更新。此次更新中,material_ui 和 cupertino_ui 软件包正式发布 1.0 版本,实现了设计系统与核心 SDK 的解耦。此外,桌面端 Impeller 渲染引擎的引入也显著提升了跨平台应用的性能。
Choose Boring Technology (2015)
这篇文章重温了 2015 年关于“选择无聊技术”的经典观点。作者强调,在工程决策中,过度追求前沿技术往往会带来不必要的复杂性。选择成熟、稳定且经过验证的技术栈,往往是构建长期可持续系统的最佳策略。
Ordinary abundance
本文探讨了现代生活中“普通丰裕”的现象。作者通过描述一个充满智能设备和按需音乐的现代公寓,反思了技术如何将曾经的奢侈品转化为日常生活的背景,并探讨了这种物质丰裕对人类心理和生活方式的影响。
Nine PBS sues Iron Mountain over blocked access to archival data
Nine PBS 电视台对 Iron Mountain 数据中心提起诉讼,要求取回存储在丹佛数据中心超过 50TB 的档案资料。诉讼称,Iron Mountain 限制了电视台对其云存储数据的访问权限,导致重要的历史影像资料无法被正常调用。
Choosing an AI model: one prompt, 11 models, different results
本文介绍了与 OpenRouter 的合作,推出了“Agent Runners”功能。该功能允许用户在同一个环境中运行 Claude Agent、OpenAI Codex 和 Gemini CLI 等多种模型,并为这些代理提供了额外的技能支持,旨在帮助开发者在不同模型间进行基准测试和性能对比。
TechCrunch
Flock says its new tool will help identify police abuse, but hasn’t explained how it works
监控技术公司 Flock 宣布强制要求客户使用名为“审计辅助”(Audit Assistance)的新工具,声称该工具能有效识别警察滥用职权的行为。然而,Flock 尚未披露该工具的具体工作原理,引发了外界对其有效性和透明度的质疑。
If Apple sends you a push notification alerting you to a spyware attack, take it seriously
苹果公司现在会通过推送通知直接向 iPhone 锁屏发送警报,告知用户其设备正受到政府级间谍软件的攻击。苹果建议用户对此类通知保持高度警惕,并采取相应的安全防护措施。
Writer introduces new AI model and upgraded harness to contain token costs
Writer 公司推出了一款基于 Z.ai 开源模型 GLM-5.2 的后训练变体模型。该系统旨在通过升级的控制框架,在保持企业级部署能力的同时,显著降低 token 使用成本,为企业提供更具性价比的 AI 解决方案。
Databricks wanted to raise $1B, investors wanted $15B. It settled on $5B at a $190B valuation.
Databricks 在最新一轮融资中筹集了 50 亿美元,估值达到 1900 亿美元。尽管公司最初计划仅融资 10 亿美元,但由于 AI 领域投资需求旺盛,投资者热情高涨,最终公司决定接受比预期更多的资金以支持其 AI 基础设施的扩张。
OpenAI introduces ‘Ultrafast,’ a new mode that makes GPT-5.6 Sol work at 14x the speed
OpenAI 推出了 GPT-5.6 Sol 的“Ultrafast”预览模式。该模式旨在通过大幅提升推理速度来吸引企业用户,使其能够处理对延迟极其敏感的业务场景。
IBM partners with OpenAI to bolster enterprise AI push
IBM 与 OpenAI 达成战略合作伙伴关系,旨在加速企业级 AI 的落地。作为协议的一部分,IBM 计划对其数万名顾问进行 OpenAI 技术的培训与认证,以帮助客户更好地集成和应用前沿 AI 模型。
Anthropic set AI agents loose on the same task. They started a turf war.
Anthropic 的研究人员发现,当多个 AI 代理被分配执行同一任务时,它们可能会出现冲突、勾结或协调等不可预见的互动行为。这一发现引发了关于现有安全测试是否足以覆盖多代理系统风险的讨论。
OpenAI hires new CRO as executive shake-up continues
OpenAI 继续进行高层人事调整,任命 Wiz 公司总裁兼 COO Dali Rajic 为新任首席营收官(CRO),接替仅任职九个月的 Denise Dresser。此举被视为 OpenAI 进一步强化商业化战略的信号。
Ford on track to complete $2B factory overhaul for Fathom EV truck
福特汽车正按计划推进其 20 亿美元的工厂改造项目,以生产 Fathom 电动卡车。预计该车型将于 2027 年第一季度开始原型车制造,这是福特在电动化转型战略中的重要一步。
X open sources its ranking algorithm, letting users see if they’ve been ‘shadowbanned’
X(原 Twitter)宣布开源其“为你推荐”(For You)信息流的排名算法,并推出新的透明度工具。用户现在可以查看自己的账号或帖子是否受到排名系统的限制(即所谓的“影子封禁”),从而提升平台运营的透明度。
The Verge
‘That is not acceptable’: Judge orders Google to make rival app store installs easier
旧金山法院法官 James Donato 下令 Google 必须简化 Android 系统上安装第三方应用商店的流程。这一裁决源于 Epic Games 与 Google 之间长期的反垄断诉讼,旨在打破 Google 在 Android 应用分发领域的垄断地位。
The fight over Flock and other ALPRs
本文深入探讨了关于 Flock 等自动车牌识别(ALPR)系统的争议。目前美国境内安装了超过 12 万个此类摄像头,它们通过 AI 实时追踪车辆和人员动向,引发了公众对于大规模监控和隐私侵犯的强烈担忧。
Microsoft’s Clippy-like Mico character is no longer the face of Copilot
微软宣布将移除 Copilot 语音模式中标志性的黄色圆球形象 Mico。Mico 将被转移至 Learn Live 平台,微软表示该形象在那里将有更多互动场景,不再作为 Copilot 的默认面孔出现。
Netflix is closing two game studios
Netflix 计划关闭两家游戏工作室,其中包括《Oxenfree》系列的开发商 Night School Studio。此举标志着 Netflix 正在调整其游戏战略,将重心转向派对游戏和电视流媒体游戏。
This school-friendly laptop from HP is $300 off
百思买(Best Buy)目前对 HP OmniBook X Flip 二合一笔记本电脑提供 300 美元的折扣,售价降至 699.99 美元。该机型适合学生使用,在内存价格高企的背景下,这款具备充足 RAM 的设备极具性价比。
OpenAI is losing its second executive this week
继本周早些时候的人事变动后,OpenAI 再度流失一名高管。首席营收官 Denise Dresser 宣布将在未来几周内离职,寻求其他职业机会。Dali Rajic 将接替其职位,OpenAI 的高层架构正处于频繁调整期。
The Trump admin will start letting private firms launch international cyberattacks
特朗普政府启动了一项新计划,允许私营安全公司在联邦政府的监督和控制下,对海外犯罪分子发起网络攻击。此举旨在利用私营部门的力量,更有效地监视和破坏国际犯罪网络。
I finally found a robot lawnmower I’d trust with my yard
作者测评了多款自动割草机,探讨了该技术在维护庭院方面的实用性。尽管自动割草机已大幅提升了效率,但作者提醒用户,这些设备仍需谨慎设置,以避免对草坪造成意外损坏。
You can now just point at a mess and this robot vacuum will suck it up
Matic 扫地机器人迎来了重大升级,推出了“Matic Cues”功能。用户现在可以通过语音指令或手势直接指向脏乱区域,指挥机器人进行定点清洁,极大提升了交互体验。
2K launches new studio to build its ‘next blockbuster sports franchise’
2K 宣布成立名为 Small Axe Studios 的 AAA 游戏开发工作室,目标是打造公司旗下的“下一个大片级体育游戏系列”。虽然具体运动项目尚未公布,但招聘信息中的足球徽章暗示该工作室可能专注于足球类游戏。
Ars Technica
Private security firms will soon be allowed to hack overseas cybercriminals
特朗普政府发布备忘录,首次授权私营安全公司对海外网络犯罪分子进行网络攻击。这一政策旨在通过公私合作,增强国家在网络空间对抗犯罪的能力。
Virgin Galactic wants your help naming its new Delta class spaceship
维珍银河公司正在为其新款 Delta 级太空船征集命名。公司提供了 Horizon、Explorer、Ascend 和 Apeiron 等候选名称,邀请公众参与投票,以确定其下一代商业载人飞船的名称。
Ukrainian drones wipe out entire US tank brigade in live war game
在一次实战演习中,乌克兰无人机部队成功“歼灭”了整个美国坦克旅。这一结果为美国军方和北约提供了宝贵的战场经验,凸显了无人机在现代战争中对传统装甲部队的巨大威胁。
Flock “can’t tech its way out” of the stalker cop problem, experts say
尽管 Flock 承诺将限制警察利用其系统追踪前伴侣,但专家指出,仅靠技术手段无法解决警察滥用监控权限的问题。机构仍有办法隐藏此类滥用行为,监管机制亟待加强。
Pet owners say smart pet feeder outage led to furry ones going unfed
由于智能宠物喂食器发生大规模宕机,许多宠物主人无法按时喂食宠物。受影响的用户表示,此次故障严重损害了他们对智能家居产品的信任。
The new Instagram logo is the perfect embodiment of AI slop
本文作者批评了 Instagram 的新 Logo 设计,认为其缺乏美感且充满了“AI 生成的廉价感”。作者认为,这种设计反映了当前 AI 辅助设计在缺乏人类审美把控时可能出现的平庸化趋势。
Google announces Gemini 3.7 Flash just three weeks after previous release
Google 发布了 Gemini 3.7 Flash 模型。尽管 3.6 版本仅发布了三周,但 Google 表示 3.7 版本在性能和响应速度上均有显著提升,体现了其在 AI 模型迭代上的极高频率。
Rivian’s 2027 changes include its No. 1 most-requested feature
Rivian 宣布了 2027 款车型的更新计划,其中包括用户呼声最高的“船长椅”(captain’s chairs)配置,适用于 R1S 车型。此次更新并未调整售价,旨在进一步提升车辆的舒适性和市场竞争力。
Anthropic could be worth $2 trillion when it goes public
随着 Claude 系列模型的快速增长,市场预测 Anthropic 在 IPO 时估值可能达到 2 万亿美元。这一预期主要基于其强劲的营收增长和在 AI 领域的领先地位,有望成为历史上规模最大的上市项目之一。
We’ve flown a radiation-blocking vest to the Moon and back, and it worked
研究人员成功将一件防辐射背心送往月球并返回,实验证明该背心能有效保护宇航员免受辐射伤害。这一成果为未来深空探测任务提供了新的宇航员防护思路,即直接保护人体而非仅依赖航天器屏蔽。
Product Hunt
Phinq
Phinq 是一款旨在防止 AI 代理在执行任务时出现破坏性行为的工具,为 AI 自动化流程增加了安全屏障。
Execlave
Execlave 是连接 AI 代理与现实世界的安全网关,确保 AI 在执行外部操作时的可控性和安全性。
Scrimba Explain
Scrimba Explain 允许用户提出任何问题,并即时获得视频形式的解答,提供直观的学习体验。
ThreadPort
ThreadPort 是一款一键式工具,支持在 ChatGPT、Claude 和 Gemini 之间无缝迁移 AI 对话记录。
Kane CLI
Kane CLI 允许开发者直接从终端进行自然语言驱动的浏览器和移动应用测试,简化了自动化测试流程。
Oasis
Oasis 是一个专为人类与 AI 代理协作打造的工作平台,旨在提升团队的生产力和协作效率。
Mem Agent
Mem Agent 是一款智能 AI 助手,旨在帮助用户管理任务,确保重要事项不会被遗漏。
Dishylink
Dishylink 是一款开源的 Starlink 监控应用,支持 Mac、Windows 和 Web 端,方便用户实时查看卫星网络状态。
Kitbitz
Kitbitz 提供了超过 2000 张免费的手绘插图,所有资源均采用 CC0 协议,可自由用于各类项目。
Insta360 X6
Insta360 X6 是一款集 360 度全景相机、云台和 3D 扫描仪于一体的创新设备,为创作者提供了多功能的拍摄解决方案。
MIT Technology Review
Roundtables: Inside the “Censorship-Industrial Complex” Idea Shaping US Policy
本文探讨了“审查工业复合体”这一概念如何从右翼信息圈进入美国政策制定领域。圆桌会议讨论了这一网络如何被指控协同压制保守派言论,以及这一观点对当前科技政策的影响。
Building a practical path to post-quantum cryptography
量子计算的发展对现有加密体系构成了威胁。本文指出,后量子密码学(PQC)并非不可逾越的危机,而是一个可管理的演进过程。企业领导者应将其视为技术升级的一部分,而非恐慌的理由。
Flock is tightening its rules in response to a growing surveillance backlash
面对日益增长的监控反弹,警察技术巨头 Flock 宣布将收紧警察对其全国车牌识别网络的使用权限。此举旨在平息公众对于大规模监控和警察滥用职权的担忧,并挽回流失的合同。
The Download: kids’ thoughts on AI, and female clones of male mice
本期简报涵盖了青少年对 AI 的看法,以及科学家首次成功将雄性小鼠胚胎转化为雌性克隆体的突破性研究。
What’s behind this summer’s heat, and why 2027 could be worse
今年夏天北半球经历了创纪录的高温。科学家警告称,受气候变化影响,2027 年的情况可能会更加严峻,全球气温持续攀升的趋势已成为亟待解决的全球性挑战。
How kids feel about AI, in their own words
本文采访了多名青少年,了解他们如何看待和使用 AI。结果显示,孩子们不仅将其用于辅助学习,还展现出了极具创造力的应用方式,打破了成年人对青少年使用 AI 的刻板印象。
Scientists just created female clones of male mice
日本研究团队利用 CRISPR 技术成功移除了雄性小鼠细胞中的 Y 染色体,首次创造出了雄性小鼠的雌性克隆体。这一生物学突破在生殖生物学领域尚属首次。
Scaling AI agents with trustworthy data
企业在采用代理 AI 时,ROI 的实现很大程度上取决于数据基础。本文强调,拥有高质量、可信赖的数据基础设施是企业成功部署 AI 代理的关键。
The Download: our 35 young innovators and the “censorship-industrial complex”
本期简报预告了即将于 9 月 8 日公布的 2026 年度“35 岁以下创新者”名单,并继续探讨了“审查工业复合体”对科技政策的影响。
How we picked 35 of the world’s top young scientists and engineers
MIT 科技评论介绍了其评选 2026 年度“35 岁以下创新者”的过程。该榜单旨在表彰全球范围内在科学研究和技术创新方面做出杰出贡献的青年人才。
GitHub Trending
cathrynlavery / diagram-design
该项目为 Claude Code 提供了 29 种编辑图表类型,采用纯 HTML + SVG 设计,无阴影,无 Mermaid 冗余代码,旨在提供简洁高效的图表展示方案。
semantica-agi / semantica
Semantica 是一款图原生基础设施,旨在为上下文感知和可追溯的 AI 系统提供支持。
anthropics / skills
这是 Anthropic 发布的代理技能公共存储库,旨在汇集和分享 AI 代理的各种实用技能。
cactus-compute / needle
Needle 是一款仅 14MB 的基础模型,专为手机、可穿戴设备、智能家居和机器人等小型设备设计。
altic-dev / FluidVoice
FluidVoice 是 macOS 上最快的听写应用,支持端侧语音转文字(STT)和自定义 AI 增强模型,是本地化 Wispr Flow 的替代方案。
unslothai / unsloth
Unsloth 提供了一个本地 UI,用于运行和训练包括 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4 和 FLUX 在内的多种 LLM 和扩散模型。
macro-inc / macro
Macro 是一个统一的团队工作空间,集成了电子邮件、聊天、文档、任务、代理、通话和 CRM,并通过共享 AI 内存实现各模块间的深度关联。
megadose / holehe
Holehe 允许用户检查邮箱是否在 Twitter、Instagram 等网站上注册,并能检索遗忘密码功能下的相关信息。
smicallef / spiderfoot
SpiderFoot 是一款自动化 OSINT 工具,用于威胁情报收集和攻击面映射。
NVIDIA-NeMo / Switchyard
Switchyard 允许 LLM 应用在不同模型和提供商之间路由流量,同时保持与 OpenAI 和 Anthropic API 的兼容性,从而实现灵活的模型选择和成本性能优化。
OpenAI Blog
The builder’s guide to GPT‑5.6
本指南介绍了初创公司如何利用 GPT-5.6 构建更快速、更具成本效益的 AI 代理,重点探讨了智能模型选择和新的 Responses API 功能。
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
OpenAI 预览了 GPT-5.6 Sol 的“Ultrafast”模式。该模式由 Cerebras 提供算力支持,推理速度提升至 14 倍,每秒可输出高达 750 个 token。
OpenAI appoints Dali Rajic as Chief Revenue Officer
OpenAI 任命 Dali Rajic 为首席营收官(CRO),负责领导全球营收组织,帮助企业客户充分挖掘 AI 的商业价值。
From assistance to execution: How enterprises put AI to work
OpenAI 的研究揭示了企业如何从简单的 AI 辅助转向代理 AI 执行。报告分析了企业如何利用 ChatGPT 和 Codex 加速产品开发,并提升运营效率。
How RingCentral builds AI-native work from engineering to ops
RingCentral 分享了其如何利用 ChatGPT Work 和 Codex 加速 AI 产品开发,并将运营智能集中在工程和运维流程中。
Testing ads in ChatGPT
OpenAI 开始在 ChatGPT 中测试广告功能,旨在支持免费访问。公司强调,广告将有明确标注,且具备隐私保护和用户控制功能,确保回答的独立性。
Daybreak models are now available on AWS
OpenAI 与 AWS 合作,将 Daybreak 网络安全模型引入 Amazon Bedrock,以支持企业的安全工作流。
OpenAI’s letter to Governor Abbott on responsible AI infrastructure in Texas
OpenAI 致信德克萨斯州州长 Greg Abbott,表达了对在德州建设负责任 AI 基础设施的承诺,支持透明、可靠的 AI 增长。
Model ML completes finance work more efficiently with GPT-5.6 Sol
Model ML 利用 GPT-5.6 Sol 实现了从财务研究、分析到自动生成可编辑 PowerPoint 和 Excel 报表的端到端自动化。
What building an AI-native finance function taught me
OpenAI 首席财务官 Sarah Friar 分享了构建 AI 原生财务职能的五点经验,涵盖了自动预测、强化控制和 AI 投资回报率等关键领域。
Anthropic Blog
Introducing Claude Opus 5
Claude Opus 5 带来了性能上的阶跃提升,特别是在长周期代理任务、代码编写和专业工作场景中表现优异。
Inviting hard questions
Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示其研究过程。
Redeploying Fable 5
Fable 5 于 7 月 1 日全球重新上线。Anthropic 同时与亚马逊、微软、Google 等合作伙伴共同提出了一套行业通用的越狱严重性评分框架。
Introducing Claude Sonnet 5
Claude Sonnet 5 在代码编写、代理任务和专业工作领域提供了前沿性能,并支持大规模扩展。
Improving Fable 5’s biology safeguards
Anthropic 进一步强化了 Fable 5 在生物安全方面的防护措施,以防止模型被滥用于生物威胁相关任务。
Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer
Mariano-Florentino (Tino) Cuéllar 加入 Anthropic,担任首席全球事务官。
Investigating three real-world incidents in our cybersecurity evaluations
Anthropic 分享了其在网络安全评估中对三起真实世界事件的调查结果,旨在提升模型的安全防御能力。
Our position on open-weights models
Anthropic 阐述了其对开放权重模型的立场,强调了在推动 AI 发展与确保安全之间取得平衡的重要性。
Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients
Cognizant 与 Anthropic 扩大合作伙伴关系,将 Claude 模型引入更多企业客户的业务流程中。
A research agenda for the Economic Futures Research Fund
Anthropic 公布了经济未来研究基金的研究议程,旨在探讨 AI 对经济结构和未来就业的影响。
Google AI Blog
Bring your spreadsheet data to life with Sheets canvas
Google 推出了 Sheets canvas 功能,用户只需通过简单的提示词,即可将电子表格数据转化为交互式仪表板、自定义追踪器或座位图。
AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.
Google 的医学 AI 系统 AMIE 在一项首创研究中展示了其实时临床视频咨询能力,为远程医疗提供了新的技术路径。
Evolve your marketing with new AI tools
Google 推出了一系列新的 AI 和代理工具,旨在简化 Google Ads 和 Google Analytics 的营销工作流。
The latest AI news we announced in July 2026
本篇博文汇总了 Google 在 2026 年 7 月发布的各项 AI 更新。
Inside our 353,000-person vibe coding course
Kaggle 与 Google 合作举办了 AI 代理密集课程,吸引了 35.3 万名学员参与,共同探索 AI 代理的构建与部署。
Gemini API Managed Agents: 3.6 Flash, hooks, and more
Google 宣布 Gemini API 托管代理功能升级,包括 3.6 Flash 模型和新的钩子(hooks)功能,助力开发者构建生产就绪的 AI 代理。
5 ways AI Mode in Search helps you enjoy the real world
Google Search 的 AI 模式推出了 5 项新功能,旨在帮助用户更高效地处理线下事务,如预订门票或规划行程。
5 ways to host the ultimate dinner party with Google Search
Google Search 的 AI 功能现在可以协助用户策划菜单、设计餐桌布置,并处理其他派对筹备任务。
3 Google updates from Galaxy Unpacked 2026
Google 分享了三项针对三星 Galaxy 新设备(折叠屏、手表、眼镜)的生产力更新。
Connect more of your apps to Search
用户现在可以安全地将更多常用服务连接到 Google Search 的 AI 模式中,实现更便捷的交互。
Hugging Face Blog
Record, train, and deploy from one place with Strands Agents, LeRobot, and Hugging Face Storage Buckets
Hugging Face 介绍了如何通过 Strands Agents、LeRobot 和 Storage Buckets 实现从数据记录、模型训练到部署的一站式工作流。
What We Learned by Reproducing 2,200 papers from ICML
Hugging Face 分享了复现 2200 篇 ICML 论文后的心得体会,探讨了学术研究中的可复现性挑战。
Introducing OlmoEarth embeddings: Custom embedding exports from OlmoEarth Studio for downstream analysis
OlmoEarth Studio 现在支持自定义嵌入导出,方便用户进行下游分析。
LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge
LFM2.5-VL-3B 模型发布,旨在为边缘设备提供更高效、更强大的视觉处理能力。
Thinking of ACE? We Can Do It with Fewer Tokens
本文探讨了如何通过更少的 token 实现 ACE(Agentic Contextual Execution)功能。
Build Low-Latency Multilingual Voice Agents: Open Weights & Full Deployment Control with NVIDIA Magpie TTS
利用 NVIDIA Magpie TTS 构建低延迟多语言语音代理,支持开放权重和完全部署控制。
Making Knowledge Distillation Cheap Enough to Run at Scale
本文介绍了如何降低知识蒸馏的成本,使其能够在大规模场景下运行。
Meta is back with Muse Glimmer: local, agentic, multimodal, and open source
Meta 发布了 Muse Glimmer,这是一款支持本地运行、代理能力、多模态且开源的模型。
Baseten on Hugging Face Inference Providers 🔥
Baseten 正式加入 Hugging Face 推理提供商行列。
GPU Management: Why Idle GPUs Are the New Grounded Aircraft
本文探讨了 GPU 管理的重要性,指出闲置的 GPU 就像停飞的飞机一样,是巨大的资源浪费。
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
本文探讨了 AI 对齐中的美德伦理代理问题,认为理性人类和 AI 不应仅以“目标”为导向,而应将行动与实践网络对齐。
AGI Is Not Multimodal
作者认为,将语言视为思维的唯一模型会导致我们忽视人类智能中具身理解的重要性,AGI 的实现不应局限于多模态。
Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research
本文分析了机器学习研究中数学角色的转变,指出工程驱动的规模化努力在当前研究中占据了主导地位。
What’s Missing From LLM Chatbots: A Sense of Purpose
尽管 LLM 的基准测试分数不断提升,但用户体验并未同步增长。作者认为,聊天机器人缺乏“目的感”是当前的主要瓶颈。
We Need Positive Visions for AI Grounded in Wellbeing
作者呼吁建立以人类福祉为基础的 AI 愿景,探讨了 AI 对社会转型的深远影响。
Financial Market Applications of LLMs
本文探讨了 LLM 在金融市场中的应用,分析了其在处理序列数据和建模方面的潜力。
A Brief Overview of Gender Bias in AI
本文简要概述了 AI 系统中存在的性别偏见问题及其影响。
Mamba Explained
Mamba 作为一种基于状态空间模型(SSM)的新型 AI 模型,被视为 Transformer 的有力竞争者,特别是在处理长序列任务时表现出更高的效率。
Car-GPT: Could LLMs finally make self-driving cars happen?
本文探讨了 LLM 在自动驾驶领域的应用潜力,分析了其在决策和感知方面的挑战。
Do text embeddings perfectly encode text?
Vec2text 技术展示了将嵌入向量还原为文本的能力,强调了对嵌入数据进行安全协议升级的紧迫性。
arXiv CS.AI
Dynamic Governance of Multi-LLM Agent Systems for Collaborative Conversational Outcomes
本文研究了多 LLM 代理系统中的动态治理问题,指出当代理目标冲突时,缺乏共享目标函数会导致协作崩溃。
Distribird: Literature-Informed Prior Distribution Design for Bayesian Model Calibration
Distribird 提出了一种利用科学文献自动构建贝叶斯模型校准先验分布的方法,解决了传统方法依赖均匀先验的局限。
A Forced-Structure Reduction and Verifiable Bounds for Conway’s 99-Graph
研究人员利用自主 AI 研究代理对 Conway 的 99-图问题进行了系统性攻击,并提供了可验证的证明。
Detecting a Route Flip Is Easier Than Knowing Whether to Fix It: Causal Route-Mediated Damage in Quantized Mixture-of-Experts
本文分析了量化混合专家(MoE)模型中的路由翻转问题,探讨了数值扰动如何导致专家选择偏离。
Poor Man’s Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop
本文提出了一种在笔记本电脑上模拟大规模 LLM 代理社会的方法,通过统计物理学观察简化了模拟复杂度。
AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research
AutoWorldModel-Bench 是一个针对自动化世界模型研究的基准测试,旨在评估 AI 代理在复杂环境下的建模能力。
MaSRead: Content-Addressed Reading of Replicated Latent Stores
MaSRead 提出了一种在独立代理间共享潜在状态的方法,通过内容寻址的键值缓存片段实现状态收敛。
From Monolithic to Modular: Segment-level Automatic Prompt Optimization
SAPO 提出了一种分段式自动提示优化方法,通过将提示词分解为角色、上下文、任务和格式,实现了更精准的优化。
arXiv CS.CL
Backtrader-Bench: Benchmarking LLM Agents on Algorithmic Trading with Self-Generated MCQs
Backtrader-Bench 是一个用于评估 LLM 代理在算法交易中表现的基准测试框架,通过自生成 MCQ 进行评估。
Retrofitting Recurrent Depth into a Pretrained Language Model: Installation, Extrapolation, Transfer, and Retention at Two Parameter Budgets
本文探讨了如何将循环深度改造进预训练语言模型,以实现更高效的迭代潜在转换。
TRACE Bench: Task-driven Roleplay Agentic Checklist Evaluation
TRACE Bench 是一个任务驱动的角色扮演代理检查表评估框架,旨在提供更细致的评估反馈。
Lost in Compaction: Evaluating Side-Constraint Loss under Context Compaction
本文研究了在上下文压缩过程中,用户会话约束(Session Constraints)丢失的问题。
Diffuse to Compress: Leveraging Diffusion LMs for Lossless Compression
本文研究了利用扩散语言模型进行无损文本压缩的方法,以应对数字文本数据增长的挑战。
Gloss-Free Representation Learning for Cross-Dataset Sign Spotting
本文提出了一种无需词汇表(Gloss-Free)的表示学习方法,用于跨数据集的手语识别。
Better, Faster, Stronger: Programmatic Skill Learning Best Reduces Agent Cost
本文探讨了通过程序化技能学习来降低 AI 代理成本的方法,强调了技能学习在成本效益方面的优势。
Self-Evolving Embodied Agents via Skill-Harness Evolution
本文研究了通过技能控制框架演化来实现具身代理的自我进化。
WIRED
Mark Zuckerberg’s AI Manifesto Is 6,500-Words—and Barely Says Anything
本文评论了马克·扎克伯格长达 6500 字的 AI 宣言,认为其内容空洞,缺乏实质性的技术或战略洞察。
The Painful Truth of Exactly How ICE’s New Shock Gloves Work
ICE 正在投入数百万美元采购电击手套,旨在通过局部剧烈疼痛来制服目标,引发了关于执法手段人道性的争议。
Why This Prediction Market Banned Teens
预测市场 Novig 宣布禁止青少年参与,CEO Jacob Fortinsky 强调其平台与其它投机性预测市场有着本质区别。
The Best Samsung Galaxy S26 Cases (2026): S26, S26+, and S26 Ultra
本文推荐了 2026 年度三星 Galaxy S26 系列的最佳手机壳和屏幕保护膜。
The Google Pixelsnap Charger With Stand Is 50 Percent Off Right Now
Google Pixelsnap 无线充电支架目前半价促销,支持 Qi2 快速无线充电,性价比极高。
In a Heat Wave, Schizophrenia Is So Much Deadlier Than Any Other Medical Condition
研究表明,在热浪期间,精神分裂症患者面临的死亡风险远高于其他医疗状况,气候变化对弱势群体构成了严重威胁。
5 Best Android Tablets in 2026: Samsung, TCL, Amazon, and More
本文盘点了 2026 年度五款最佳 Android 平板电脑,涵盖了从娱乐到办公的多种需求。
The 10 Best Cooling Mattresses for Hot Sleepers (2026)
本文测评了 10 款最佳凉感床垫,帮助怕热的用户在炎炎夏日获得更好的睡眠体验。
CBP Workers Allegedly Used Government Databases to Spy on Exes, Crushes, and Colleagues
记录显示,美国海关及边境保卫局(CBP)员工多次滥用政府数据库,窥探前伴侣、暗恋对象及同事的个人信息。
There’s a Fatty Liver Epidemic. AI Could Help Get Ahead of It
全球有超过十亿人患有脂肪肝,研究人员认为 AI 工具能够早期识别该病症,从而挽救生命。
Lobsters
python’s pre-declared constants are kinda weird
本文讨论了 Python 中预声明常量的奇怪行为,引发了社区关于语言特性的讨论。
EuroZig
EuroZig 是一个关于 Zig 语言的讨论话题。
I want extern “fil-c”
作者探讨了在编程中引入 extern "fil-c" 的需求及其潜在的实现方式。
AI is removing the middle class of software engineering
本文探讨了 AI 如何通过自动化任务,逐渐削弱软件工程领域中层职位的需求。
GitHub Stacks in Jujutsu
本文介绍了如何在 Jujutsu 版本控制系统中管理 GitHub Stacks。
Does anyone run Postgres without PgBouncer?
本文讨论了在不使用 PgBouncer 的情况下运行 Postgres 的可行性及相关挑战。
How Tailscale helped find the SQLite WAL-Reset bug
Tailscale 分享了其如何协助定位并修复 SQLite WAL-Reset 漏洞的过程。
I hate packaging my software for Linux
作者表达了对 Linux 软件打包流程的挫败感,引发了关于跨平台分发难度的讨论。
DEV Community
Nmap for Authorized Infrastructure Validation (Not Hacking)
本文介绍了如何利用 Nmap 进行授权的基础设施验证,确保网络配置符合安全策略,而非用于黑客攻击。
What Building a C++ Benchmarking Suite Taught Me About “Simple” Data Structures
作者分享了在构建 C++ 基准测试套件过程中,对数组、链表和哈希表等基础数据结构在理论与实践中差异的深刻理解。
Reflecting on 7-8 Years of Career Growth: Adaptability and Continuous Learning Key to Senior Data Engineer Success
本文回顾了数据工程师 7-8 年的职业成长路径,强调了适应能力和持续学习在晋升高级职位中的关键作用。
ChatGPT Work Brings Desktop Automation, Memory and Governance Into the AI Workflow
ChatGPT Work 桌面版引入了桌面自动化、记忆功能和治理机制,将 AI 从简单的对话工具提升为具备操作能力的生产力助手。
The Kubernetes Checklist for Teams Without a Platform Team
本文为没有专门平台团队的小型工程团队提供了一份 Kubernetes 运维检查清单,帮助他们更好地管理集群。
Mastering Low-Precision AI: FP8 and FP4 Support Across Frameworks in Mid-2026
本文介绍了 2026 年中期 FP8 和 FP4 低精度 AI 训练与推理在各框架中的支持情况,探讨了其在提升效率方面的作用。
Using Python to Analyze Customer Behavior
本文探讨了如何利用 Python 分析客户行为数据,从而为企业决策提供有价值的商业洞察。
What a Small-Business CRM Needs Beyond Contact Storage
作者指出,一个实用的 CRM 系统不仅是联系人存储,更是一个需要精心建模的运营系统,以保持业务上下文的连贯性。
Shipping an Isometric Game in the Browser With Three.js
本文分享了使用 Three.js 开发浏览器端等距视角游戏的架构经验,特别强调了启动路径的优化。
Design Notes for a Deterministic C++ Simulation Framework
本文探讨了构建确定性 C++ 仿真框架的设计考量,强调了在多线程环境下保持输入输出一致性的重要性。
Meta Engineering
How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees
WhatsApp 正在构建诈骗预警功能,在保护端到端加密隐私的同时,通过可验证性保证用户免受 AI 生成的诈骗信息干扰。
From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking
Meta 介绍了其广告排名系统的多阶段架构,通过建模用户行为序列,显著提升了广告推荐的精准度。
GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model
Meta 通过优化 GEM 训练流程,将端到端训练效率提升了一倍,实现了在数千个 GPU 上的高效扩展。
Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization
Meta 正在探索分层兴趣表示技术,旨在通过连接用户兴趣与广告实体,优化深层漏斗广告的转化效果。
Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler
Meta 通过引入开源内核调度器 sched_ext,定制了广告服务的调度策略,有效解决了延迟退化问题。
Meta’s AI Storage Blueprint at Scale
Meta 分享了其 AI 存储蓝图,强调了在模型能力和数据集规模指数级增长的背景下,快速可靠的存储对 AI 创新的重要性。
10 Years of Meta’s Commitment to Python
今年是 Meta 连续第 10 年赞助 Python 软件基金会(PSF),体现了其对 Python 语言生态的长期支持。
Privacy-Aware Infrastructure in the AI-Native Era: An Asset Classification Case Study
Meta 分享了其在 AI 原生时代构建隐私感知基础设施的案例,探讨了如何通过资产分类实现有效的隐私控制。
How Meta Engineered Ultra-Narrow Batteries for AI Glasses
Meta 介绍了其如何为智能眼镜设计超窄电池,在有限的镜腿空间内实现高性能供电。
DeepMind Blog
Introducing Gemini 3.7 Flash
Google DeepMind 发布了 Gemini 3.7 Flash 模型。
Putting sign language AI into users’ hands
DeepMind 推出了手语转文字(SL2T)模型,为聋哑和听障用户提供全新的手语交互功能。
WeatherNext: AI model achieves breakthrough in forecasting cyclones
WeatherNext 模型在气旋预测方面取得了突破性进展。
Gemini Robotics ER 2: powering robotics with video understanding, task orchestration, and multi-robot collaboration
Gemini Robotics ER 2 增强了机器人的视频理解、任务编排和多机器人协作能力。
We’re launching Lyria 3.5 in Google Flow Music, with advances across musicality, lyrics, vocals, and creative control
Lyria 3.5 在 Google Flow Music 中发布,在音乐性、歌词、人声和创作控制方面均有显著提升。
Gemini Robotics 2 brings whole body intelligence to robots
Gemini Robotics 2 为机器人带来了全身智能,提升了其在复杂环境下的运动和交互能力。
Accelerating the frontiers of scientific discovery: Google’s $40M commitment to the Genesis Mission
Google 承诺投入 4000 万美元的 AI 代币和算力额度,支持 Genesis Mission 的科学发现。
Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
Google 介绍了 Gemini 系列的新成员,包括 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。
Introducing Gemini 3.5 Flash Cyber
Gemini 3.5 Flash Cyber 是一款轻量级网络安全模型,专门用于发现和修补漏洞。
Our approach to bioresilience
Google DeepMind 与 Isomorphic Labs 分享了其在生物韧性(bioresilience)和 AI 模型方面的共同方法。
VentureBeat AI
Google just redesigned the search box for the first time in 25 years — here’s why it matters more than you think.
Google 对其搜索框进行了 25 年来的首次重新设计,标志着搜索范式的重大转变。
[Read more →](https://venturebeat.com/technology/google-just-redesigned-the-search-box-for-the-first-time-in-25-years-