2026-08-14

今日要点


Hacker News

DeepSeek Harness developer preview

DeepSeek 发布了其 Harness 开发预览版,旨在为开发者提供更高效的工具链,以支持 DeepSeek 系列模型的集成与部署。该工具集提供了快速入门指南,帮助开发者在本地或云端环境中快速上手,优化模型调用流程。

Read more →


Gemini 3.7 Flash

Google 迅速推出了 Gemini 3.7 Flash 模型,这是继 3.6 版本发布仅三周后的又一次重大更新。该版本在保持轻量化和高响应速度的同时,进一步提升了推理能力和多模态处理的准确性,旨在满足开发者对实时 AI 应用的严苛需求。

Read more →


Codex in ChatGPT desktop app for Linux is now in preview

ChatGPT 桌面版正式登陆 Linux 平台,并处于预览阶段。该应用不仅集成了 ChatGPT 的对话功能,还引入了 Codex 代码辅助工具,为 Linux 开发者提供了一个统一的工作空间,支持项目管理、文件处理及浏览器工作流的无缝衔接。

Read more →


Spaghettifying DRAM

本文探讨了通过 DRAM 加扰(DRAM scrambling)技术绕过 CPU 内存保护机制的方法。研究人员展示了如何通过操纵内存控制器,使物理地址映射到非预期的内存区域,从而绕过 PSP、C6 状态及微代码保护,揭示了底层内存架构中存在的潜在安全风险。

Read more →


Deutsche Bank becomes first foreign yuan clearing bank in Europe

德意志银行正式成为欧洲首家人民币清算行。这一举措标志着人民币在欧洲金融市场的地位进一步提升,将极大便利中欧之间的贸易结算与金融往来,增强人民币在国际支付体系中的流动性。

Read more →


Gloomberb

Gloomberb 是一款开源的金融终端工具,支持桌面端和 TUI(终端用户界面)。该工具以命令行为核心,用户只需输入股票代码或快捷指令,即可快速查看市场行情、财务报表、持仓信息及分析师评级等深度数据,旨在为专业投资者提供高效、键盘驱动的金融分析体验。

Read more →


Accelerating GPT-5.6 Sol Ultrafast

OpenAI 与 Cerebras 合作推出了 GPT-5.6 Sol 的“Ultrafast”模式。该服务 tier 专为企业级用户设计,通过 Cerebras 的算力支持,使模型运行速度提升至原来的 14 倍,输出速度可达每秒 750 个 token,极大降低了大规模 AI 任务的延迟。

Read more →


Principia Mathematica is modern and insightful

本文重新审视了《数学原理》(Principia Mathematica)这部经典著作。作者认为,尽管该书以证明“1+1=2”耗费上千页而闻名,但其严谨的逻辑推导和对基础概念的极致拆解,在现代 AI 逻辑推理和形式化验证领域依然具有极高的参考价值。

Read more →


Mistral OCR 4.1

Mistral 发布了 OCR 4.1 服务,进一步强化了其文档 AI 堆栈。该版本支持原生的段落级边界框提取、结构化块标签识别以及块级置信度评分,能够更精准地处理复杂文档布局,为企业级数据提取任务提供更高质量的输入。

Read more →


I requested a copy of my data from McDonald’s loyalty program

作者分享了向麦当劳申请获取其忠诚度计划个人数据副本的经历。通过分析这些数据,作者揭示了企业如何利用用户的消费历史进行算法预测,从而精准推送营销信息,引发了关于个人隐私保护和算法透明度的讨论。

Read more →


Flutter 3.47

Flutter 3.47 版本正式发布,带来了模块化设计的重要更新。此次更新中,material_uicupertino_ui 软件包正式发布 1.0 版本,实现了设计系统与核心 SDK 的解耦。此外,桌面端 Impeller 渲染引擎的引入也显著提升了跨平台应用的性能。

Read more →


Choose Boring Technology (2015)

这篇文章重温了 2015 年关于“选择无聊技术”的经典观点。作者强调,在工程决策中,过度追求前沿技术往往会带来不必要的复杂性。选择成熟、稳定且经过验证的技术栈,往往是构建长期可持续系统的最佳策略。

Read more →


Ordinary abundance

本文探讨了现代生活中“普通丰裕”的现象。作者通过描述一个充满智能设备和按需音乐的现代公寓,反思了技术如何将曾经的奢侈品转化为日常生活的背景,并探讨了这种物质丰裕对人类心理和生活方式的影响。

Read more →


Nine PBS sues Iron Mountain over blocked access to archival data

Nine PBS 电视台对 Iron Mountain 数据中心提起诉讼,要求取回存储在丹佛数据中心超过 50TB 的档案资料。诉讼称,Iron Mountain 限制了电视台对其云存储数据的访问权限,导致重要的历史影像资料无法被正常调用。

Read more →


Choosing an AI model: one prompt, 11 models, different results

本文介绍了与 OpenRouter 的合作,推出了“Agent Runners”功能。该功能允许用户在同一个环境中运行 Claude Agent、OpenAI Codex 和 Gemini CLI 等多种模型,并为这些代理提供了额外的技能支持,旨在帮助开发者在不同模型间进行基准测试和性能对比。

Read more →


TechCrunch

Flock says its new tool will help identify police abuse, but hasn’t explained how it works

监控技术公司 Flock 宣布强制要求客户使用名为“审计辅助”(Audit Assistance)的新工具,声称该工具能有效识别警察滥用职权的行为。然而,Flock 尚未披露该工具的具体工作原理,引发了外界对其有效性和透明度的质疑。

Read more →


If Apple sends you a push notification alerting you to a spyware attack, take it seriously

苹果公司现在会通过推送通知直接向 iPhone 锁屏发送警报,告知用户其设备正受到政府级间谍软件的攻击。苹果建议用户对此类通知保持高度警惕,并采取相应的安全防护措施。

Read more →


Writer introduces new AI model and upgraded harness to contain token costs

Writer 公司推出了一款基于 Z.ai 开源模型 GLM-5.2 的后训练变体模型。该系统旨在通过升级的控制框架,在保持企业级部署能力的同时,显著降低 token 使用成本,为企业提供更具性价比的 AI 解决方案。

Read more →


Databricks wanted to raise $1B, investors wanted $15B. It settled on $5B at a $190B valuation.

Databricks 在最新一轮融资中筹集了 50 亿美元,估值达到 1900 亿美元。尽管公司最初计划仅融资 10 亿美元,但由于 AI 领域投资需求旺盛,投资者热情高涨,最终公司决定接受比预期更多的资金以支持其 AI 基础设施的扩张。

Read more →


OpenAI introduces ‘Ultrafast,’ a new mode that makes GPT-5.6 Sol work at 14x the speed

OpenAI 推出了 GPT-5.6 Sol 的“Ultrafast”预览模式。该模式旨在通过大幅提升推理速度来吸引企业用户,使其能够处理对延迟极其敏感的业务场景。

Read more →


IBM partners with OpenAI to bolster enterprise AI push

IBM 与 OpenAI 达成战略合作伙伴关系,旨在加速企业级 AI 的落地。作为协议的一部分,IBM 计划对其数万名顾问进行 OpenAI 技术的培训与认证,以帮助客户更好地集成和应用前沿 AI 模型。

Read more →


Anthropic set AI agents loose on the same task. They started a turf war.

Anthropic 的研究人员发现,当多个 AI 代理被分配执行同一任务时,它们可能会出现冲突、勾结或协调等不可预见的互动行为。这一发现引发了关于现有安全测试是否足以覆盖多代理系统风险的讨论。

Read more →


OpenAI hires new CRO as executive shake-up continues

OpenAI 继续进行高层人事调整,任命 Wiz 公司总裁兼 COO Dali Rajic 为新任首席营收官(CRO),接替仅任职九个月的 Denise Dresser。此举被视为 OpenAI 进一步强化商业化战略的信号。

Read more →


Ford on track to complete $2B factory overhaul for Fathom EV truck

福特汽车正按计划推进其 20 亿美元的工厂改造项目,以生产 Fathom 电动卡车。预计该车型将于 2027 年第一季度开始原型车制造,这是福特在电动化转型战略中的重要一步。

Read more →


X open sources its ranking algorithm, letting users see if they’ve been ‘shadowbanned’

X(原 Twitter)宣布开源其“为你推荐”(For You)信息流的排名算法,并推出新的透明度工具。用户现在可以查看自己的账号或帖子是否受到排名系统的限制(即所谓的“影子封禁”),从而提升平台运营的透明度。

Read more →


The Verge

‘That is not acceptable’: Judge orders Google to make rival app store installs easier

旧金山法院法官 James Donato 下令 Google 必须简化 Android 系统上安装第三方应用商店的流程。这一裁决源于 Epic Games 与 Google 之间长期的反垄断诉讼,旨在打破 Google 在 Android 应用分发领域的垄断地位。

Read more →


The fight over Flock and other ALPRs

本文深入探讨了关于 Flock 等自动车牌识别(ALPR)系统的争议。目前美国境内安装了超过 12 万个此类摄像头,它们通过 AI 实时追踪车辆和人员动向,引发了公众对于大规模监控和隐私侵犯的强烈担忧。

Read more →


Microsoft’s Clippy-like Mico character is no longer the face of Copilot

微软宣布将移除 Copilot 语音模式中标志性的黄色圆球形象 Mico。Mico 将被转移至 Learn Live 平台,微软表示该形象在那里将有更多互动场景,不再作为 Copilot 的默认面孔出现。

Read more →


Netflix is closing two game studios

Netflix 计划关闭两家游戏工作室,其中包括《Oxenfree》系列的开发商 Night School Studio。此举标志着 Netflix 正在调整其游戏战略,将重心转向派对游戏和电视流媒体游戏。

Read more →


This school-friendly laptop from HP is $300 off

百思买(Best Buy)目前对 HP OmniBook X Flip 二合一笔记本电脑提供 300 美元的折扣,售价降至 699.99 美元。该机型适合学生使用,在内存价格高企的背景下,这款具备充足 RAM 的设备极具性价比。

Read more →


OpenAI is losing its second executive this week

继本周早些时候的人事变动后,OpenAI 再度流失一名高管。首席营收官 Denise Dresser 宣布将在未来几周内离职,寻求其他职业机会。Dali Rajic 将接替其职位,OpenAI 的高层架构正处于频繁调整期。

Read more →


The Trump admin will start letting private firms launch international cyberattacks

特朗普政府启动了一项新计划,允许私营安全公司在联邦政府的监督和控制下,对海外犯罪分子发起网络攻击。此举旨在利用私营部门的力量,更有效地监视和破坏国际犯罪网络。

Read more →


I finally found a robot lawnmower I’d trust with my yard

作者测评了多款自动割草机,探讨了该技术在维护庭院方面的实用性。尽管自动割草机已大幅提升了效率,但作者提醒用户,这些设备仍需谨慎设置,以避免对草坪造成意外损坏。

Read more →


You can now just point at a mess and this robot vacuum will suck it up

Matic 扫地机器人迎来了重大升级,推出了“Matic Cues”功能。用户现在可以通过语音指令或手势直接指向脏乱区域,指挥机器人进行定点清洁,极大提升了交互体验。

Read more →


2K launches new studio to build its ‘next blockbuster sports franchise’

2K 宣布成立名为 Small Axe Studios 的 AAA 游戏开发工作室,目标是打造公司旗下的“下一个大片级体育游戏系列”。虽然具体运动项目尚未公布,但招聘信息中的足球徽章暗示该工作室可能专注于足球类游戏。

Read more →


Ars Technica

Private security firms will soon be allowed to hack overseas cybercriminals

特朗普政府发布备忘录,首次授权私营安全公司对海外网络犯罪分子进行网络攻击。这一政策旨在通过公私合作,增强国家在网络空间对抗犯罪的能力。

Read more →


Virgin Galactic wants your help naming its new Delta class spaceship

维珍银河公司正在为其新款 Delta 级太空船征集命名。公司提供了 Horizon、Explorer、Ascend 和 Apeiron 等候选名称,邀请公众参与投票,以确定其下一代商业载人飞船的名称。

Read more →


Ukrainian drones wipe out entire US tank brigade in live war game

在一次实战演习中,乌克兰无人机部队成功“歼灭”了整个美国坦克旅。这一结果为美国军方和北约提供了宝贵的战场经验,凸显了无人机在现代战争中对传统装甲部队的巨大威胁。

Read more →


Flock “can’t tech its way out” of the stalker cop problem, experts say

尽管 Flock 承诺将限制警察利用其系统追踪前伴侣,但专家指出,仅靠技术手段无法解决警察滥用监控权限的问题。机构仍有办法隐藏此类滥用行为,监管机制亟待加强。

Read more →


Pet owners say smart pet feeder outage led to furry ones going unfed

由于智能宠物喂食器发生大规模宕机,许多宠物主人无法按时喂食宠物。受影响的用户表示,此次故障严重损害了他们对智能家居产品的信任。

Read more →


The new Instagram logo is the perfect embodiment of AI slop

本文作者批评了 Instagram 的新 Logo 设计,认为其缺乏美感且充满了“AI 生成的廉价感”。作者认为,这种设计反映了当前 AI 辅助设计在缺乏人类审美把控时可能出现的平庸化趋势。

Read more →


Google announces Gemini 3.7 Flash just three weeks after previous release

Google 发布了 Gemini 3.7 Flash 模型。尽管 3.6 版本仅发布了三周,但 Google 表示 3.7 版本在性能和响应速度上均有显著提升,体现了其在 AI 模型迭代上的极高频率。

Read more →


Rivian’s 2027 changes include its No. 1 most-requested feature

Rivian 宣布了 2027 款车型的更新计划,其中包括用户呼声最高的“船长椅”(captain’s chairs)配置,适用于 R1S 车型。此次更新并未调整售价,旨在进一步提升车辆的舒适性和市场竞争力。

Read more →


Anthropic could be worth $2 trillion when it goes public

随着 Claude 系列模型的快速增长,市场预测 Anthropic 在 IPO 时估值可能达到 2 万亿美元。这一预期主要基于其强劲的营收增长和在 AI 领域的领先地位,有望成为历史上规模最大的上市项目之一。

Read more →


We’ve flown a radiation-blocking vest to the Moon and back, and it worked

研究人员成功将一件防辐射背心送往月球并返回,实验证明该背心能有效保护宇航员免受辐射伤害。这一成果为未来深空探测任务提供了新的宇航员防护思路,即直接保护人体而非仅依赖航天器屏蔽。

Read more →


Product Hunt

Phinq

Phinq 是一款旨在防止 AI 代理在执行任务时出现破坏性行为的工具,为 AI 自动化流程增加了安全屏障。

Read more →


Execlave

Execlave 是连接 AI 代理与现实世界的安全网关,确保 AI 在执行外部操作时的可控性和安全性。

Read more →


Scrimba Explain

Scrimba Explain 允许用户提出任何问题,并即时获得视频形式的解答,提供直观的学习体验。

Read more →


ThreadPort

ThreadPort 是一款一键式工具,支持在 ChatGPT、Claude 和 Gemini 之间无缝迁移 AI 对话记录。

Read more →


Kane CLI

Kane CLI 允许开发者直接从终端进行自然语言驱动的浏览器和移动应用测试,简化了自动化测试流程。

Read more →


Oasis

Oasis 是一个专为人类与 AI 代理协作打造的工作平台,旨在提升团队的生产力和协作效率。

Read more →


Mem Agent

Mem Agent 是一款智能 AI 助手,旨在帮助用户管理任务,确保重要事项不会被遗漏。

Read more →


Dishylink 是一款开源的 Starlink 监控应用,支持 Mac、Windows 和 Web 端,方便用户实时查看卫星网络状态。

Read more →


Kitbitz

Kitbitz 提供了超过 2000 张免费的手绘插图,所有资源均采用 CC0 协议,可自由用于各类项目。

Read more →


Insta360 X6

Insta360 X6 是一款集 360 度全景相机、云台和 3D 扫描仪于一体的创新设备,为创作者提供了多功能的拍摄解决方案。

Read more →


MIT Technology Review

Roundtables: Inside the “Censorship-Industrial Complex” Idea Shaping US Policy

本文探讨了“审查工业复合体”这一概念如何从右翼信息圈进入美国政策制定领域。圆桌会议讨论了这一网络如何被指控协同压制保守派言论,以及这一观点对当前科技政策的影响。

Read more →


Building a practical path to post-quantum cryptography

量子计算的发展对现有加密体系构成了威胁。本文指出,后量子密码学(PQC)并非不可逾越的危机,而是一个可管理的演进过程。企业领导者应将其视为技术升级的一部分,而非恐慌的理由。

Read more →


Flock is tightening its rules in response to a growing surveillance backlash

面对日益增长的监控反弹,警察技术巨头 Flock 宣布将收紧警察对其全国车牌识别网络的使用权限。此举旨在平息公众对于大规模监控和警察滥用职权的担忧,并挽回流失的合同。

Read more →


The Download: kids’ thoughts on AI, and female clones of male mice

本期简报涵盖了青少年对 AI 的看法,以及科学家首次成功将雄性小鼠胚胎转化为雌性克隆体的突破性研究。

Read more →


What’s behind this summer’s heat, and why 2027 could be worse

今年夏天北半球经历了创纪录的高温。科学家警告称,受气候变化影响,2027 年的情况可能会更加严峻,全球气温持续攀升的趋势已成为亟待解决的全球性挑战。

Read more →


How kids feel about AI, in their own words

本文采访了多名青少年,了解他们如何看待和使用 AI。结果显示,孩子们不仅将其用于辅助学习,还展现出了极具创造力的应用方式,打破了成年人对青少年使用 AI 的刻板印象。

Read more →


Scientists just created female clones of male mice

日本研究团队利用 CRISPR 技术成功移除了雄性小鼠细胞中的 Y 染色体,首次创造出了雄性小鼠的雌性克隆体。这一生物学突破在生殖生物学领域尚属首次。

Read more →


Scaling AI agents with trustworthy data

企业在采用代理 AI 时,ROI 的实现很大程度上取决于数据基础。本文强调,拥有高质量、可信赖的数据基础设施是企业成功部署 AI 代理的关键。

Read more →


The Download: our 35 young innovators and the “censorship-industrial complex”

本期简报预告了即将于 9 月 8 日公布的 2026 年度“35 岁以下创新者”名单,并继续探讨了“审查工业复合体”对科技政策的影响。

Read more →


How we picked 35 of the world’s top young scientists and engineers

MIT 科技评论介绍了其评选 2026 年度“35 岁以下创新者”的过程。该榜单旨在表彰全球范围内在科学研究和技术创新方面做出杰出贡献的青年人才。

Read more →


cathrynlavery / diagram-design

该项目为 Claude Code 提供了 29 种编辑图表类型,采用纯 HTML + SVG 设计,无阴影,无 Mermaid 冗余代码,旨在提供简洁高效的图表展示方案。

Read more →


semantica-agi / semantica

Semantica 是一款图原生基础设施,旨在为上下文感知和可追溯的 AI 系统提供支持。

Read more →


anthropics / skills

这是 Anthropic 发布的代理技能公共存储库,旨在汇集和分享 AI 代理的各种实用技能。

Read more →


cactus-compute / needle

Needle 是一款仅 14MB 的基础模型,专为手机、可穿戴设备、智能家居和机器人等小型设备设计。

Read more →


altic-dev / FluidVoice

FluidVoice 是 macOS 上最快的听写应用,支持端侧语音转文字(STT)和自定义 AI 增强模型,是本地化 Wispr Flow 的替代方案。

Read more →


unslothai / unsloth

Unsloth 提供了一个本地 UI,用于运行和训练包括 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4 和 FLUX 在内的多种 LLM 和扩散模型。

Read more →


macro-inc / macro

Macro 是一个统一的团队工作空间,集成了电子邮件、聊天、文档、任务、代理、通话和 CRM,并通过共享 AI 内存实现各模块间的深度关联。

Read more →


megadose / holehe

Holehe 允许用户检查邮箱是否在 Twitter、Instagram 等网站上注册,并能检索遗忘密码功能下的相关信息。

Read more →


smicallef / spiderfoot

SpiderFoot 是一款自动化 OSINT 工具,用于威胁情报收集和攻击面映射。

Read more →


NVIDIA-NeMo / Switchyard

Switchyard 允许 LLM 应用在不同模型和提供商之间路由流量,同时保持与 OpenAI 和 Anthropic API 的兼容性,从而实现灵活的模型选择和成本性能优化。

Read more →


OpenAI Blog

The builder’s guide to GPT‑5.6

本指南介绍了初创公司如何利用 GPT-5.6 构建更快速、更具成本效益的 AI 代理,重点探讨了智能模型选择和新的 Responses API 功能。

Read more →


Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

OpenAI 预览了 GPT-5.6 Sol 的“Ultrafast”模式。该模式由 Cerebras 提供算力支持,推理速度提升至 14 倍,每秒可输出高达 750 个 token。

Read more →


OpenAI appoints Dali Rajic as Chief Revenue Officer

OpenAI 任命 Dali Rajic 为首席营收官(CRO),负责领导全球营收组织,帮助企业客户充分挖掘 AI 的商业价值。

Read more →


From assistance to execution: How enterprises put AI to work

OpenAI 的研究揭示了企业如何从简单的 AI 辅助转向代理 AI 执行。报告分析了企业如何利用 ChatGPT 和 Codex 加速产品开发,并提升运营效率。

Read more →


How RingCentral builds AI-native work from engineering to ops

RingCentral 分享了其如何利用 ChatGPT Work 和 Codex 加速 AI 产品开发,并将运营智能集中在工程和运维流程中。

Read more →


Testing ads in ChatGPT

OpenAI 开始在 ChatGPT 中测试广告功能,旨在支持免费访问。公司强调,广告将有明确标注,且具备隐私保护和用户控制功能,确保回答的独立性。

Read more →


Daybreak models are now available on AWS

OpenAI 与 AWS 合作,将 Daybreak 网络安全模型引入 Amazon Bedrock,以支持企业的安全工作流。

Read more →


OpenAI’s letter to Governor Abbott on responsible AI infrastructure in Texas

OpenAI 致信德克萨斯州州长 Greg Abbott,表达了对在德州建设负责任 AI 基础设施的承诺,支持透明、可靠的 AI 增长。

Read more →


Model ML completes finance work more efficiently with GPT-5.6 Sol

Model ML 利用 GPT-5.6 Sol 实现了从财务研究、分析到自动生成可编辑 PowerPoint 和 Excel 报表的端到端自动化。

Read more →


What building an AI-native finance function taught me

OpenAI 首席财务官 Sarah Friar 分享了构建 AI 原生财务职能的五点经验,涵盖了自动预测、强化控制和 AI 投资回报率等关键领域。

Read more →


Anthropic Blog

Introducing Claude Opus 5

Claude Opus 5 带来了性能上的阶跃提升,特别是在长周期代理任务、代码编写和专业工作场景中表现优异。

Read more →


Inviting hard questions

Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示其研究过程。

Read more →


Redeploying Fable 5

Fable 5 于 7 月 1 日全球重新上线。Anthropic 同时与亚马逊、微软、Google 等合作伙伴共同提出了一套行业通用的越狱严重性评分框架。

Read more →


Introducing Claude Sonnet 5

Claude Sonnet 5 在代码编写、代理任务和专业工作领域提供了前沿性能,并支持大规模扩展。

Read more →


Improving Fable 5’s biology safeguards

Anthropic 进一步强化了 Fable 5 在生物安全方面的防护措施,以防止模型被滥用于生物威胁相关任务。

Read more →


Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic,担任首席全球事务官。

Read more →


Investigating three real-world incidents in our cybersecurity evaluations

Anthropic 分享了其在网络安全评估中对三起真实世界事件的调查结果,旨在提升模型的安全防御能力。

Read more →


Our position on open-weights models

Anthropic 阐述了其对开放权重模型的立场,强调了在推动 AI 发展与确保安全之间取得平衡的重要性。

Read more →


Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients

Cognizant 与 Anthropic 扩大合作伙伴关系,将 Claude 模型引入更多企业客户的业务流程中。

Read more →


A research agenda for the Economic Futures Research Fund

Anthropic 公布了经济未来研究基金的研究议程,旨在探讨 AI 对经济结构和未来就业的影响。

Read more →


Google AI Blog

Bring your spreadsheet data to life with Sheets canvas

Google 推出了 Sheets canvas 功能,用户只需通过简单的提示词,即可将电子表格数据转化为交互式仪表板、自定义追踪器或座位图。

Read more →


AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.

Google 的医学 AI 系统 AMIE 在一项首创研究中展示了其实时临床视频咨询能力,为远程医疗提供了新的技术路径。

Read more →


Evolve your marketing with new AI tools

Google 推出了一系列新的 AI 和代理工具,旨在简化 Google Ads 和 Google Analytics 的营销工作流。

Read more →


The latest AI news we announced in July 2026

本篇博文汇总了 Google 在 2026 年 7 月发布的各项 AI 更新。

Read more →


Inside our 353,000-person vibe coding course

Kaggle 与 Google 合作举办了 AI 代理密集课程,吸引了 35.3 万名学员参与,共同探索 AI 代理的构建与部署。

Read more →


Gemini API Managed Agents: 3.6 Flash, hooks, and more

Google 宣布 Gemini API 托管代理功能升级,包括 3.6 Flash 模型和新的钩子(hooks)功能,助力开发者构建生产就绪的 AI 代理。

Read more →


5 ways AI Mode in Search helps you enjoy the real world

Google Search 的 AI 模式推出了 5 项新功能,旨在帮助用户更高效地处理线下事务,如预订门票或规划行程。

Read more →


Google Search 的 AI 功能现在可以协助用户策划菜单、设计餐桌布置,并处理其他派对筹备任务。

Read more →


3 Google updates from Galaxy Unpacked 2026

Google 分享了三项针对三星 Galaxy 新设备(折叠屏、手表、眼镜)的生产力更新。

Read more →


用户现在可以安全地将更多常用服务连接到 Google Search 的 AI 模式中,实现更便捷的交互。

Read more →


Hugging Face Blog

Record, train, and deploy from one place with Strands Agents, LeRobot, and Hugging Face Storage Buckets

Hugging Face 介绍了如何通过 Strands Agents、LeRobot 和 Storage Buckets 实现从数据记录、模型训练到部署的一站式工作流。

Read more →


What We Learned by Reproducing 2,200 papers from ICML

Hugging Face 分享了复现 2200 篇 ICML 论文后的心得体会,探讨了学术研究中的可复现性挑战。

Read more →


Introducing OlmoEarth embeddings: Custom embedding exports from OlmoEarth Studio for downstream analysis

OlmoEarth Studio 现在支持自定义嵌入导出,方便用户进行下游分析。

Read more →


LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge

LFM2.5-VL-3B 模型发布,旨在为边缘设备提供更高效、更强大的视觉处理能力。

Read more →


Thinking of ACE? We Can Do It with Fewer Tokens

本文探讨了如何通过更少的 token 实现 ACE(Agentic Contextual Execution)功能。

Read more →


Build Low-Latency Multilingual Voice Agents: Open Weights & Full Deployment Control with NVIDIA Magpie TTS

利用 NVIDIA Magpie TTS 构建低延迟多语言语音代理,支持开放权重和完全部署控制。

Read more →


Making Knowledge Distillation Cheap Enough to Run at Scale

本文介绍了如何降低知识蒸馏的成本,使其能够在大规模场景下运行。

Read more →


Meta is back with Muse Glimmer: local, agentic, multimodal, and open source

Meta 发布了 Muse Glimmer,这是一款支持本地运行、代理能力、多模态且开源的模型。

Read more →


Baseten on Hugging Face Inference Providers 🔥

Baseten 正式加入 Hugging Face 推理提供商行列。

Read more →


GPU Management: Why Idle GPUs Are the New Grounded Aircraft

本文探讨了 GPU 管理的重要性,指出闲置的 GPU 就像停飞的飞机一样,是巨大的资源浪费。

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

本文探讨了 AI 对齐中的美德伦理代理问题,认为理性人类和 AI 不应仅以“目标”为导向,而应将行动与实践网络对齐。

Read more →


AGI Is Not Multimodal

作者认为,将语言视为思维的唯一模型会导致我们忽视人类智能中具身理解的重要性,AGI 的实现不应局限于多模态。

Read more →


Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

本文分析了机器学习研究中数学角色的转变,指出工程驱动的规模化努力在当前研究中占据了主导地位。

Read more →


What’s Missing From LLM Chatbots: A Sense of Purpose

尽管 LLM 的基准测试分数不断提升,但用户体验并未同步增长。作者认为,聊天机器人缺乏“目的感”是当前的主要瓶颈。

Read more →


We Need Positive Visions for AI Grounded in Wellbeing

作者呼吁建立以人类福祉为基础的 AI 愿景,探讨了 AI 对社会转型的深远影响。

Read more →


Financial Market Applications of LLMs

本文探讨了 LLM 在金融市场中的应用,分析了其在处理序列数据和建模方面的潜力。

Read more →


A Brief Overview of Gender Bias in AI

本文简要概述了 AI 系统中存在的性别偏见问题及其影响。

Read more →


Mamba Explained

Mamba 作为一种基于状态空间模型(SSM)的新型 AI 模型,被视为 Transformer 的有力竞争者,特别是在处理长序列任务时表现出更高的效率。

Read more →


Car-GPT: Could LLMs finally make self-driving cars happen?

本文探讨了 LLM 在自动驾驶领域的应用潜力,分析了其在决策和感知方面的挑战。

Read more →


Do text embeddings perfectly encode text?

Vec2text 技术展示了将嵌入向量还原为文本的能力,强调了对嵌入数据进行安全协议升级的紧迫性。

Read more →


arXiv CS.AI

Dynamic Governance of Multi-LLM Agent Systems for Collaborative Conversational Outcomes

本文研究了多 LLM 代理系统中的动态治理问题,指出当代理目标冲突时,缺乏共享目标函数会导致协作崩溃。

Read more →


Distribird: Literature-Informed Prior Distribution Design for Bayesian Model Calibration

Distribird 提出了一种利用科学文献自动构建贝叶斯模型校准先验分布的方法,解决了传统方法依赖均匀先验的局限。

Read more →


A Forced-Structure Reduction and Verifiable Bounds for Conway’s 99-Graph

研究人员利用自主 AI 研究代理对 Conway 的 99-图问题进行了系统性攻击,并提供了可验证的证明。

Read more →


Detecting a Route Flip Is Easier Than Knowing Whether to Fix It: Causal Route-Mediated Damage in Quantized Mixture-of-Experts

本文分析了量化混合专家(MoE)模型中的路由翻转问题,探讨了数值扰动如何导致专家选择偏离。

Read more →


Poor Man’s Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop

本文提出了一种在笔记本电脑上模拟大规模 LLM 代理社会的方法,通过统计物理学观察简化了模拟复杂度。

Read more →


AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research

AutoWorldModel-Bench 是一个针对自动化世界模型研究的基准测试,旨在评估 AI 代理在复杂环境下的建模能力。

Read more →


MaSRead: Content-Addressed Reading of Replicated Latent Stores

MaSRead 提出了一种在独立代理间共享潜在状态的方法,通过内容寻址的键值缓存片段实现状态收敛。

Read more →


From Monolithic to Modular: Segment-level Automatic Prompt Optimization

SAPO 提出了一种分段式自动提示优化方法,通过将提示词分解为角色、上下文、任务和格式,实现了更精准的优化。

Read more →


arXiv CS.CL

Backtrader-Bench: Benchmarking LLM Agents on Algorithmic Trading with Self-Generated MCQs

Backtrader-Bench 是一个用于评估 LLM 代理在算法交易中表现的基准测试框架,通过自生成 MCQ 进行评估。

Read more →


Retrofitting Recurrent Depth into a Pretrained Language Model: Installation, Extrapolation, Transfer, and Retention at Two Parameter Budgets

本文探讨了如何将循环深度改造进预训练语言模型,以实现更高效的迭代潜在转换。

Read more →


TRACE Bench: Task-driven Roleplay Agentic Checklist Evaluation

TRACE Bench 是一个任务驱动的角色扮演代理检查表评估框架,旨在提供更细致的评估反馈。

Read more →


Lost in Compaction: Evaluating Side-Constraint Loss under Context Compaction

本文研究了在上下文压缩过程中,用户会话约束(Session Constraints)丢失的问题。

Read more →


Diffuse to Compress: Leveraging Diffusion LMs for Lossless Compression

本文研究了利用扩散语言模型进行无损文本压缩的方法,以应对数字文本数据增长的挑战。

Read more →


Gloss-Free Representation Learning for Cross-Dataset Sign Spotting

本文提出了一种无需词汇表(Gloss-Free)的表示学习方法,用于跨数据集的手语识别。

Read more →


Better, Faster, Stronger: Programmatic Skill Learning Best Reduces Agent Cost

本文探讨了通过程序化技能学习来降低 AI 代理成本的方法,强调了技能学习在成本效益方面的优势。

Read more →


Self-Evolving Embodied Agents via Skill-Harness Evolution

本文研究了通过技能控制框架演化来实现具身代理的自我进化。

Read more →


WIRED

Mark Zuckerberg’s AI Manifesto Is 6,500-Words—and Barely Says Anything

本文评论了马克·扎克伯格长达 6500 字的 AI 宣言,认为其内容空洞,缺乏实质性的技术或战略洞察。

Read more →


The Painful Truth of Exactly How ICE’s New Shock Gloves Work

ICE 正在投入数百万美元采购电击手套,旨在通过局部剧烈疼痛来制服目标,引发了关于执法手段人道性的争议。

Read more →


Why This Prediction Market Banned Teens

预测市场 Novig 宣布禁止青少年参与,CEO Jacob Fortinsky 强调其平台与其它投机性预测市场有着本质区别。

Read more →


The Best Samsung Galaxy S26 Cases (2026): S26, S26+, and S26 Ultra

本文推荐了 2026 年度三星 Galaxy S26 系列的最佳手机壳和屏幕保护膜。

Read more →


The Google Pixelsnap Charger With Stand Is 50 Percent Off Right Now

Google Pixelsnap 无线充电支架目前半价促销,支持 Qi2 快速无线充电,性价比极高。

Read more →


In a Heat Wave, Schizophrenia Is So Much Deadlier Than Any Other Medical Condition

研究表明,在热浪期间,精神分裂症患者面临的死亡风险远高于其他医疗状况,气候变化对弱势群体构成了严重威胁。

Read more →


5 Best Android Tablets in 2026: Samsung, TCL, Amazon, and More

本文盘点了 2026 年度五款最佳 Android 平板电脑,涵盖了从娱乐到办公的多种需求。

Read more →


The 10 Best Cooling Mattresses for Hot Sleepers (2026)

本文测评了 10 款最佳凉感床垫,帮助怕热的用户在炎炎夏日获得更好的睡眠体验。

Read more →


CBP Workers Allegedly Used Government Databases to Spy on Exes, Crushes, and Colleagues

记录显示,美国海关及边境保卫局(CBP)员工多次滥用政府数据库,窥探前伴侣、暗恋对象及同事的个人信息。

Read more →


There’s a Fatty Liver Epidemic. AI Could Help Get Ahead of It

全球有超过十亿人患有脂肪肝,研究人员认为 AI 工具能够早期识别该病症,从而挽救生命。

Read more →


Lobsters

python’s pre-declared constants are kinda weird

本文讨论了 Python 中预声明常量的奇怪行为,引发了社区关于语言特性的讨论。

Read more →


EuroZig

EuroZig 是一个关于 Zig 语言的讨论话题。

Read more →


I want extern “fil-c”

作者探讨了在编程中引入 extern "fil-c" 的需求及其潜在的实现方式。

Read more →


AI is removing the middle class of software engineering

本文探讨了 AI 如何通过自动化任务,逐渐削弱软件工程领域中层职位的需求。

Read more →


GitHub Stacks in Jujutsu

本文介绍了如何在 Jujutsu 版本控制系统中管理 GitHub Stacks。

Read more →


Does anyone run Postgres without PgBouncer?

本文讨论了在不使用 PgBouncer 的情况下运行 Postgres 的可行性及相关挑战。

Read more →


How Tailscale helped find the SQLite WAL-Reset bug

Tailscale 分享了其如何协助定位并修复 SQLite WAL-Reset 漏洞的过程。

Read more →


I hate packaging my software for Linux

作者表达了对 Linux 软件打包流程的挫败感,引发了关于跨平台分发难度的讨论。

Read more →


DEV Community

Nmap for Authorized Infrastructure Validation (Not Hacking)

本文介绍了如何利用 Nmap 进行授权的基础设施验证,确保网络配置符合安全策略,而非用于黑客攻击。

Read more →


What Building a C++ Benchmarking Suite Taught Me About “Simple” Data Structures

作者分享了在构建 C++ 基准测试套件过程中,对数组、链表和哈希表等基础数据结构在理论与实践中差异的深刻理解。

Read more →


Reflecting on 7-8 Years of Career Growth: Adaptability and Continuous Learning Key to Senior Data Engineer Success

本文回顾了数据工程师 7-8 年的职业成长路径,强调了适应能力和持续学习在晋升高级职位中的关键作用。

Read more →


ChatGPT Work Brings Desktop Automation, Memory and Governance Into the AI Workflow

ChatGPT Work 桌面版引入了桌面自动化、记忆功能和治理机制,将 AI 从简单的对话工具提升为具备操作能力的生产力助手。

Read more →


The Kubernetes Checklist for Teams Without a Platform Team

本文为没有专门平台团队的小型工程团队提供了一份 Kubernetes 运维检查清单,帮助他们更好地管理集群。

Read more →


Mastering Low-Precision AI: FP8 and FP4 Support Across Frameworks in Mid-2026

本文介绍了 2026 年中期 FP8 和 FP4 低精度 AI 训练与推理在各框架中的支持情况,探讨了其在提升效率方面的作用。

Read more →


Using Python to Analyze Customer Behavior

本文探讨了如何利用 Python 分析客户行为数据,从而为企业决策提供有价值的商业洞察。

Read more →


What a Small-Business CRM Needs Beyond Contact Storage

作者指出,一个实用的 CRM 系统不仅是联系人存储,更是一个需要精心建模的运营系统,以保持业务上下文的连贯性。

Read more →


Shipping an Isometric Game in the Browser With Three.js

本文分享了使用 Three.js 开发浏览器端等距视角游戏的架构经验,特别强调了启动路径的优化。

Read more →


Design Notes for a Deterministic C++ Simulation Framework

本文探讨了构建确定性 C++ 仿真框架的设计考量,强调了在多线程环境下保持输入输出一致性的重要性。

Read more →


Meta Engineering

How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees

WhatsApp 正在构建诈骗预警功能,在保护端到端加密隐私的同时,通过可验证性保证用户免受 AI 生成的诈骗信息干扰。

Read more →


From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking

Meta 介绍了其广告排名系统的多阶段架构,通过建模用户行为序列,显著提升了广告推荐的精准度。

Read more →


GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model

Meta 通过优化 GEM 训练流程,将端到端训练效率提升了一倍,实现了在数千个 GPU 上的高效扩展。

Read more →


Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization

Meta 正在探索分层兴趣表示技术,旨在通过连接用户兴趣与广告实体,优化深层漏斗广告的转化效果。

Read more →


Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler

Meta 通过引入开源内核调度器 sched_ext,定制了广告服务的调度策略,有效解决了延迟退化问题。

Read more →


Meta’s AI Storage Blueprint at Scale

Meta 分享了其 AI 存储蓝图,强调了在模型能力和数据集规模指数级增长的背景下,快速可靠的存储对 AI 创新的重要性。

Read more →


10 Years of Meta’s Commitment to Python

今年是 Meta 连续第 10 年赞助 Python 软件基金会(PSF),体现了其对 Python 语言生态的长期支持。

Read more →


Privacy-Aware Infrastructure in the AI-Native Era: An Asset Classification Case Study

Meta 分享了其在 AI 原生时代构建隐私感知基础设施的案例,探讨了如何通过资产分类实现有效的隐私控制。

Read more →


How Meta Engineered Ultra-Narrow Batteries for AI Glasses

Meta 介绍了其如何为智能眼镜设计超窄电池,在有限的镜腿空间内实现高性能供电。

Read more →


DeepMind Blog

Introducing Gemini 3.7 Flash

Google DeepMind 发布了 Gemini 3.7 Flash 模型。

Read more →


Putting sign language AI into users’ hands

DeepMind 推出了手语转文字(SL2T)模型,为聋哑和听障用户提供全新的手语交互功能。

Read more →


WeatherNext: AI model achieves breakthrough in forecasting cyclones

WeatherNext 模型在气旋预测方面取得了突破性进展。

Read more →


Gemini Robotics ER 2: powering robotics with video understanding, task orchestration, and multi-robot collaboration

Gemini Robotics ER 2 增强了机器人的视频理解、任务编排和多机器人协作能力。

Read more →


We’re launching Lyria 3.5 in Google Flow Music, with advances across musicality, lyrics, vocals, and creative control

Lyria 3.5 在 Google Flow Music 中发布,在音乐性、歌词、人声和创作控制方面均有显著提升。

Read more →


Gemini Robotics 2 brings whole body intelligence to robots

Gemini Robotics 2 为机器人带来了全身智能,提升了其在复杂环境下的运动和交互能力。

Read more →


Accelerating the frontiers of scientific discovery: Google’s $40M commitment to the Genesis Mission

Google 承诺投入 4000 万美元的 AI 代币和算力额度,支持 Genesis Mission 的科学发现。

Read more →


Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber

Google 介绍了 Gemini 系列的新成员,包括 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。

Read more →


Introducing Gemini 3.5 Flash Cyber

Gemini 3.5 Flash Cyber 是一款轻量级网络安全模型,专门用于发现和修补漏洞。

Read more →


Our approach to bioresilience

Google DeepMind 与 Isomorphic Labs 分享了其在生物韧性(bioresilience)和 AI 模型方面的共同方法。

Read more →


VentureBeat AI

Google just redesigned the search box for the first time in 25 years — here’s why it matters more than you think.

Google 对其搜索框进行了 25 年来的首次重新设计,标志着搜索范式的重大转变。

[Read more →](https://venturebeat.com/technology/google-just-redesigned-the-search-box-for-the-first-time-in-25-years-

生成二维码中...

请点击右上角 ···

选择 发送给朋友收藏