2026-08-18

今日要点


Hacker News

Anthropic’s ‘watermark’ text adulteration in Claude is a perversion of writing

Anthropic 在 Claude 中强制添加“水印”是对写作的扭曲

Anthropic 宣布其所有 Claude 模型将开始对生成内容进行“水印”处理,以符合欧盟的相关法规。作者对此表示强烈不满,认为这种强制性的技术干预破坏了写作的本质,且 Anthropic 在公告中并未详细说明具体的技术实现细节,引发了外界对其透明度和创作自由的担忧。

Read more →


Qwen 3.8 27B is excellent, but it defaults to overthinking things

Qwen 3.8 27B 表现出色,但默认设置下容易“过度思考”

阿里巴巴 Qwen 研究实验室发布的 Qwen 3.8 27B 是一款支持视觉能力的开源大模型。该模型参数规模适中,非常适合在高性能笔记本电脑上运行。尽管其基准测试表现亮眼,但用户反馈指出,该模型在处理简单任务时往往会陷入“过度思考”的逻辑陷阱。

Read more →


Incident with Github.com

Github.com 故障事件

GitHub 近期频繁出现服务中断,导致用户无法正常接收 OTP 验证码或进行代码推送。此次事件再次引发了社区关于 GitHub 可靠性的讨论,许多开发者开始质疑是否应该迁移至其他代码托管平台。

Read more →


A Preview of DuckDB v2.0

DuckDB v2.0 预览

DuckDB v2.0 代号“Cyanoptera”预计将于今年秋季发布。新版本将带来重大升级,包括支持作为独立服务器运行、引入触发器(Triggers)、新增 VARIANT 数据类型、支持异步 I/O 以及全新的 SQL 解析器和存储格式,旨在进一步提升数据处理性能。

Read more →


Ask HN: Alternatives to GitHub

Ask HN:GitHub 的替代方案有哪些?

鉴于 GitHub 近几个月持续出现服务不稳定的情况,开发者在社区发起讨论,询问是否有可靠的替代方案。用户们正在评估迁移成本与风险,探讨是否到了彻底告别 GitHub 的时候。

Read more →


Universal Health Coverage Could Save $1T and 114k Lives a Year, Yale Study

耶鲁大学研究:全民医保每年可节省 1 万亿美元并挽救 11.4 万条生命

耶鲁大学公共卫生学院的一项预印本研究指出,如果美国实施单一支付方的全民医疗保险制度,不仅能覆盖所有国民,每年还能减少 11.4 万例死亡,并比现行医疗体系节省约 1 万亿美元的开支。

Read more →


AI;DR (AI; Didn’t Read)

AI;DR (AI; 没读)

随着 AI 生成内容泛滥,人们对 AI 写作产生了审美疲劳。作者提到,现在看到 AI 生成的文字甚至会产生生理上的不适感,这种“AI 没读”现象反映了大众对高质量人类创作的渴望与对机器生成内容的抵触。

Read more →


GPT 5.6 Sol is the best “vision” model OpenAI ever released

GPT 5.6 Sol 是 OpenAI 发布过的最强“视觉”模型

OpenAI 推出的 GPT-5.6 系列(包括 Sol、Terra 和 Luna)重点强化了计算机操作能力。Sol 模型在 UI 代理和 3D 可视化方面表现卓越,能够自主导航并操作桌面应用程序,标志着 AI 从单纯的文本处理向全能型数字助手迈进。

Read more →


AI-Generated GitHub Copilot “Autofix” Allowed Compromise of Snowflake’s Jira

AI 生成的 GitHub Copilot “自动修复”功能导致 Snowflake 的 Jira 系统被入侵

Wiz Research 的安全团队通过 Snowflake 的漏洞披露计划发现,GitHub Copilot 的“自动修复”功能在处理代码时引入了安全漏洞,导致 Snowflake 的一个公共仓库被攻破。这一事件警示开发者,AI 辅助编程工具在提升效率的同时,也可能带来严重的自动化安全风险。

Read more →


The federal keyword lists that canceled billions in research funding

导致数十亿美元研究资金被取消的联邦关键词列表

法庭文件显示,美国国立卫生研究院(NIH)和国家科学基金会(NSF)等机构曾使用特定的“关键词列表”来筛选并拒绝研究资助申请。在特朗普政府重新上台后,许多学术研究人员因其研究课题涉及这些敏感词而突然失去了资金支持。

Read more →


GIMP Development Update

GIMP 开发更新

GIMP 团队发布了开发进展报告,重点介绍了即将到来的 GIMP 3.4 版本。尽管内部开发工作繁重,但团队承诺将持续优化用户体验(UX)并引入多项新功能,以应对日益增长的图像处理需求。

Read more →


Qwen3.8 27B scores 52 on Artificial Analysis

Qwen3.8 27B 在 Artificial Analysis 评测中获得 52 分

Qwen3.8 27B 在 Artificial Analysis 智能指数中获得了 52 分,远高于同类模型的平均水平。该模型支持 256k 上下文窗口,具备出色的文本和图像处理能力,是目前开源模型中性价比极高的选择。

Read more →


Linear algebra done right

正确的线性代数

《Linear Algebra Done Right》第四版现已开放获取,提供包括中文在内的多种语言版本。该书采用知识共享(Creative Commons BY-NC)许可,读者可以免费下载电子版,是学习线性代数的经典教材。

Read more →


TechCrunch

AI automation startup Relay shuts down, staff joins Google’s Chrome team

AI 自动化初创公司 Relay 关闭,团队加入 Google Chrome 部门

提供企业工作流自动化的初创公司 Relay 将于下月停止运营。其 CEO 及部分核心员工将加入 Google Chrome 团队,继续从事浏览器相关技术的研发工作。

Read more →


‘Unprecedented’ number of Apple users received recent spyware alert, say investigators

调查人员称,近期收到苹果间谍软件警报的用户数量达到“前所未有”的水平

网络安全专家指出,近期收到苹果公司威胁通知的用户数量异常庞大。这表明针对苹果用户的间谍软件攻击活动正在加剧,安全形势不容乐观。

Read more →


Save up to $300 on your TechCrunch Disrupt 2026 pass until August 21

8 月 21 日前购买 TechCrunch Disrupt 2026 通行证可节省高达 300 美元

TechCrunch Disrupt 2026 大会将于 10 月 13 日至 15 日在旧金山 Moscone West 举行。目前早鸟优惠正在进行中,感兴趣的创业者和开发者可抓紧时间锁定折扣。

Read more →


Spotify’s new Playlist Notes let users and editors explain their song picks

Spotify 新增“播放列表笔记”功能,允许用户和编辑解释选曲理由

Spotify 推出了新功能,允许用户和官方编辑为播放列表中的歌曲添加背景故事或选曲理由。这一举措旨在增强音乐分享的社交属性,让听众更深入地了解音乐背后的故事。

Read more →


Higgsfield raises $400M Series B, quadrupling its valuation in 8 months to $5.4B

Higgsfield 完成 4 亿美元 B 轮融资,8 个月内估值翻两番至 54 亿美元

由前 Snap 高管 Alex Mashrabov 创立的 AI 图像与视频生成平台 Higgsfield 完成了 4 亿美元的 B 轮融资。在短短 8 个月内,其估值从之前的水平飙升至 54 亿美元,显示出资本市场对 AI 视频生成赛道的极高热情。

Read more →


Reddit 开始测试类似 TikTok 的音视频体验

Reddit 正在测试一种全新的音视频内容呈现方式,允许用户直接观看或收听热门帖子的音视频版本,而非仅仅阅读文字。此举旨在提升平台内容的互动性和沉浸感。

Read more →


Sound-powered fire protection startup gets $15M to snuff out fires before they turn catastrophic

声波灭火初创公司获 1500 万美元融资,旨在防患于未然

Sonic Fire Tech 获得 1500 万美元融资,用于推广其声波灭火系统。该技术能够通过声波在火灾初期将其扑灭,适用于商业厨房、公寓楼等多种场景,有效防止火灾演变成灾难。

Read more →


YouTube will now count a view as soon as a video starts playing

YouTube 视频一经播放即计入观看量

YouTube 宣布调整观看计数规则,视频只要开始播放即计入观看量。这一调整与 Shorts 短视频的计数方式保持一致,预计将显著提升创作者的视频观看数据。

Read more →


Feedly attributes weeklong slowdown to bug, not its AI pivot

Feedly 将长达一周的运行缓慢归咎于 Bug,而非 AI 转型

针对用户关于 Feedly 网页版“几乎无法使用”的投诉,官方回应称这是由于系统 Bug 导致,而非此前进行的 AI 转型所致。目前团队正在修复相关问题,并处理移动端及客服方面的积压投诉。

Read more →


Amazon, which started off selling books, is destroying rare texts to train AI

亚马逊正在销毁稀有书籍以训练 AI

作为曾经的图书销售巨头,亚马逊被曝出正在销毁稀有文本资源,将其用于训练大语言模型(LLM)。由于网络上的公开数据已被挖掘殆尽,稀有书籍成为了 AI 训练的新“矿藏”。

Read more →


The Verge

ABC 的直播新闻节目由热门话题驱动

ABC News 推出了名为“Searched”的直播新闻节目,专门报道社交媒体和搜索引擎上的热门话题。该节目自 4 月起已在 Disney Plus 和 Hulu 的 ABC News Live 频道播出。

Read more →


This compact Glorious mechanical keyboard is just $35

这款紧凑型 Glorious 机械键盘仅售 35 美元

Glorious GMMK 3 机械键盘(65% 布局)目前在 Woot 网站上打折促销,使用优惠码后价格仅为 34.99 美元(原价 139.99 美元),是入门定制机械键盘的绝佳选择。

Read more →


Wordle meets Clippy in this new word game

Wordle 与 Clippy 在这款新文字游戏中相遇

游戏设计师 Sam Rosenthal 推出了一款结合了 Wordle 机制与 Clippy(微软 Office 助手)风格的新文字游戏,为传统的猜词游戏增添了趣味性和互动性。

Read more →


YouTube is changing how it counts views to give the numbers a boost

YouTube 更改观看计数方式以提升数据表现

YouTube 将于 8 月 24 日起实施新的观看计数规则,视频一经播放即计入观看量。此举旨在与 Instagram 和 TikTok 的标准看齐,预计将帮助创作者更快地积累观看数据。

Read more →


The Analogue Pocket gets a Supreme makeover in red or gold

Analogue Pocket 推出 Supreme 联名版,提供红金两色

Analogue 与 Supreme 合作,为 Analogue Pocket 手持游戏机推出了金属质感的红、金两色版本。该产品采用阳极氧化铝机身,并配有 24K 镀金或亮面红色涂层,作为 Supreme 2026 秋冬系列的一部分发售。

Read more →


Sonos finally added Live Activities controls for your iPhone lockscreen

Sonos 终于为 iPhone 锁屏添加了“实时活动”控制功能

Sonos 移动应用更新后,正式支持 iOS 的“实时活动”(Live Activities)功能。用户现在可以直接在 iPhone 锁屏界面控制音乐播放,这一功能此前在社区中呼声极高。

Read more →


Trump’s dumb border wall

特朗普的“愚蠢”边境墙

文章探讨了位于德克萨斯州大弯国家公园附近的边境墙建设情况,批评了该工程在环境和实际效用上的负面影响,认为其不仅破坏了自然景观,且在边境管控上收效甚微。

Read more →


Apple ordered to stop scaring iPhone and iPad users away from third-party apps

苹果被勒令停止恐吓 iPhone 和 iPad 用户使用第三方应用

德国联邦卡特尔局指控苹果在数据收集提示中存在设计偏见,旨在诱导用户避开第三方应用。苹果已被要求修改相关规则,以确保公平竞争。

Read more →


WiiM’s capable HomePod-esque smart speaker is almost $50 off

WiiM 的高性能智能音箱直降 50 美元

WiiM 的 100W 智能音箱目前优惠 50 美元。该音箱支持 20 多种音乐服务,配备 Wi-Fi 6E、蓝牙 5.3 和以太网接口,是 Apple HomePod 的强力竞争对手,且不受生态系统锁定。

Read more →


Uber partners with Zipline on Eats drone deliveries

Uber 与 Zipline 合作开展无人机送餐业务

Uber 宣布与无人机公司 Zipline 合作,计划于今年晚些时候开展无人机送餐服务。双方的目标是到 2029 年实现每天 100 万次无人机配送。

Read more →


Ars Technica

The Moon’s shadow raced across the heart of Spain, and I was there to see it

月影掠过西班牙中心地带,我有幸亲眼见证

作者分享了在马德里以北 90 分钟路程处观看日全食的震撼体验,详细描述了月球阴影覆盖大地的壮观景象。

Read more →


As Wisconsin cities flee Flock, its shared camera network loses value

随着威斯康星州城市纷纷弃用 Flock,其共享摄像头网络的价值正在缩水

Flock 公司的车牌识别摄像头网络因隐私争议在威斯康星州遭遇抵制。随着多个城市退出该网络,其“网络效应”开始反向作用,导致整个系统的价值大幅下降。

Read more →


Supreme Court rejects Verizon bid for $47 million refund of FCC fine

最高法院驳回 Verizon 要求退还 4700 万美元 FCC 罚款的请求

尽管 Verizon 辩称出售设备位置数据并不违法,但美国最高法院仍驳回了其要求退还 FCC 罚款的诉求。

Read more →


Petlibro accused of “gaslighting” users over smart pet feeder outage

Petlibro 被指在智能喂食器故障问题上“煤气灯效应”式欺骗用户

Petlibro 声称其喂食器在离线状态下仍能执行定时喂食,但用户报告称实际情况并非如此,指责公司在故障处理上存在欺骗行为。

Read more →


Hidden Airtag reveals Amazon is trashing rare books to train AI

隐藏的 AirTag 揭露亚马逊正在销毁稀有书籍以训练 AI

通过在亚马逊的废弃物中放置 AirTag,调查人员发现亚马逊正在销毁稀有书籍用于 AI 训练。亚马逊甚至以一只霸王龙吞食书籍作为其 AI 团队的标志。

Read more →


This sub-$7,000 sportscar might be just what the future needs

这款售价不到 7000 美元的跑车或许正是未来所需

Gasolini AR1 跑车采用本田双缸摩托车发动机,且正在开发电动版本。其低廉的价格和轻量化设计,为未来交通工具提供了一种新思路。

Read more →


Nvidia discloses $21B stake in SpaceX

英伟达披露持有 SpaceX 210 亿美元股份

在埃隆·马斯克宣布 SpaceX 将为英伟达数据中心提供独家支持后,英伟达披露了其在 SpaceX 的巨额投资。

Read more →


Meet the only known trebuchet casualty in history

历史上唯一已知的投石机受害者

古病理学家 Jo Buckberry 介绍了历史上唯一记录在案的投石机受害者,这一发现揭示了中世纪战争的残酷性。

Read more →


Satellite operators are in panic mode due to a worsening launch crisis

卫星运营商因发射危机加剧而陷入恐慌

如果猎鹰系列火箭停止飞行,全球卫星运营商将面临严重的发射危机。文章分析了当前航天发射市场的脆弱性。

Read more →


Wildfire smoke now bigger prenatal threat than human sources of air pollution

野火烟雾已成为比人为空气污染更大的产前威胁

研究表明,尽管法规减少了人为排放对产前健康的危害,但野火烟雾的增加正在抵消这些进展,成为新的主要威胁。

Read more →


Product Hunt

Omni by xpander

Omni by xpander

无需再时刻监控你的 AI 代理。

Read more →


Vendo

Vendo

让用户在你的产品内构建他们自己的功能。

Read more →


Meridian

Meridian

别让你的工作被忽视,争取获得晋升!

Read more →


Blender Agent Bridge

Blender Agent Bridge

用于 Blender AI 工作流的开源 MCP 桥接器。

Read more →


Bulbthings

Bulbthings

用于跟踪和管理物理资产的 AI 平台。

Read more →


TinyFish

TinyFish

AI 代理的 Web 操作层。

Read more →


Hansel by Seedling

Hansel by Seedling

你的邮件、你的服务器、你的密钥,确保你不会被锁定。

Read more →


Clears

Clears

超越 AI 编码,迈向代理式软件交付。

Read more →


Replay QA for Teams

Replay QA for Teams

为那些交付速度快于验证速度的团队提供自主 QA 服务。

Read more →


OpenTrade

OpenTrade

用于 Claude Code / Codex 的开源交易工具。

Read more →


MIT Technology Review

What Flock’s defenders are missing

Flock 的支持者忽略了什么

Flock 公司近期对其车牌识别网络进行了调整,试图缓解隐私争议。文章分析了这些调整的局限性,指出其并未从根本上解决大规模监控带来的社会风险。

Read more →


The Download: dead robot friends and the “censorship-industrial complex”

每日下载:死去的机器人朋友与“审查工业复合体”

本期简报探讨了当儿童的机器人伙伴停止服务时,孩子们的心理影响,并讨论了关于“审查工业复合体”的争议性话题。

Read more →


How much hydrogen awaits us underground?

地下蕴藏着多少氢气?

地质学家在安大略省的矿井深处发现了被封存了十亿年的古老盐水,这为研究地下氢气资源提供了新的视角。

Read more →


What happens when a kid’s robot best friend dies?

当孩子的机器人挚友“死去”时会发生什么?

文章探讨了 Moxie 机器人对儿童心理健康的支持作用,以及当这些机器人因服务终止而“离去”时,对儿童情感造成的冲击。

Read more →


The Download: Flock’s new rules, cloning’s future, and children’s cells

每日下载:Flock 的新规、克隆的未来与儿童细胞

本期简报涵盖了 Flock 监控网络的新规、克隆技术的伦理挑战以及人类细胞图谱项目的最新进展。

Read more →


This scientist is helping build a missing map of childhood

这位科学家正在绘制缺失的“童年地图”

Deanne Taylor 致力于完善人类细胞图谱,特别关注儿童发育阶段的细胞特征,以填补医学研究中的空白。

Read more →


Job titles of the future: Space travel agent

未来的职位:太空旅行代理

随着太空旅游的兴起,专门负责策划太空行程的“太空旅行代理”正成为高端生活方式领域的新兴职业。

Read more →


Cloning could be used to save species—or make human “organ sacks”

克隆技术:拯救物种还是制造人类“器官袋”?

科学家通过 CRISPR 技术成功将雄性小鼠胚胎转化为雌性,这一突破引发了关于克隆技术在物种保护与人类器官制造方面应用的伦理大讨论。

Read more →


Roundtables: Inside the “Censorship-Industrial Complex” Idea Shaping US Policy

圆桌会议:深入探讨塑造美国政策的“审查工业复合体”概念

会议探讨了“审查工业复合体”这一概念如何从右翼舆论场进入美国政策制定过程,以及其对言论自由的影响。

Read more →


Building a practical path to post-quantum cryptography

构建后量子密码学的实用路径

尽管量子计算威胁着现有加密体系,但文章认为后量子密码学(PQC)是一个可管理的演进过程,而非迫在眉睫的危机。

Read more →


harry0703 / MoneyPrinterTurbo

利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。

Read more →


usestrix / strix

开源 AI 渗透测试工具,用于发现并修复应用程序中的漏洞。

Read more →


nautechsystems / nautilus_trader

生产级 Rust 原生交易引擎,具备确定性的事件驱动架构。

Read more →


akitaonrails / ai-memory

为代理编码 CLI 提供长期记忆解决方案,并促进不同代理供应商之间的任务交接。

Read more →


mukul975 / Anthropic-Cybersecurity-Skills

为 AI 代理提供的 817 项结构化网络安全技能,映射至 6 大框架,适用于 Claude Code、GitHub Copilot 等 20 多个平台。

Read more →


AlexsJones / llmfit

数百种模型与提供商,一条命令即可找到适合你硬件运行的模型。

Read more →


santifer / career-ops

开源 AI 求职工具:扫描招聘门户、评估职位、定制简历并跟踪申请,在 AI 编码 CLI 中本地运行。

Read more →


jundot / omlx

适用于 Apple Silicon 的 LLM 推理服务器,支持连续批处理和 SSD 缓存,可通过 macOS 菜单栏管理。

Read more →


immich-app / immich

高性能自托管照片和视频管理解决方案。

Read more →


cordiverse / cordis

时空可组合性元框架。

Read more →


OpenAI Blog

The Defender’s Window

防御者的窗口

AI 正在重塑网络安全攻防格局。OpenAI 介绍了其如何加强防御体系,并为安全团队提供了应对当前威胁的建议。

Read more →


OpenAI joins PORTS-Pike project

OpenAI 加入 PORTS-Pike 项目

OpenAI 加入该项目,旨在扩大社区投资,并支持俄亥俄州南部的数千个就业岗位。

Read more →


New policy ideas for the Intelligence Age

智能时代的新政策构想

OpenAI 资助了 14 个独立项目,旨在探索智能时代下的 AI 政策,以扩大经济机会并增强社会韧性。

Read more →


The builder’s guide to GPT‑5.6

GPT-5.6 构建者指南

指南介绍了初创公司如何利用 GPT-5.6 构建更高效的 AI 代理,并利用新的 Responses API 优化成本与性能。

Read more →


Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

预览 Ultrafast 模式:GPT-5.6 Sol 速度提升至 14 倍

OpenAI 推出 Ultrafast API 服务层,由 Cerebras 提供支持,输出速度高达每秒 750 个 token。

Read more →


OpenAI appoints Dali Rajic as Chief Revenue Officer

OpenAI 任命 Dali Rajic 为首席营收官

Dali Rajic 将领导 OpenAI 的全球营收组织,帮助企业客户充分挖掘 AI 的商业价值。

Read more →


From assistance to execution: How enterprises put AI to work

从辅助到执行:企业如何应用 AI

研究揭示了企业如何通过 ChatGPT 和 Codex 采用代理式 AI,以及领先企业如何在 AI 转型中脱颖而出。

Read more →


How RingCentral builds AI-native work from engineering to ops

RingCentral 如何构建从工程到运营的 AI 原生工作流

RingCentral 利用 ChatGPT Work 和 Codex 加速 AI 产品开发,并实现工程与运营的智能化管理。

Read more →


Testing ads in ChatGPT

在 ChatGPT 中测试广告

OpenAI 开始在 ChatGPT 中测试广告,以支持免费服务的可持续性,并承诺提供清晰的标签、隐私保护和用户控制权。

Read more →


Daybreak models are now available on AWS

Daybreak 模型现已在 AWS 上线

OpenAI 与 AWS 合作,通过 Amazon Bedrock 提供 Daybreak 网络安全能力,支持企业安全工作流。

Read more →


Anthropic Blog

Introducing Claude Opus 5

Claude Opus 5 介绍

Opus 5 在长周期代理任务、编码和专业工作方面实现了质的飞跃。

Read more →


Inviting hard questions

欢迎提出难题

Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决过程中保持透明。

Read more →


Redeploying Fable 5

Fable 5 重新部署

Fable 5 于 7 月 1 日全球上线。Anthropic 同时与亚马逊、谷歌等合作伙伴共同提出了一套行业通用的越狱严重性评分框架。

Read more →


Introducing Claude Sonnet 5

Claude Sonnet 5 介绍

Sonnet 5 在编码、代理任务和专业工作方面提供了前沿的性能表现。

Read more →


How Claude’s text watermark works

Claude 的文本水印是如何工作的

文章详细解释了 Claude 文本水印的技术原理。

Read more →


Improving Fable 5’s biology safeguards

改进 Fable 5 的生物安全防护

Anthropic 进一步加强了 Fable 5 在生物安全领域的防护措施。

Read more →


Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任首席全球事务官

Tino Cuéllar 将负责 Anthropic 的全球事务,推动 AI 的负责任发展。

Read more →


Investigating three real-world incidents in our cybersecurity evaluations

调查网络安全评估中的三起真实事件

Anthropic 分享了其在网络安全评估中发现的真实案例,以提升行业安全水平。

Read more →


Our position on open-weights models

我们对开源权重模型的立场

Anthropic 阐述了其对开源权重模型的看法与考量。

Read more →


Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients

Cognizant 与 Anthropic 扩大合作,将 Claude 带给企业客户

双方合作旨在为企业客户提供更强大的 Claude AI 解决方案。

Read more →


Google AI Blog

Get closer to the game with Gemini and Pixel

通过 Gemini 和 Pixel 拉近与比赛的距离

Google Gemini 与 Pixel 手机与五家全球足球俱乐部合作,通过 AI 技术提升球迷的比赛日体验。

Read more →


Bring your spreadsheet data to life with Sheets canvas

用 Sheets canvas 让电子表格数据“活”起来

Sheets canvas 允许用户通过简单的提示词,将数据转化为交互式仪表板、学习追踪器等。

Read more →


AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.

Google 医疗 AI 系统 AMIE 在临床视频咨询研究中展现实时能力

Google 介绍了 AMIE 系统,该系统在模拟临床环境中展现了出色的实时视频咨询能力。

Read more →


Evolve your marketing with new AI tools

用 AI 新工具升级你的营销

Google 介绍了 Ads 和 Analytics 中的新 AI 代理体验,旨在简化营销工作流。

Read more →


The latest AI news we announced in July 2026

2026 年 7 月 Google AI 最新动态汇总

回顾了 Google 在 7 月份发布的各项 AI 更新。

Read more →


Inside our 353,000-person vibe coding course

走进 35 万人的“Vibe Coding”课程

Kaggle 的 AI 代理强化课程吸引了大量学习者,共同探索 AI 代理的构建与部署。

Read more →


Gemini API Managed Agents: 3.6 Flash, hooks, and more

Gemini API 托管代理:3.6 Flash、钩子及更多功能

Google 宣布了 Gemini API 托管代理的新功能,帮助开发者构建可靠的生产级代理。

Read more →


5 ways AI Mode in Search helps you enjoy the real world

搜索 AI 模式助你享受现实世界的 5 种方式

介绍如何利用搜索 AI 工具预订门票或规划行程,从而更好地享受线下生活。

Read more →


用 Google 搜索举办完美晚宴的 5 种方法

利用 AI 功能规划菜单、设计餐桌布置及处理派对筹备任务。

Read more →


3 Google updates from Galaxy Unpacked 2026

Galaxy Unpacked 2026 上的 3 项 Google 更新

Google 分享了如何通过 AI 提升三星折叠屏、手表及眼镜用户的生产力。

Read more →


Hugging Face Blog

Same Cluster, 33 Points More Utilization: What Changed Was the Order

同一集群,利用率提升 33 个百分点:改变的是顺序

文章探讨了任务调度顺序对集群利用率的显著影响。

Read more →


State of Open Models: Summer 2026 Observations

2026 年夏季开源模型现状观察

总结了当前开源模型领域的发展趋势与关键观察。

Read more →


Record, train, and deploy from one place with Strands Agents, LeRobot, and Hugging Face Storage Buckets

通过 Strands Agents、LeRobot 和 Hugging Face 存储桶实现一站式记录、训练与部署

介绍了如何整合工具链,实现机器人 AI 的高效开发。

Read more →


What We Learned by Reproducing 2,200 papers from ICML

复现 2200 篇 ICML 论文后的心得

分享了大规模复现学术论文过程中的经验与教训。

Read more →


Introducing OlmoEarth embeddings: Custom embedding exports from OlmoEarth Studio for downstream analysis

OlmoEarth 嵌入介绍:从 OlmoEarth Studio 导出自定义嵌入以进行下游分析

介绍了 OlmoEarth 嵌入功能及其在数据分析中的应用。

Read more →


LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge

LFM2.5-VL-3B:为边缘设备提供更好、更快的视觉能力

介绍了轻量级视觉模型 LFM2.5-VL-3B 的优势。

Read more →


Thinking of ACE? We Can Do It with Fewer Tokens

考虑 ACE?我们可以用更少的 Token 实现

探讨了如何优化 ACE 架构以降低 Token 消耗。

Read more →


Build Low-Latency Multilingual Voice Agents: Open Weights & Full Deployment Control with NVIDIA Magpie TTS

构建低延迟多语言语音代理:利用 NVIDIA Magpie TTS 实现开源权重与完全部署控制

介绍了如何利用 Magpie TTS 构建高效的语音代理。

Read more →


Making Knowledge Distillation Cheap Enough to Run at Scale

让知识蒸馏变得足够便宜以实现大规模运行

探讨了降低知识蒸馏成本的技术路径。

Read more →


Meta is back with Muse Glimmer: local, agentic, multimodal, and open source

Meta 回归:Muse Glimmer,本地化、代理式、多模态且开源

介绍了 Meta 的最新开源模型 Muse Glimmer。

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

正交性之后:德性伦理代理与 AI 对齐

文章认为理性人类不应仅以“目标”为导向,AI 亦然,应将行动与实践网络对齐。

Read more →


AGI Is Not Multimodal

AGI 不是多模态的

文章指出,将语言作为思维模型会导致我们忽视人类智能中具身理解的重要性。

Read more →


Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

形状、对称性与结构:数学在机器学习研究中角色的转变

探讨了机器学习研究从数学驱动向计算密集型工程驱动的范式转移。

Read more →


What’s Missing From LLM Chatbots: A Sense of Purpose

LLM 聊天机器人缺失了什么:使命感

尽管基准测试分数不断提高,但用户体验并未同步提升,文章认为缺失的是“使命感”。

Read more →


We Need Positive Visions for AI Grounded in Wellbeing

我们需要基于福祉的 AI 正向愿景

呼吁构建以人类福祉为核心的 AI 发展愿景,而非仅仅关注技术指标。

Read more →


Financial Market Applications of LLMs

LLM 在金融市场的应用

探讨了 LLM 在金融序列数据建模中的潜力与挑战。

Read more →


A Brief Overview of Gender Bias in AI

AI 中的性别偏见简述

概述了 AI 系统中存在的性别偏见问题及其影响。

Read more →


Mamba Explained

Mamba 详解

介绍了基于状态空间模型(SSM)的 Mamba 模型,作为 Transformer 的高效替代方案。

Read more →


Car-GPT: Could LLMs finally make self-driving cars happen?

Car-GPT:LLM 能否最终实现自动驾驶?

探讨了 LLM 在自动驾驶决策中的应用潜力及面临的挑战。

Read more →


Do text embeddings perfectly encode text?

文本嵌入能完美编码文本吗?

文章通过 ‘Vec2text’ 实验证明了嵌入数据存在被还原的风险,强调了安全协议的重要性。

Read more →


arXiv CS.AI

Inducing Reward-Free Judging Rubrics that Reduce Over-Crediting in Agent Evaluation

诱导无奖励判断准则以减少代理评估中的过度信任

研究提出了一种新的评估方法,通过无奖励的判断准则来减少对 AI 代理的过度评价。

Read more →


Depth-Aware Sensitivity Analysis of Mixture-of-Experts Models via Magnitude-Based Expert Masking

基于幅度专家掩码的混合专家模型深度敏感性分析

分析了 MoE 模型中不同层的相对重要性,为模型压缩提供了理论依据。

Read more →


Modular Cognitive Architecture Emerges in Large Language Models

大语言模型中涌现的模块化认知架构

探讨了 LLM 是否像人类大脑一样具备功能专门化的模块化组织。

Read more →


A Year in LLM Serving: Workload Evolution, Caching and Load-Balancing

LLM 服务的一年:工作负载演变、缓存与负载均衡

分析了 LLM 服务在云端的工作负载特征,为基准测试提供了真实数据。

Read more →


Agentao: A Governed Local-First Runtime for Tool-Using LLM Agents

Agentao:用于工具使用型 LLM 代理的受控本地优先运行时

提出了 Agentao 运行时,旨在解决代理在执行任务时的权限与安全风险。

Read more →


AI Evaluation Should Work With Humans

AI 评估应与人类协作

文章主张 AI 评估应从“替代人类”转向“评估人机协作性能”。

Read more →


Stable Miscalibration in Large Language Models: A Practical View of High-Confidence Errors

大语言模型中的稳定错误校准:高置信度错误的实践视角

研究了 LLM 在高置信度下产生错误的原因,并提出了诊断方法。

Read more →


Measuring Cross-Task Behavioral Consistency in Language Model Agents

测量语言模型代理的跨任务行为一致性

引入了行为一致性指标(BCM),用于量化代理在不同任务中的表现稳定性。

Read more →


arXiv CS.CL

Does a Language Server Save Tokens for Coding Agents? A Measurement Methodology and Preliminary Study

语言服务器能为编码代理节省 Token 吗?测量方法与初步研究

研究了 LSP 在编码代理中的应用,探讨其在减少 Token 消耗方面的作用。

Read more →


Think in Latent, Explain in Language: Self-Explainable Latent Reasoning

潜空间思考,语言解释:自解释潜空间推理

提出了一种将推理压缩至潜空间并进行语言解释的方法,以提升效率与可解释性。

Read more →


Not All Tokens Are Equal: Inflation-Aware Routing for Agentic LLM Systems

并非所有 Token 都平等:代理式 LLM 系统的通胀感知路由

定义了“Token 通胀”概念,即代理系统因反复重试导致的额外成本,并提出了优化路由方案。

Read more →


BCMT: Blockwise Causal Memory Transformer

BCMT:分块因果记忆 Transformer

提出了一种新的长上下文建模架构,解耦了局部 Token 交互,降低了计算复杂度。

Read more →


Jais 2: A Family of Arabic-Centric Open Large Language Models

Jais 2:阿拉伯语中心开源大语言模型系列

介绍了由 MBZUAI 等机构开发的 Jais 2 模型系列,旨在提升阿拉伯语建模能力。

Read more →


IterCOMP: Reasoning-aware Adaptive Prompt Compression for Multi-hop Question Answering

IterCOMP:多跳问答中推理感知的自适应提示压缩

提出了一种自适应提示压缩方法,以提升多跳问答的效率与准确性。

Read more →


Measuring Fairness in Large Audio Language Models via Semantic-Aware Bias Estimation

通过语义感知偏差估计测量大型音频语言模型的公平性

研究了大型音频语言模型在不同人口统计学子群中的公平性问题。

Read more →


GRPO Beyond English: A Large-Scale Study of GRPO in Non-English and Multilingual Settings

GRPO 超越英语:非英语及多语言环境下的 GRPO 大规模研究

对 GRPO 在多语言环境下的表现进行了大规模实证研究。

Read more →


WIRED

What Is El Niño? Here’s What It Means for Weather, Water, and Global Economy

什么是厄尔尼诺?它对天气、水资源和全球经济意味着什么

文章分析了史上最强厄尔尼诺现象的影响,并探讨了其对全球气候与经济的潜在威胁。

Read more →


This R-Rated Film Studio Wants to Be the HBO of AI

这家 R 级电影工作室想成为 AI 界的 HBO

Rogue Studios 正在利用 AI 生成“精致”的成人内容,试图在 AI 影视领域占据一席之地。

Read more →


7 Best Cheap Laptops to Buy in 2026 (and Some to Avoid)

2026 年 7 款最佳廉价笔记本电脑推荐(及避坑指南)

评测了多款预算型笔记本电脑,为消费者提供购买建议。

Read more →


CookUnity Prepared Meal Delivery Review (2026): Chef-Centric Meals

CookUnity 预制餐配送评测(2026):主厨级餐点

评测了 CookUnity 配送服务,认为其餐点品质接近专业厨师烹饪。

Read more →


Skylight Buddy Review (2026): Kid Routines Just Got Easy

Skylight Buddy 评测(2026):让儿童作息管理变得简单

Skylight Buddy 数字日历帮助孩子养成了良好的作息习惯。

Read more →


El Niño and Saharan Dust Silence Atlantic Hurricane Season

厄尔尼诺与撒哈拉沙尘让大西洋飓风季“哑火”

分析了厄尔尼诺现象与沙尘对飓风形成的抑制作用,但提醒仍需警惕潜在的强风暴。

Read more →


Election Officials Are Preparing for Prediction Markets to Sow Chaos in the Midterms

选举官员正准备应对预测市场在期中选举中引发的混乱

文章探讨了预测市场如何干扰选举进程,并对选民认知造成误导。

Read more →


肠道健康与阿尔茨海默病之间存在新联系

研究发现肠道细菌产生的代谢物会削弱大脑保护屏障,从而促进阿尔茨海默病的发展。

Read more →


Astronomers Discover the Existence of a Black Hole Star

天文学家发现“黑洞星”的存在

詹姆斯·韦伯望远镜观测到的物体为早期宇宙中神秘红点的成因提供了新解释。

Read more →


Samsung Galaxy Z Fold8 and Galaxy Z Fold8 Ultra Review: The Right Shape

三星 Galaxy Z Fold8 与 Z Fold8 Ultra 评测:正确的形态

评测了三星最新的折叠屏手机,认为其设计终于达到了成熟阶段。

Read more →


Lobsters

GitHub has alternatives, but no replacement

GitHub 有替代品,但没有替代者

社区讨论认为,虽然存在 GitHub 的替代方案,但目前尚无平台能完全取代其生态地位。

Read more →


Does it make sense to switch to a Github Alternative ?

切换到 GitHub 替代方案有意义吗?

开发者讨论了 GitHub 频繁宕机带来的影响,并探讨了迁移至其他平台的必要性。

Read more →


I thought I was building a C replacement. I was wrong

我以为我在构建 C 语言的替代品,但我错了

开发者分享了在构建编程语言过程中的反思与经验。

Read more →


A Preview of DuckDB v2.0

DuckDB v2.0 预览

社区讨论了 DuckDB v2.0 的新特性及其对数据处理的影响。

Read more →


Passphrase-less reboots using kexec under NixOS

在 NixOS 下使用 kexec 实现无密码重启

分享了在 NixOS 系统中实现无密码重启的技术方案。

Read more →


When the Down Arrow is not an Upside-Down Up Arrow (2022)

当向下箭头不是倒置的向上箭头时

探讨了 UI 设计中符号含义的细微差别。

Read more →


A faster way to calculate the day-of-the-week

计算星期几的更快方法

分享了一种高效的日期计算算法。

Read more →


Thinking about tests: assertions and matchers

关于测试的思考:断言与匹配器

探讨了测试框架中断言与匹配器的设计哲学。

Read more →


Writing a Fast Compiler

编写快速编译器

分享了优化编译器性能的实践经验。

Read more →


Four levels of in-place initialization

原地初始化的四个级别

探讨了编程语言中原地初始化的不同实现方式。

Read more →


DEV Community

I’m an AI maintainer. This month, strangers checked my work.

我是一名 AI 维护者,这个月有陌生人检查了我的工作

AI 维护者 Elara 分享了其在链上工作的经历,所有操作均有迹可循,确保了透明度。

Read more →


🚀 crewai-go v0.4.0 is live!

crewai-go v0.4.0 发布!

CrewAI 的 Go 语言版本发布 v0.4.0,带来了更好的性能与并发支持。

Read more →


Architecting a Low-Power Geofencing Engine: Lessons from Battery Optimization on Android

构建低功耗地理围栏引擎:Android 电池优化经验

分享了在 Android 上开发低功耗地理围栏功能的实践经验。

Read more →


PromptShrink

PromptShrink

介绍了一款名为 PromptShrink 的工具,可将 LLM Token 使用量降低 60%。

Read more →


The Ultimate IDOR Testing Checklist (2026 Edition)

2026 版 IDOR 测试终极清单

提供了针对 IDOR(不安全直接对象引用)漏洞的全面测试指南。

Read more →


Quoting Difficulties

引用难题

探讨了在 Clojure 中处理 DSL 引用时的复杂性。

Read more →


The Agent Left the IDE

代理离开了 IDE

文章指出 AI 编码代理正在从简单的代码生成转向自主操作计算机,改变了软件开发的工作流。

Read more →


The Outbox Pattern Is Not Enough

Outbox 模式已不足够

探讨了 Outbox 模式在处理高并发事务时的局限性。

Read more →


AI Made Bugs Cheap to Find

AI 让发现 Bug 变得廉价

文章指出 AI 发现 Bug 的能力远超人类处理能力,这要求开发者重新思考软件安全策略。

Read more →


Agent Runbooks Beat Better Prompts

代理运行手册胜过更好的提示词

作者认为,与其不断优化提示词,不如为 AI 代理编写清晰的运行手册。

Read more →


Meta Engineering

How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees

我们如何利用端到端加密和可验证性保证在 WhatsApp 上构建诈骗警报

WhatsApp 介绍了其在保护用户隐私的同时,如何利用 AI 技术识别并预警诈骗信息。

Read more →


From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking

从用户序列到缩放定律:Meta 广告排序的多阶段架构

介绍了 Meta 如何通过建模用户行为序列来优化广告推荐效果。

Read more →


GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model

GEM 训练:Meta 如何将其 LLM 规模广告基础模型的效率翻倍

分享了 Meta 在优化广告推荐模型训练效率方面的技术突破。

Read more →


Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization

探索 Meta 广告深层漏斗优化的分层兴趣表示

介绍了 Meta 在广告推荐中利用分层兴趣表示来连接用户与广告主的技术创新。

Read more →


Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler

利用开源内核调度器现代化 Meta 广告服务

介绍了 Meta 如何利用 sched_ext 框架定制调度策略,以降低广告服务的延迟。

Read more →


Meta’s AI Storage Blueprint at Scale

Meta 大规模 AI 存储蓝图

分享了 Meta 在应对 AI 模型训练对存储性能和成本挑战方面的经验。

Read more →


10 Years of Meta’s Commitment to Python

Meta 对 Python 的 10 年承诺

庆祝 Meta 连续 10 年赞助 Python 软件基金会,强调了 Python 在其工程体系中的重要性。

Read more →


Privacy-Aware Infrastructure in the AI-Native Era: An Asset Classification Case Study

AI 原生时代的隐私感知基础设施:资产分类案例研究

探讨了在 AI 时代如何通过资产分类来有效实施隐私控制。

Read more →


How Meta Engineered Ultra-Narrow Batteries for AI Glasses

Meta 如何为 AI 眼镜设计超窄电池

分享了 Meta 在智能眼镜电池设计方面的工程挑战与解决方案。

Read more →


DeepMind Blog

Introducing Gemini 3.7 Flash

Gemini 3.7 Flash 介绍

Google DeepMind 发布了 Gemini 3.7 Flash 模型。

Read more →


Putting sign language AI into users’ hands

将手语 AI 交到用户手中

介绍了 SL2T 模型,旨在为聋哑及听障用户提供手语转文字服务。

[Read more →](/news/2026-08-13/618d

生成二维码中...

请点击右上角 ···

选择 发送给朋友收藏