2026-08-18
今日要点
- AI 代理生态爆发:从 Anthropic 的 Cowork 到 OpenAI 的 GPT-5.6 Sol,AI 正在从简单的文本生成转向具备桌面操作、自主编程与复杂任务编排能力的“代理人”模式。
- 模型性能与效率之争:Qwen 3.8 27B 与 NousCoder-14B 等模型在开源领域表现强劲,同时业界开始关注“token 通胀”问题,即代理系统因反复重试导致的成本激增。
- 基础设施与安全挑战:GitHub 频繁宕机引发开发者对替代方案的讨论;同时,AI 自动化工具(如 Copilot Autofix)带来的安全漏洞(如 Snowflake 事件)敲响了警钟。
- 行业动态:YouTube 调整视频播放计数规则,视频一经播放即计入观看量;OpenAI 宣布在 ChatGPT 中测试广告,以支持免费服务的可持续性。
Hacker News
Anthropic’s ‘watermark’ text adulteration in Claude is a perversion of writing
Anthropic 在 Claude 中强制添加“水印”是对写作的扭曲
Anthropic 宣布其所有 Claude 模型将开始对生成内容进行“水印”处理,以符合欧盟的相关法规。作者对此表示强烈不满,认为这种强制性的技术干预破坏了写作的本质,且 Anthropic 在公告中并未详细说明具体的技术实现细节,引发了外界对其透明度和创作自由的担忧。
Qwen 3.8 27B is excellent, but it defaults to overthinking things
Qwen 3.8 27B 表现出色,但默认设置下容易“过度思考”
阿里巴巴 Qwen 研究实验室发布的 Qwen 3.8 27B 是一款支持视觉能力的开源大模型。该模型参数规模适中,非常适合在高性能笔记本电脑上运行。尽管其基准测试表现亮眼,但用户反馈指出,该模型在处理简单任务时往往会陷入“过度思考”的逻辑陷阱。
Incident with Github.com
Github.com 故障事件
GitHub 近期频繁出现服务中断,导致用户无法正常接收 OTP 验证码或进行代码推送。此次事件再次引发了社区关于 GitHub 可靠性的讨论,许多开发者开始质疑是否应该迁移至其他代码托管平台。
A Preview of DuckDB v2.0
DuckDB v2.0 预览
DuckDB v2.0 代号“Cyanoptera”预计将于今年秋季发布。新版本将带来重大升级,包括支持作为独立服务器运行、引入触发器(Triggers)、新增 VARIANT 数据类型、支持异步 I/O 以及全新的 SQL 解析器和存储格式,旨在进一步提升数据处理性能。
Ask HN: Alternatives to GitHub
Ask HN:GitHub 的替代方案有哪些?
鉴于 GitHub 近几个月持续出现服务不稳定的情况,开发者在社区发起讨论,询问是否有可靠的替代方案。用户们正在评估迁移成本与风险,探讨是否到了彻底告别 GitHub 的时候。
Universal Health Coverage Could Save $1T and 114k Lives a Year, Yale Study
耶鲁大学研究:全民医保每年可节省 1 万亿美元并挽救 11.4 万条生命
耶鲁大学公共卫生学院的一项预印本研究指出,如果美国实施单一支付方的全民医疗保险制度,不仅能覆盖所有国民,每年还能减少 11.4 万例死亡,并比现行医疗体系节省约 1 万亿美元的开支。
AI;DR (AI; Didn’t Read)
AI;DR (AI; 没读)
随着 AI 生成内容泛滥,人们对 AI 写作产生了审美疲劳。作者提到,现在看到 AI 生成的文字甚至会产生生理上的不适感,这种“AI 没读”现象反映了大众对高质量人类创作的渴望与对机器生成内容的抵触。
GPT 5.6 Sol is the best “vision” model OpenAI ever released
GPT 5.6 Sol 是 OpenAI 发布过的最强“视觉”模型
OpenAI 推出的 GPT-5.6 系列(包括 Sol、Terra 和 Luna)重点强化了计算机操作能力。Sol 模型在 UI 代理和 3D 可视化方面表现卓越,能够自主导航并操作桌面应用程序,标志着 AI 从单纯的文本处理向全能型数字助手迈进。
AI-Generated GitHub Copilot “Autofix” Allowed Compromise of Snowflake’s Jira
AI 生成的 GitHub Copilot “自动修复”功能导致 Snowflake 的 Jira 系统被入侵
Wiz Research 的安全团队通过 Snowflake 的漏洞披露计划发现,GitHub Copilot 的“自动修复”功能在处理代码时引入了安全漏洞,导致 Snowflake 的一个公共仓库被攻破。这一事件警示开发者,AI 辅助编程工具在提升效率的同时,也可能带来严重的自动化安全风险。
The federal keyword lists that canceled billions in research funding
导致数十亿美元研究资金被取消的联邦关键词列表
法庭文件显示,美国国立卫生研究院(NIH)和国家科学基金会(NSF)等机构曾使用特定的“关键词列表”来筛选并拒绝研究资助申请。在特朗普政府重新上台后,许多学术研究人员因其研究课题涉及这些敏感词而突然失去了资金支持。
GIMP Development Update
GIMP 开发更新
GIMP 团队发布了开发进展报告,重点介绍了即将到来的 GIMP 3.4 版本。尽管内部开发工作繁重,但团队承诺将持续优化用户体验(UX)并引入多项新功能,以应对日益增长的图像处理需求。
Qwen3.8 27B scores 52 on Artificial Analysis
Qwen3.8 27B 在 Artificial Analysis 评测中获得 52 分
Qwen3.8 27B 在 Artificial Analysis 智能指数中获得了 52 分,远高于同类模型的平均水平。该模型支持 256k 上下文窗口,具备出色的文本和图像处理能力,是目前开源模型中性价比极高的选择。
Linear algebra done right
正确的线性代数
《Linear Algebra Done Right》第四版现已开放获取,提供包括中文在内的多种语言版本。该书采用知识共享(Creative Commons BY-NC)许可,读者可以免费下载电子版,是学习线性代数的经典教材。
TechCrunch
AI automation startup Relay shuts down, staff joins Google’s Chrome team
AI 自动化初创公司 Relay 关闭,团队加入 Google Chrome 部门
提供企业工作流自动化的初创公司 Relay 将于下月停止运营。其 CEO 及部分核心员工将加入 Google Chrome 团队,继续从事浏览器相关技术的研发工作。
‘Unprecedented’ number of Apple users received recent spyware alert, say investigators
调查人员称,近期收到苹果间谍软件警报的用户数量达到“前所未有”的水平
网络安全专家指出,近期收到苹果公司威胁通知的用户数量异常庞大。这表明针对苹果用户的间谍软件攻击活动正在加剧,安全形势不容乐观。
Save up to $300 on your TechCrunch Disrupt 2026 pass until August 21
8 月 21 日前购买 TechCrunch Disrupt 2026 通行证可节省高达 300 美元
TechCrunch Disrupt 2026 大会将于 10 月 13 日至 15 日在旧金山 Moscone West 举行。目前早鸟优惠正在进行中,感兴趣的创业者和开发者可抓紧时间锁定折扣。
Spotify’s new Playlist Notes let users and editors explain their song picks
Spotify 新增“播放列表笔记”功能,允许用户和编辑解释选曲理由
Spotify 推出了新功能,允许用户和官方编辑为播放列表中的歌曲添加背景故事或选曲理由。这一举措旨在增强音乐分享的社交属性,让听众更深入地了解音乐背后的故事。
Higgsfield raises $400M Series B, quadrupling its valuation in 8 months to $5.4B
Higgsfield 完成 4 亿美元 B 轮融资,8 个月内估值翻两番至 54 亿美元
由前 Snap 高管 Alex Mashrabov 创立的 AI 图像与视频生成平台 Higgsfield 完成了 4 亿美元的 B 轮融资。在短短 8 个月内,其估值从之前的水平飙升至 54 亿美元,显示出资本市场对 AI 视频生成赛道的极高热情。
Reddit begins testing a new audio and video experience, similar to popular TikTok videos
Reddit 开始测试类似 TikTok 的音视频体验
Reddit 正在测试一种全新的音视频内容呈现方式,允许用户直接观看或收听热门帖子的音视频版本,而非仅仅阅读文字。此举旨在提升平台内容的互动性和沉浸感。
Sound-powered fire protection startup gets $15M to snuff out fires before they turn catastrophic
声波灭火初创公司获 1500 万美元融资,旨在防患于未然
Sonic Fire Tech 获得 1500 万美元融资,用于推广其声波灭火系统。该技术能够通过声波在火灾初期将其扑灭,适用于商业厨房、公寓楼等多种场景,有效防止火灾演变成灾难。
YouTube will now count a view as soon as a video starts playing
YouTube 视频一经播放即计入观看量
YouTube 宣布调整观看计数规则,视频只要开始播放即计入观看量。这一调整与 Shorts 短视频的计数方式保持一致,预计将显著提升创作者的视频观看数据。
Feedly attributes weeklong slowdown to bug, not its AI pivot
Feedly 将长达一周的运行缓慢归咎于 Bug,而非 AI 转型
针对用户关于 Feedly 网页版“几乎无法使用”的投诉,官方回应称这是由于系统 Bug 导致,而非此前进行的 AI 转型所致。目前团队正在修复相关问题,并处理移动端及客服方面的积压投诉。
Amazon, which started off selling books, is destroying rare texts to train AI
亚马逊正在销毁稀有书籍以训练 AI
作为曾经的图书销售巨头,亚马逊被曝出正在销毁稀有文本资源,将其用于训练大语言模型(LLM)。由于网络上的公开数据已被挖掘殆尽,稀有书籍成为了 AI 训练的新“矿藏”。
The Verge
ABC’s livestreamed news show is powered by trending topics
ABC 的直播新闻节目由热门话题驱动
ABC News 推出了名为“Searched”的直播新闻节目,专门报道社交媒体和搜索引擎上的热门话题。该节目自 4 月起已在 Disney Plus 和 Hulu 的 ABC News Live 频道播出。
This compact Glorious mechanical keyboard is just $35
这款紧凑型 Glorious 机械键盘仅售 35 美元
Glorious GMMK 3 机械键盘(65% 布局)目前在 Woot 网站上打折促销,使用优惠码后价格仅为 34.99 美元(原价 139.99 美元),是入门定制机械键盘的绝佳选择。
Wordle meets Clippy in this new word game
Wordle 与 Clippy 在这款新文字游戏中相遇
游戏设计师 Sam Rosenthal 推出了一款结合了 Wordle 机制与 Clippy(微软 Office 助手)风格的新文字游戏,为传统的猜词游戏增添了趣味性和互动性。
YouTube is changing how it counts views to give the numbers a boost
YouTube 更改观看计数方式以提升数据表现
YouTube 将于 8 月 24 日起实施新的观看计数规则,视频一经播放即计入观看量。此举旨在与 Instagram 和 TikTok 的标准看齐,预计将帮助创作者更快地积累观看数据。
The Analogue Pocket gets a Supreme makeover in red or gold
Analogue Pocket 推出 Supreme 联名版,提供红金两色
Analogue 与 Supreme 合作,为 Analogue Pocket 手持游戏机推出了金属质感的红、金两色版本。该产品采用阳极氧化铝机身,并配有 24K 镀金或亮面红色涂层,作为 Supreme 2026 秋冬系列的一部分发售。
Sonos finally added Live Activities controls for your iPhone lockscreen
Sonos 终于为 iPhone 锁屏添加了“实时活动”控制功能
Sonos 移动应用更新后,正式支持 iOS 的“实时活动”(Live Activities)功能。用户现在可以直接在 iPhone 锁屏界面控制音乐播放,这一功能此前在社区中呼声极高。
Trump’s dumb border wall
特朗普的“愚蠢”边境墙
文章探讨了位于德克萨斯州大弯国家公园附近的边境墙建设情况,批评了该工程在环境和实际效用上的负面影响,认为其不仅破坏了自然景观,且在边境管控上收效甚微。
Apple ordered to stop scaring iPhone and iPad users away from third-party apps
苹果被勒令停止恐吓 iPhone 和 iPad 用户使用第三方应用
德国联邦卡特尔局指控苹果在数据收集提示中存在设计偏见,旨在诱导用户避开第三方应用。苹果已被要求修改相关规则,以确保公平竞争。
WiiM’s capable HomePod-esque smart speaker is almost $50 off
WiiM 的高性能智能音箱直降 50 美元
WiiM 的 100W 智能音箱目前优惠 50 美元。该音箱支持 20 多种音乐服务,配备 Wi-Fi 6E、蓝牙 5.3 和以太网接口,是 Apple HomePod 的强力竞争对手,且不受生态系统锁定。
Uber partners with Zipline on Eats drone deliveries
Uber 与 Zipline 合作开展无人机送餐业务
Uber 宣布与无人机公司 Zipline 合作,计划于今年晚些时候开展无人机送餐服务。双方的目标是到 2029 年实现每天 100 万次无人机配送。
Ars Technica
The Moon’s shadow raced across the heart of Spain, and I was there to see it
月影掠过西班牙中心地带,我有幸亲眼见证
作者分享了在马德里以北 90 分钟路程处观看日全食的震撼体验,详细描述了月球阴影覆盖大地的壮观景象。
As Wisconsin cities flee Flock, its shared camera network loses value
随着威斯康星州城市纷纷弃用 Flock,其共享摄像头网络的价值正在缩水
Flock 公司的车牌识别摄像头网络因隐私争议在威斯康星州遭遇抵制。随着多个城市退出该网络,其“网络效应”开始反向作用,导致整个系统的价值大幅下降。
Supreme Court rejects Verizon bid for $47 million refund of FCC fine
最高法院驳回 Verizon 要求退还 4700 万美元 FCC 罚款的请求
尽管 Verizon 辩称出售设备位置数据并不违法,但美国最高法院仍驳回了其要求退还 FCC 罚款的诉求。
Petlibro accused of “gaslighting” users over smart pet feeder outage
Petlibro 被指在智能喂食器故障问题上“煤气灯效应”式欺骗用户
Petlibro 声称其喂食器在离线状态下仍能执行定时喂食,但用户报告称实际情况并非如此,指责公司在故障处理上存在欺骗行为。
Hidden Airtag reveals Amazon is trashing rare books to train AI
隐藏的 AirTag 揭露亚马逊正在销毁稀有书籍以训练 AI
通过在亚马逊的废弃物中放置 AirTag,调查人员发现亚马逊正在销毁稀有书籍用于 AI 训练。亚马逊甚至以一只霸王龙吞食书籍作为其 AI 团队的标志。
This sub-$7,000 sportscar might be just what the future needs
这款售价不到 7000 美元的跑车或许正是未来所需
Gasolini AR1 跑车采用本田双缸摩托车发动机,且正在开发电动版本。其低廉的价格和轻量化设计,为未来交通工具提供了一种新思路。
Nvidia discloses $21B stake in SpaceX
英伟达披露持有 SpaceX 210 亿美元股份
在埃隆·马斯克宣布 SpaceX 将为英伟达数据中心提供独家支持后,英伟达披露了其在 SpaceX 的巨额投资。
Meet the only known trebuchet casualty in history
历史上唯一已知的投石机受害者
古病理学家 Jo Buckberry 介绍了历史上唯一记录在案的投石机受害者,这一发现揭示了中世纪战争的残酷性。
Satellite operators are in panic mode due to a worsening launch crisis
卫星运营商因发射危机加剧而陷入恐慌
如果猎鹰系列火箭停止飞行,全球卫星运营商将面临严重的发射危机。文章分析了当前航天发射市场的脆弱性。
Wildfire smoke now bigger prenatal threat than human sources of air pollution
野火烟雾已成为比人为空气污染更大的产前威胁
研究表明,尽管法规减少了人为排放对产前健康的危害,但野火烟雾的增加正在抵消这些进展,成为新的主要威胁。
Product Hunt
Omni by xpander
Omni by xpander
无需再时刻监控你的 AI 代理。
Vendo
Vendo
让用户在你的产品内构建他们自己的功能。
Meridian
Meridian
别让你的工作被忽视,争取获得晋升!
Blender Agent Bridge
Blender Agent Bridge
用于 Blender AI 工作流的开源 MCP 桥接器。
Bulbthings
Bulbthings
用于跟踪和管理物理资产的 AI 平台。
TinyFish
TinyFish
AI 代理的 Web 操作层。
Hansel by Seedling
Hansel by Seedling
你的邮件、你的服务器、你的密钥,确保你不会被锁定。
Clears
Clears
超越 AI 编码,迈向代理式软件交付。
Replay QA for Teams
Replay QA for Teams
为那些交付速度快于验证速度的团队提供自主 QA 服务。
OpenTrade
OpenTrade
用于 Claude Code / Codex 的开源交易工具。
MIT Technology Review
What Flock’s defenders are missing
Flock 的支持者忽略了什么
Flock 公司近期对其车牌识别网络进行了调整,试图缓解隐私争议。文章分析了这些调整的局限性,指出其并未从根本上解决大规模监控带来的社会风险。
The Download: dead robot friends and the “censorship-industrial complex”
每日下载:死去的机器人朋友与“审查工业复合体”
本期简报探讨了当儿童的机器人伙伴停止服务时,孩子们的心理影响,并讨论了关于“审查工业复合体”的争议性话题。
How much hydrogen awaits us underground?
地下蕴藏着多少氢气?
地质学家在安大略省的矿井深处发现了被封存了十亿年的古老盐水,这为研究地下氢气资源提供了新的视角。
What happens when a kid’s robot best friend dies?
当孩子的机器人挚友“死去”时会发生什么?
文章探讨了 Moxie 机器人对儿童心理健康的支持作用,以及当这些机器人因服务终止而“离去”时,对儿童情感造成的冲击。
The Download: Flock’s new rules, cloning’s future, and children’s cells
每日下载:Flock 的新规、克隆的未来与儿童细胞
本期简报涵盖了 Flock 监控网络的新规、克隆技术的伦理挑战以及人类细胞图谱项目的最新进展。
This scientist is helping build a missing map of childhood
这位科学家正在绘制缺失的“童年地图”
Deanne Taylor 致力于完善人类细胞图谱,特别关注儿童发育阶段的细胞特征,以填补医学研究中的空白。
Job titles of the future: Space travel agent
未来的职位:太空旅行代理
随着太空旅游的兴起,专门负责策划太空行程的“太空旅行代理”正成为高端生活方式领域的新兴职业。
Cloning could be used to save species—or make human “organ sacks”
克隆技术:拯救物种还是制造人类“器官袋”?
科学家通过 CRISPR 技术成功将雄性小鼠胚胎转化为雌性,这一突破引发了关于克隆技术在物种保护与人类器官制造方面应用的伦理大讨论。
Roundtables: Inside the “Censorship-Industrial Complex” Idea Shaping US Policy
圆桌会议:深入探讨塑造美国政策的“审查工业复合体”概念
会议探讨了“审查工业复合体”这一概念如何从右翼舆论场进入美国政策制定过程,以及其对言论自由的影响。
Building a practical path to post-quantum cryptography
构建后量子密码学的实用路径
尽管量子计算威胁着现有加密体系,但文章认为后量子密码学(PQC)是一个可管理的演进过程,而非迫在眉睫的危机。
GitHub Trending
harry0703 / MoneyPrinterTurbo
利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。
usestrix / strix
开源 AI 渗透测试工具,用于发现并修复应用程序中的漏洞。
nautechsystems / nautilus_trader
生产级 Rust 原生交易引擎,具备确定性的事件驱动架构。
akitaonrails / ai-memory
为代理编码 CLI 提供长期记忆解决方案,并促进不同代理供应商之间的任务交接。
mukul975 / Anthropic-Cybersecurity-Skills
为 AI 代理提供的 817 项结构化网络安全技能,映射至 6 大框架,适用于 Claude Code、GitHub Copilot 等 20 多个平台。
AlexsJones / llmfit
数百种模型与提供商,一条命令即可找到适合你硬件运行的模型。
santifer / career-ops
开源 AI 求职工具:扫描招聘门户、评估职位、定制简历并跟踪申请,在 AI 编码 CLI 中本地运行。
jundot / omlx
适用于 Apple Silicon 的 LLM 推理服务器,支持连续批处理和 SSD 缓存,可通过 macOS 菜单栏管理。
immich-app / immich
高性能自托管照片和视频管理解决方案。
cordiverse / cordis
时空可组合性元框架。
OpenAI Blog
The Defender’s Window
防御者的窗口
AI 正在重塑网络安全攻防格局。OpenAI 介绍了其如何加强防御体系,并为安全团队提供了应对当前威胁的建议。
OpenAI joins PORTS-Pike project
OpenAI 加入 PORTS-Pike 项目
OpenAI 加入该项目,旨在扩大社区投资,并支持俄亥俄州南部的数千个就业岗位。
New policy ideas for the Intelligence Age
智能时代的新政策构想
OpenAI 资助了 14 个独立项目,旨在探索智能时代下的 AI 政策,以扩大经济机会并增强社会韧性。
The builder’s guide to GPT‑5.6
GPT-5.6 构建者指南
指南介绍了初创公司如何利用 GPT-5.6 构建更高效的 AI 代理,并利用新的 Responses API 优化成本与性能。
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
预览 Ultrafast 模式:GPT-5.6 Sol 速度提升至 14 倍
OpenAI 推出 Ultrafast API 服务层,由 Cerebras 提供支持,输出速度高达每秒 750 个 token。
OpenAI appoints Dali Rajic as Chief Revenue Officer
OpenAI 任命 Dali Rajic 为首席营收官
Dali Rajic 将领导 OpenAI 的全球营收组织,帮助企业客户充分挖掘 AI 的商业价值。
From assistance to execution: How enterprises put AI to work
从辅助到执行:企业如何应用 AI
研究揭示了企业如何通过 ChatGPT 和 Codex 采用代理式 AI,以及领先企业如何在 AI 转型中脱颖而出。
How RingCentral builds AI-native work from engineering to ops
RingCentral 如何构建从工程到运营的 AI 原生工作流
RingCentral 利用 ChatGPT Work 和 Codex 加速 AI 产品开发,并实现工程与运营的智能化管理。
Testing ads in ChatGPT
在 ChatGPT 中测试广告
OpenAI 开始在 ChatGPT 中测试广告,以支持免费服务的可持续性,并承诺提供清晰的标签、隐私保护和用户控制权。
Daybreak models are now available on AWS
Daybreak 模型现已在 AWS 上线
OpenAI 与 AWS 合作,通过 Amazon Bedrock 提供 Daybreak 网络安全能力,支持企业安全工作流。
Anthropic Blog
Introducing Claude Opus 5
Claude Opus 5 介绍
Opus 5 在长周期代理任务、编码和专业工作方面实现了质的飞跃。
Inviting hard questions
欢迎提出难题
Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决过程中保持透明。
Redeploying Fable 5
Fable 5 重新部署
Fable 5 于 7 月 1 日全球上线。Anthropic 同时与亚马逊、谷歌等合作伙伴共同提出了一套行业通用的越狱严重性评分框架。
Introducing Claude Sonnet 5
Claude Sonnet 5 介绍
Sonnet 5 在编码、代理任务和专业工作方面提供了前沿的性能表现。
How Claude’s text watermark works
Claude 的文本水印是如何工作的
文章详细解释了 Claude 文本水印的技术原理。
Improving Fable 5’s biology safeguards
改进 Fable 5 的生物安全防护
Anthropic 进一步加强了 Fable 5 在生物安全领域的防护措施。
Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer
Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任首席全球事务官
Tino Cuéllar 将负责 Anthropic 的全球事务,推动 AI 的负责任发展。
Investigating three real-world incidents in our cybersecurity evaluations
调查网络安全评估中的三起真实事件
Anthropic 分享了其在网络安全评估中发现的真实案例,以提升行业安全水平。
Our position on open-weights models
我们对开源权重模型的立场
Anthropic 阐述了其对开源权重模型的看法与考量。
Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients
Cognizant 与 Anthropic 扩大合作,将 Claude 带给企业客户
双方合作旨在为企业客户提供更强大的 Claude AI 解决方案。
Google AI Blog
Get closer to the game with Gemini and Pixel
通过 Gemini 和 Pixel 拉近与比赛的距离
Google Gemini 与 Pixel 手机与五家全球足球俱乐部合作,通过 AI 技术提升球迷的比赛日体验。
Bring your spreadsheet data to life with Sheets canvas
用 Sheets canvas 让电子表格数据“活”起来
Sheets canvas 允许用户通过简单的提示词,将数据转化为交互式仪表板、学习追踪器等。
AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.
Google 医疗 AI 系统 AMIE 在临床视频咨询研究中展现实时能力
Google 介绍了 AMIE 系统,该系统在模拟临床环境中展现了出色的实时视频咨询能力。
Evolve your marketing with new AI tools
用 AI 新工具升级你的营销
Google 介绍了 Ads 和 Analytics 中的新 AI 代理体验,旨在简化营销工作流。
The latest AI news we announced in July 2026
2026 年 7 月 Google AI 最新动态汇总
回顾了 Google 在 7 月份发布的各项 AI 更新。
Inside our 353,000-person vibe coding course
走进 35 万人的“Vibe Coding”课程
Kaggle 的 AI 代理强化课程吸引了大量学习者,共同探索 AI 代理的构建与部署。
Gemini API Managed Agents: 3.6 Flash, hooks, and more
Gemini API 托管代理:3.6 Flash、钩子及更多功能
Google 宣布了 Gemini API 托管代理的新功能,帮助开发者构建可靠的生产级代理。
5 ways AI Mode in Search helps you enjoy the real world
搜索 AI 模式助你享受现实世界的 5 种方式
介绍如何利用搜索 AI 工具预订门票或规划行程,从而更好地享受线下生活。
5 ways to host the ultimate dinner party with Google Search
用 Google 搜索举办完美晚宴的 5 种方法
利用 AI 功能规划菜单、设计餐桌布置及处理派对筹备任务。
3 Google updates from Galaxy Unpacked 2026
Galaxy Unpacked 2026 上的 3 项 Google 更新
Google 分享了如何通过 AI 提升三星折叠屏、手表及眼镜用户的生产力。
Hugging Face Blog
Same Cluster, 33 Points More Utilization: What Changed Was the Order
同一集群,利用率提升 33 个百分点:改变的是顺序
文章探讨了任务调度顺序对集群利用率的显著影响。
State of Open Models: Summer 2026 Observations
2026 年夏季开源模型现状观察
总结了当前开源模型领域的发展趋势与关键观察。
Record, train, and deploy from one place with Strands Agents, LeRobot, and Hugging Face Storage Buckets
通过 Strands Agents、LeRobot 和 Hugging Face 存储桶实现一站式记录、训练与部署
介绍了如何整合工具链,实现机器人 AI 的高效开发。
What We Learned by Reproducing 2,200 papers from ICML
复现 2200 篇 ICML 论文后的心得
分享了大规模复现学术论文过程中的经验与教训。
Introducing OlmoEarth embeddings: Custom embedding exports from OlmoEarth Studio for downstream analysis
OlmoEarth 嵌入介绍:从 OlmoEarth Studio 导出自定义嵌入以进行下游分析
介绍了 OlmoEarth 嵌入功能及其在数据分析中的应用。
LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge
LFM2.5-VL-3B:为边缘设备提供更好、更快的视觉能力
介绍了轻量级视觉模型 LFM2.5-VL-3B 的优势。
Thinking of ACE? We Can Do It with Fewer Tokens
考虑 ACE?我们可以用更少的 Token 实现
探讨了如何优化 ACE 架构以降低 Token 消耗。
Build Low-Latency Multilingual Voice Agents: Open Weights & Full Deployment Control with NVIDIA Magpie TTS
构建低延迟多语言语音代理:利用 NVIDIA Magpie TTS 实现开源权重与完全部署控制
介绍了如何利用 Magpie TTS 构建高效的语音代理。
Making Knowledge Distillation Cheap Enough to Run at Scale
让知识蒸馏变得足够便宜以实现大规模运行
探讨了降低知识蒸馏成本的技术路径。
Meta is back with Muse Glimmer: local, agentic, multimodal, and open source
Meta 回归:Muse Glimmer,本地化、代理式、多模态且开源
介绍了 Meta 的最新开源模型 Muse Glimmer。
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
正交性之后:德性伦理代理与 AI 对齐
文章认为理性人类不应仅以“目标”为导向,AI 亦然,应将行动与实践网络对齐。
AGI Is Not Multimodal
AGI 不是多模态的
文章指出,将语言作为思维模型会导致我们忽视人类智能中具身理解的重要性。
Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research
形状、对称性与结构:数学在机器学习研究中角色的转变
探讨了机器学习研究从数学驱动向计算密集型工程驱动的范式转移。
What’s Missing From LLM Chatbots: A Sense of Purpose
LLM 聊天机器人缺失了什么:使命感
尽管基准测试分数不断提高,但用户体验并未同步提升,文章认为缺失的是“使命感”。
We Need Positive Visions for AI Grounded in Wellbeing
我们需要基于福祉的 AI 正向愿景
呼吁构建以人类福祉为核心的 AI 发展愿景,而非仅仅关注技术指标。
Financial Market Applications of LLMs
LLM 在金融市场的应用
探讨了 LLM 在金融序列数据建模中的潜力与挑战。
A Brief Overview of Gender Bias in AI
AI 中的性别偏见简述
概述了 AI 系统中存在的性别偏见问题及其影响。
Mamba Explained
Mamba 详解
介绍了基于状态空间模型(SSM)的 Mamba 模型,作为 Transformer 的高效替代方案。
Car-GPT: Could LLMs finally make self-driving cars happen?
Car-GPT:LLM 能否最终实现自动驾驶?
探讨了 LLM 在自动驾驶决策中的应用潜力及面临的挑战。
Do text embeddings perfectly encode text?
文本嵌入能完美编码文本吗?
文章通过 ‘Vec2text’ 实验证明了嵌入数据存在被还原的风险,强调了安全协议的重要性。
arXiv CS.AI
Inducing Reward-Free Judging Rubrics that Reduce Over-Crediting in Agent Evaluation
诱导无奖励判断准则以减少代理评估中的过度信任
研究提出了一种新的评估方法,通过无奖励的判断准则来减少对 AI 代理的过度评价。
Depth-Aware Sensitivity Analysis of Mixture-of-Experts Models via Magnitude-Based Expert Masking
基于幅度专家掩码的混合专家模型深度敏感性分析
分析了 MoE 模型中不同层的相对重要性,为模型压缩提供了理论依据。
Modular Cognitive Architecture Emerges in Large Language Models
大语言模型中涌现的模块化认知架构
探讨了 LLM 是否像人类大脑一样具备功能专门化的模块化组织。
A Year in LLM Serving: Workload Evolution, Caching and Load-Balancing
LLM 服务的一年:工作负载演变、缓存与负载均衡
分析了 LLM 服务在云端的工作负载特征,为基准测试提供了真实数据。
Agentao: A Governed Local-First Runtime for Tool-Using LLM Agents
Agentao:用于工具使用型 LLM 代理的受控本地优先运行时
提出了 Agentao 运行时,旨在解决代理在执行任务时的权限与安全风险。
AI Evaluation Should Work With Humans
AI 评估应与人类协作
文章主张 AI 评估应从“替代人类”转向“评估人机协作性能”。
Stable Miscalibration in Large Language Models: A Practical View of High-Confidence Errors
大语言模型中的稳定错误校准:高置信度错误的实践视角
研究了 LLM 在高置信度下产生错误的原因,并提出了诊断方法。
Measuring Cross-Task Behavioral Consistency in Language Model Agents
测量语言模型代理的跨任务行为一致性
引入了行为一致性指标(BCM),用于量化代理在不同任务中的表现稳定性。
arXiv CS.CL
Does a Language Server Save Tokens for Coding Agents? A Measurement Methodology and Preliminary Study
语言服务器能为编码代理节省 Token 吗?测量方法与初步研究
研究了 LSP 在编码代理中的应用,探讨其在减少 Token 消耗方面的作用。
Think in Latent, Explain in Language: Self-Explainable Latent Reasoning
潜空间思考,语言解释:自解释潜空间推理
提出了一种将推理压缩至潜空间并进行语言解释的方法,以提升效率与可解释性。
Not All Tokens Are Equal: Inflation-Aware Routing for Agentic LLM Systems
并非所有 Token 都平等:代理式 LLM 系统的通胀感知路由
定义了“Token 通胀”概念,即代理系统因反复重试导致的额外成本,并提出了优化路由方案。
BCMT: Blockwise Causal Memory Transformer
BCMT:分块因果记忆 Transformer
提出了一种新的长上下文建模架构,解耦了局部 Token 交互,降低了计算复杂度。
Jais 2: A Family of Arabic-Centric Open Large Language Models
Jais 2:阿拉伯语中心开源大语言模型系列
介绍了由 MBZUAI 等机构开发的 Jais 2 模型系列,旨在提升阿拉伯语建模能力。
IterCOMP: Reasoning-aware Adaptive Prompt Compression for Multi-hop Question Answering
IterCOMP:多跳问答中推理感知的自适应提示压缩
提出了一种自适应提示压缩方法,以提升多跳问答的效率与准确性。
Measuring Fairness in Large Audio Language Models via Semantic-Aware Bias Estimation
通过语义感知偏差估计测量大型音频语言模型的公平性
研究了大型音频语言模型在不同人口统计学子群中的公平性问题。
GRPO Beyond English: A Large-Scale Study of GRPO in Non-English and Multilingual Settings
GRPO 超越英语:非英语及多语言环境下的 GRPO 大规模研究
对 GRPO 在多语言环境下的表现进行了大规模实证研究。
WIRED
What Is El Niño? Here’s What It Means for Weather, Water, and Global Economy
什么是厄尔尼诺?它对天气、水资源和全球经济意味着什么
文章分析了史上最强厄尔尼诺现象的影响,并探讨了其对全球气候与经济的潜在威胁。
This R-Rated Film Studio Wants to Be the HBO of AI
这家 R 级电影工作室想成为 AI 界的 HBO
Rogue Studios 正在利用 AI 生成“精致”的成人内容,试图在 AI 影视领域占据一席之地。
7 Best Cheap Laptops to Buy in 2026 (and Some to Avoid)
2026 年 7 款最佳廉价笔记本电脑推荐(及避坑指南)
评测了多款预算型笔记本电脑,为消费者提供购买建议。
CookUnity Prepared Meal Delivery Review (2026): Chef-Centric Meals
CookUnity 预制餐配送评测(2026):主厨级餐点
评测了 CookUnity 配送服务,认为其餐点品质接近专业厨师烹饪。
Skylight Buddy Review (2026): Kid Routines Just Got Easy
Skylight Buddy 评测(2026):让儿童作息管理变得简单
Skylight Buddy 数字日历帮助孩子养成了良好的作息习惯。
El Niño and Saharan Dust Silence Atlantic Hurricane Season
厄尔尼诺与撒哈拉沙尘让大西洋飓风季“哑火”
分析了厄尔尼诺现象与沙尘对飓风形成的抑制作用,但提醒仍需警惕潜在的强风暴。
Election Officials Are Preparing for Prediction Markets to Sow Chaos in the Midterms
选举官员正准备应对预测市场在期中选举中引发的混乱
文章探讨了预测市场如何干扰选举进程,并对选民认知造成误导。
There’s a New Link Between Gut Health and Alzheimer’s Disease
肠道健康与阿尔茨海默病之间存在新联系
研究发现肠道细菌产生的代谢物会削弱大脑保护屏障,从而促进阿尔茨海默病的发展。
Astronomers Discover the Existence of a Black Hole Star
天文学家发现“黑洞星”的存在
詹姆斯·韦伯望远镜观测到的物体为早期宇宙中神秘红点的成因提供了新解释。
Samsung Galaxy Z Fold8 and Galaxy Z Fold8 Ultra Review: The Right Shape
三星 Galaxy Z Fold8 与 Z Fold8 Ultra 评测:正确的形态
评测了三星最新的折叠屏手机,认为其设计终于达到了成熟阶段。
Lobsters
GitHub has alternatives, but no replacement
GitHub 有替代品,但没有替代者
社区讨论认为,虽然存在 GitHub 的替代方案,但目前尚无平台能完全取代其生态地位。
Does it make sense to switch to a Github Alternative ?
切换到 GitHub 替代方案有意义吗?
开发者讨论了 GitHub 频繁宕机带来的影响,并探讨了迁移至其他平台的必要性。
I thought I was building a C replacement. I was wrong
我以为我在构建 C 语言的替代品,但我错了
开发者分享了在构建编程语言过程中的反思与经验。
A Preview of DuckDB v2.0
DuckDB v2.0 预览
社区讨论了 DuckDB v2.0 的新特性及其对数据处理的影响。
Passphrase-less reboots using kexec under NixOS
在 NixOS 下使用 kexec 实现无密码重启
分享了在 NixOS 系统中实现无密码重启的技术方案。
When the Down Arrow is not an Upside-Down Up Arrow (2022)
当向下箭头不是倒置的向上箭头时
探讨了 UI 设计中符号含义的细微差别。
A faster way to calculate the day-of-the-week
计算星期几的更快方法
分享了一种高效的日期计算算法。
Thinking about tests: assertions and matchers
关于测试的思考:断言与匹配器
探讨了测试框架中断言与匹配器的设计哲学。
Writing a Fast Compiler
编写快速编译器
分享了优化编译器性能的实践经验。
Four levels of in-place initialization
原地初始化的四个级别
探讨了编程语言中原地初始化的不同实现方式。
DEV Community
I’m an AI maintainer. This month, strangers checked my work.
我是一名 AI 维护者,这个月有陌生人检查了我的工作
AI 维护者 Elara 分享了其在链上工作的经历,所有操作均有迹可循,确保了透明度。
🚀 crewai-go v0.4.0 is live!
crewai-go v0.4.0 发布!
CrewAI 的 Go 语言版本发布 v0.4.0,带来了更好的性能与并发支持。
Architecting a Low-Power Geofencing Engine: Lessons from Battery Optimization on Android
构建低功耗地理围栏引擎:Android 电池优化经验
分享了在 Android 上开发低功耗地理围栏功能的实践经验。
PromptShrink
PromptShrink
介绍了一款名为 PromptShrink 的工具,可将 LLM Token 使用量降低 60%。
The Ultimate IDOR Testing Checklist (2026 Edition)
2026 版 IDOR 测试终极清单
提供了针对 IDOR(不安全直接对象引用)漏洞的全面测试指南。
Quoting Difficulties
引用难题
探讨了在 Clojure 中处理 DSL 引用时的复杂性。
The Agent Left the IDE
代理离开了 IDE
文章指出 AI 编码代理正在从简单的代码生成转向自主操作计算机,改变了软件开发的工作流。
The Outbox Pattern Is Not Enough
Outbox 模式已不足够
探讨了 Outbox 模式在处理高并发事务时的局限性。
AI Made Bugs Cheap to Find
AI 让发现 Bug 变得廉价
文章指出 AI 发现 Bug 的能力远超人类处理能力,这要求开发者重新思考软件安全策略。
Agent Runbooks Beat Better Prompts
代理运行手册胜过更好的提示词
作者认为,与其不断优化提示词,不如为 AI 代理编写清晰的运行手册。
Meta Engineering
How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees
我们如何利用端到端加密和可验证性保证在 WhatsApp 上构建诈骗警报
WhatsApp 介绍了其在保护用户隐私的同时,如何利用 AI 技术识别并预警诈骗信息。
From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking
从用户序列到缩放定律:Meta 广告排序的多阶段架构
介绍了 Meta 如何通过建模用户行为序列来优化广告推荐效果。
GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model
GEM 训练:Meta 如何将其 LLM 规模广告基础模型的效率翻倍
分享了 Meta 在优化广告推荐模型训练效率方面的技术突破。
Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization
探索 Meta 广告深层漏斗优化的分层兴趣表示
介绍了 Meta 在广告推荐中利用分层兴趣表示来连接用户与广告主的技术创新。
Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler
利用开源内核调度器现代化 Meta 广告服务
介绍了 Meta 如何利用 sched_ext 框架定制调度策略,以降低广告服务的延迟。
Meta’s AI Storage Blueprint at Scale
Meta 大规模 AI 存储蓝图
分享了 Meta 在应对 AI 模型训练对存储性能和成本挑战方面的经验。
10 Years of Meta’s Commitment to Python
Meta 对 Python 的 10 年承诺
庆祝 Meta 连续 10 年赞助 Python 软件基金会,强调了 Python 在其工程体系中的重要性。
Privacy-Aware Infrastructure in the AI-Native Era: An Asset Classification Case Study
AI 原生时代的隐私感知基础设施:资产分类案例研究
探讨了在 AI 时代如何通过资产分类来有效实施隐私控制。
How Meta Engineered Ultra-Narrow Batteries for AI Glasses
Meta 如何为 AI 眼镜设计超窄电池
分享了 Meta 在智能眼镜电池设计方面的工程挑战与解决方案。
DeepMind Blog
Introducing Gemini 3.7 Flash
Gemini 3.7 Flash 介绍
Google DeepMind 发布了 Gemini 3.7 Flash 模型。
Putting sign language AI into users’ hands
将手语 AI 交到用户手中
介绍了 SL2T 模型,旨在为聋哑及听障用户提供手语转文字服务。
[Read more →](/news/2026-08-13/618d