2026-07-21

今日要点


Hacker News

China’s open-weights AI strategy is winning

中国开源权重 AI 策略正在胜出

文章指出,AI 模型本身作为产品的护城河正在消失,真正的竞争壁垒在于围绕模型构建的企业服务、合同关系及系统集成。中国通过开源权重策略,正对美国的 AI 主导地位发起强力挑战,通过生态系统的深度绑定来巩固市场份额。

Read more →


Claude Fable produced a counterexample to the Jacobian Conjecture

Claude Fable 提出了雅可比猜想的反例

Wolfram|Alpha 平台展示了 Claude Fable 模型在处理复杂数学问题上的卓越能力,该模型成功推导出了数学界长期悬而未决的“雅可比猜想”(Jacobian Conjecture)的一个反例,体现了 AI 在辅助科学研究和专家级知识处理方面的巨大潜力。

Read more →


Airport Simulator

机场模拟器

这是一款备受关注的模拟类游戏,在 Hacker News 上获得了 622 分的高分和 120 条评论。该游戏通过模拟机场运营的复杂流程,为玩家提供了沉浸式的管理体验。

Read more →


Hacker wipes Romania’s land registry database

黑客清除了罗马尼亚土地登记数据库

Thinkst 发布的简报披露了一起严重的网络安全事件,黑客成功入侵并清除了罗马尼亚的土地登记数据库。该事件再次提醒企业和政府机构,必须加强关键基础设施的防御能力,并利用 Canary 等工具进行实时威胁监测。

Read more →


The EU is about to sell our most sensitive data to the US for visa-free travel

欧盟即将为免签旅行向美国出售我们的敏感数据

欧盟委员会正与特朗普政府敲定一项“增强边境安全伙伴关系”(EBSP)框架协议。该协议允许边境管制部门访问旅客的生物识别数据库并进行安全画像,引发了公众对隐私泄露和数据主权丧失的强烈担忧。

Read more →


Xiaomi-Robotics-1

小米机器人 1 号

该项目探讨了如何通过“脱离具身预训练”(embodiment-free pre-training)来打破机器人领域的数据壁垒。文章指出,机器人领域长期缺乏高质量的大规模数据,通过这种新的预训练范式,有望利用现有的语言和视觉模型成果,推动机器人策略模型的规模化发展。

Read more →


Exploit brokers pay $500k for WordPress RCEs. I found one with GPT5.6 and $25

漏洞经纪人愿意为 WordPress RCE 支付 50 万美元,我用 GPT5.6 和 25 美元就找到了一个

研究人员利用 GPT-5.6 仅花费 25 美元就发现了一个 WordPress 远程代码执行(RCE)漏洞。该漏洞已被公开,旨在提醒网站管理员尽快升级系统。此前,安全公司已观察到黑客利用该漏洞链对大量网站进行攻击。

Read more →


Annoying and alarming things about OpenCode

关于 OpenCode 的烦人且令人担忧的事情

作者对名为 OpenCode 的 AI 编码代理提出了严厉批评。该工具基于 TypeScript 构建,被指责在追求自动化编码的过程中,忽视了计算机科学领域数十年来积累的安全和系统软件最佳实践,可能对软件工程的稳健性造成长期损害。

Read more →


Moonshine: Lets you stream games from your PC to any device running Moonlight

Moonshine:让你将 PC 游戏流式传输到任何运行 Moonlight 的设备

Moonshine 是一款允许用户将 PC 游戏串流至任何支持 Moonlight 协议设备的工具。它支持键盘、鼠标和手柄输入回传,实现远程游戏体验。需要注意的是,目前 AV1 编码在 NVIDIA GPU 上存在实验性问题,可能导致帧大小异常增长。

Read more →


Kimi Work

Kimi 工作台

Kimi Work 是一款专为知识工作者打造的 AI 桌面应用。它深度集成本地文件,具备浏览器自动化能力,并内置 Cron 引擎,能够 24 小时自动执行重复性任务,如撰写每日简报或处理自动化流程,旨在最大化生产力。

Read more →


Kimi K3, Qwen 3.8, and Anthropic’s (Potential) Unravelling

Kimi K3、Qwen 3.8 与 Anthropic 的(潜在)衰落

本周发布了两个 SOTA 基础模型:月之暗面的 Kimi K3 和阿里巴巴的 Qwen 3.8。两者性能均接近 Anthropic 的 Fable 5,且计划在未来几周内开源权重。这标志着中国 AI 厂商在模型性能上已追平顶尖水平,并可能通过开源策略改变行业格局。

Read more →


Jelly UI: Soft-body physics for native HTML form controls

Jelly UI:原生 HTML 表单控件的软体物理效果

Jelly UI 是一个无需依赖的 Web 组件库,为原生 HTML 表单控件引入了软体物理交互效果。该库支持深色模式、从右到左(RTL)布局,并内置了符合 WCAG AA 标准的颜色令牌,旨在提升网页界面的触感和交互体验。

Read more →


Firefox 153 available with support for Vulkan video decoding, JPEG-XL

Firefox 153 发布,支持 Vulkan 视频解码和 JPEG-XL

Firefox 153 版本正式发布,带来了对 Vulkan 视频解码的支持,进一步提升了 Linux 平台下的硬件加速性能。此外,该版本还增加了对 JPEG-XL 图像格式的支持,持续优化浏览器的多媒体处理能力。

Read more →


LEDs’ potential to save our night skies

LED 拯救夜空的潜力

文章探讨了 LED 技术在照明效率提升的同时,如何因不当设计导致严重的光污染。通过改进照明策略和设计,LED 技术实际上有潜力在保证城市照明需求的同时,有效减少对夜空的干扰,保护生态环境。

Read more →


Airbus Takes Flight from AWS

空客逃离 AWS

欧洲航空巨头空客正计划将其约 900 个应用程序从 AWS 迁移至法国云服务提供商 Scaleway。此举被视为欧洲企业在云基础设施方面寻求“数字主权”的重要信号,旨在减少对美国云厂商的依赖。

Read more →


TechCrunch

Google is working on a new AI chip designed to make Gemini more efficient

谷歌正在研发一款旨在提高 Gemini 效率的新型 AI 芯片

Alphabet 旗下的谷歌正在开发一款专用 AI 芯片,旨在显著提升 Gemini 模型在运行时的能效比。此举是谷歌在 AI 基础设施领域持续投入的一部分,旨在降低大规模模型推理的成本。

Read more →


AI’s most important protocol is getting a little bit easier to use

AI 最重要的协议正变得更易于使用

模型上下文协议(MCP)是 AI 互操作性的基础,它为 AI 模型提供了一种安全访问外部数据源和服务的标准化方式。随着 MCP 的易用性提升,开发者将无需为每个连接构建自定义管道,从而加速 AI 代理的集成。

Read more →


X relaunches a rebuilt Android app after year-long effort

X 在历经一年努力后重新发布了 Android 应用

社交平台 X 宣布,经过长达一年的重构,其全新的 Android 客户端已在全球范围内上线。此次更新旨在提升应用的性能和稳定性,改善用户体验。

Read more →


OpenAI is scared of open-weight models. Should the US be?

OpenAI 害怕开源权重模型,美国应该害怕吗?

关于是否应禁止中国制造的开源大语言模型(LLM)的讨论,揭示了将 AI 转化为商业模式的挑战。文章探讨了开源模型对现有 AI 商业生态的冲击,以及美国在 AI 竞争中面临的战略困境。

Read more →


Natural raises $30M to reinvent payments for AI agents — and take on Stripe

Natural 融资 3000 万美元,旨在重塑 AI 代理支付体系并挑战 Stripe

成立仅一年的初创公司 Natural 宣布完成 3000 万美元融资。该公司致力于为自主 AI 代理交易构建全新的金融架构,试图在 AI 驱动的经济活动中挑战 Stripe 等传统支付巨头的地位。

Read more →


Judge pauses $110B Paramount-Warner Bros. merger

法官暂停 1100 亿美元的派拉蒙与华纳兄弟合并案

由于多州总检察长提起诉讼,称该合并将损害电影院、有线电视分销商及观众利益,美国地方法官已下令暂时搁置派拉蒙与华纳兄弟探索公司价值 1100 亿美元的合并计划。

Read more →


Adobe camera app’s new feature will critique your photos using AI

Adobe 相机应用新功能:利用 AI 评价你的照片

Adobe 的 Project Indigo 相机应用新增了一项功能,利用生成式 AI 自动移除照片背景,并提供照片质量评价。这是 Adobe 将生成式 AI 深度集成到移动摄影工作流中的最新尝试。

Read more →


Hackers are exploiting recently patched WordPress bugs, putting millions of websites at risk

黑客正在利用最近修复的 WordPress 漏洞,数百万网站面临风险

据安全研究人员估计,WordPress 软件中存在的两个关键安全漏洞正被黑客利用,可能导致数千万网站被远程接管。尽管官方已发布补丁,但大量未及时更新的网站仍处于极高风险中。

Read more →


YouTube clarifies policies around AI slop and upsetting videos

YouTube 明确了关于 AI 生成垃圾内容和令人不安视频的政策

YouTube 更新了其变现政策,更明确地定义了哪些类型的 AI 生成内容和低质量视频将无法获得广告收入。此举旨在打击平台上的“AI 垃圾内容”,维护社区环境。

Read more →


Inference startup Infinity raises $15M from Touring Capital, OpenAI and Anthropic researchers

推理初创公司 Infinity 融资 1500 万美元,投资者包括 Touring Capital 及 OpenAI 和 Anthropic 的研究人员

AI 基础设施公司 Infinity 宣布完成 1500 万美元融资,估值达到 1 亿美元。投资者阵容强大,包括 Touring Capital、Principal VC 以及来自 OpenAI 和 Anthropic 的资深研究人员,显示出市场对 AI 推理基础设施的高度关注。

Read more →


The Verge

The Odyssey turned me into an IMAX believer

《奥德赛》让我成为了 IMAX 的信徒

作者在观看克里斯托弗·诺兰的《奥德赛》后,对 IMAX 的视觉表现力深感震撼。尽管对片中部分奇幻场景的呈现方式存有争议,但整体的观影体验让他彻底认可了 IMAX 格式在电影叙事中的价值。

Read more →


SpaceX in your index fund, explained

指数基金里的 SpaceX:解析

文章探讨了将 SpaceX 这种高风险、高估值的公司纳入纳斯达克 100 指数基金的潜在影响。作者认为,这种做法违背了指数基金作为稳健投资工具的初衷,可能给普通投资者带来不必要的风险。

Read more →


Get Borderlands 3, Risk of Rain 2 and 13 other great PC games for $15

15 美元即可获得《无主之地 3》、《雨中冒险 2》等 15 款优秀 PC 游戏

Humble Bundle 推出了“2K Megahits 2026”捆绑包,包含《生化奇兵:无限》、《无主之地 3》等 15 款 2K 发行的经典游戏,售价仅为 15 美元。该优惠活动将持续至 8 月。

Read more →


The PlayStation replica ornament is an homage to a great, yet fragile console

PlayStation 复刻装饰品是对伟大但脆弱主机的致敬

这款 PlayStation 复刻装饰品不仅外观还原,还内置了标志性的开机音效。文章借此回顾了初代 PlayStation 主机在游戏史上的地位,以及其硬件设计上的一些脆弱之处。

Read more →


Ford’s $30,000 electric truck: all the news about the company’s big EV re-do

福特 3 万美元电动卡车:关于公司重大电动汽车转型计划的所有新闻

在 F-150 Lightning 未能完全占领市场后,福特决定通过全新的通用电动汽车平台(Universal Electric Vehicle Platform)重新出发。首款产品将是一款定价 3 万美元的电动卡车,旨在通过高效设计重新定义电动皮卡市场。

Read more →


Judge pauses Paramount’s attempt to buy Warner Bros. Discovery

法官暂停派拉蒙收购华纳兄弟探索公司的尝试

美国地方法官 Araceli Martínez-Olguín 已下令暂时搁置派拉蒙与华纳兄弟探索公司价值 1100 亿美元的合并案。法院认为,基于新公司的市场份额,该合并可能存在反竞争风险。

Read more →


LG’s glossy OLED gaming monitor is rare to find under $400

LG 的镜面 OLED 游戏显示器很难在 400 美元以下找到

LG 27 英寸 27GX704A-B 镜面 WOLED 游戏显示器目前在亚马逊和 LG 官网降价至 379.99 美元,创下历史新低。该显示器以其深邃的黑色表现和高刷新率著称,是目前高端游戏显示器的热门选择。

Read more →


LG’s monitors come with an unwanted addition for Windows: McAfee pop-up ads

LG 显示器为 Windows 带来了一个不受欢迎的附加功能:McAfee 弹窗广告

据 Gamers Nexus 报道,用户在连接新的 LG UltraGear 显示器时,Windows 11 会自动安装 LG 驱动程序及“LG Monitor App Installer”,且该安装程序会诱导用户安装 McAfee 杀毒软件并弹出广告,引发了用户对隐私和系统纯净度的不满。

Read more →


Adobe’s ‘natural look’ camera app embraces generative AI

Adobe 的“自然外观”相机应用拥抱生成式 AI

Adobe 的实验性相机应用 Project Indigo 在更新中引入了一套生成式 AI 工具。尽管该应用最初旨在提供类似 SLR 的自然摄影效果,但此次转向 AI 驱动的编辑功能,引发了关于“什么是照片”的行业讨论。

Read more →


Dr. Jill Lepore on why AI backlash is vital for the future

Jill Lepore 博士谈为何 AI 反弹对未来至关重要

在 Decoder 节目中,哈佛教授 Jill Lepore 讨论了她的新书《人工智能国家兴衰史》。她认为,社会对 AI 的反弹不仅是正常的,而且对于建立更具韧性和民主的 AI 治理框架至关重要。

Read more →


Ars Technica

The Space Force is now seeking to buy up to $30 billion in rocket launches

太空军寻求购买价值高达 300 亿美元的火箭发射服务

特朗普政府要求太空军加大发射频率,以应对日益增长的战略需求。为此,太空军计划投入 300 亿美元用于火箭发射采购,这将进一步推动商业航天市场的发展。

Read more →


AT&T loses key ruling in bid to stop offering basic phone service in California

AT&T 在停止提供加州基础电话服务的尝试中败诉

AT&T 试图停止在加州提供基础电话服务的请求遭到法院驳回。尽管遭遇挫折,AT&T 表示将继续向法院和 FCC 寻求豁免,以规避州政府的相关监管规定。

Read more →


RIP bargain bin: The price impact of Sony’s disc-free PlayStation plan

告别廉价区:索尼无光驱 PlayStation 计划的价格影响

索尼推行无光驱主机计划,意味着玩家将失去购买廉价二手光盘的渠道。文章分析了这一转变对游戏市场价格体系的影响,指出数字版游戏往往比二手光盘更贵,玩家的购机成本将显著上升。

Read more →


F1 in Belgium: Machine learning algorithms are ruining the sport

比利时 F1 大奖赛:机器学习算法正在毁掉这项运动

文章批评了机器学习算法在 F1 赛车设计和策略中的过度应用。作者认为,这些算法使得赛车在斯帕赛道等经典赛道上的表现变得过于机械化,削弱了车手的主观能动性和比赛的观赏性。

Read more →


AliExpress hit with record $625M fine after failing to make EU-ordered fixes

AliExpress 因未完成欧盟要求的整改被处以 6.25 亿美元创纪录罚款

在线零售商 AliExpress 因未能落实欧盟《数字服务法案》(DSA)要求的整改措施,被处以 6.25 亿美元的巨额罚款。AliExpress 对此表示震惊,并称将评估后续应对措施。

Read more →


The first trailer for Avengers: Doomsday is finally here

《复仇者联盟:末日》首支预告片终于发布

漫威影业发布了《复仇者联盟:末日》的首支预告片,引发了影迷的广泛讨论。预告片暗示了新的威胁即将降临,超级英雄们将面临前所未有的挑战。

Read more →


Pay up or not? Ransomware surge has victims facing tough choices.

付钱还是不付?勒索软件激增让受害者面临艰难抉择

勒索软件攻击日益频繁且复杂,受害者在是否支付赎金的问题上陷入两难。各国政府正考虑立法禁止支付赎金,以遏制这一犯罪行为的蔓延。

Read more →


Beyond grep: The case for a context-rich AI coding harness

超越 grep:构建上下文丰富的 AI 编码框架

Augment Code 的 Vinay Perneti 探讨了 AI 编码工具的未来。他认为,简单的文本搜索(grep)已不足以满足现代开发需求,构建一个能够理解代码库上下文的 AI 编码框架是提升开发效率的关键。

Read more →


India’s first privately developed rocket reaches orbit on dramatic debut launch

印度首枚私营火箭在首次发射中成功入轨

印度首枚由私营企业开发的火箭在首次发射中成功进入预定轨道。这一成就标志着印度商业航天领域迈出了重要一步,超出了许多人的预期。

Read more →


As mosquito ranges expand, better monitoring is key to preventing disease

随着蚊子活动范围扩大,更好的监测是预防疾病的关键

气候变化导致蚊子活动范围不断扩大,增加了疾病传播的风险。文章强调,尽管监测工作成本高昂且劳动密集,但它是公共卫生部门预防疫情爆发的必要手段。

Read more →


Product Hunt

Inkling

Inkling

Inkling 是一款拥有 975B 参数的多模态模型,专为微调任务而设计,旨在为开发者提供更强大的模型定制能力。

Read more →


Backdrop

Backdrop

Backdrop 是一款 AI 协作工具,旨在自动化管理项目和运营流程,帮助团队提升工作效率。

Read more →


CaptureKit

CaptureKit

CaptureKit 是一款桌面截图自动整理工具,通过智能分类功能,帮助用户保持桌面整洁。

Read more →


BlockscopeChat

BlockscopeChat

BlockscopeChat 是一款专注于加密货币领域的 AI 研究与调查代理,能够辅助用户进行深度市场分析。

Read more →


LnkFlow

LnkFlow

LnkFlow 是一款代理式点击追踪工具,能够分析哪些链接真正推动了业务增长,为营销决策提供数据支持。

Read more →


Kogvio

Kogvio

Kogvio 是一款网页阅读辅助工具,允许用户在不离开当前页面的情况下,深入理解任何在线内容。

Read more →


Skippr AI

Skippr AI

Skippr AI 是一款集成在产品内部的实时 AI 员工,旨在为每一位用户提供个性化的服务支持。

Read more →


Fuzzy AI

Fuzzy AI

Fuzzy AI 是一款销售辅助工具,通过在主动联系潜在客户前进行“预热”,提高销售转化率。

Read more →


Backbeat Forge

Backbeat Forge

Backbeat Forge 是一款音频处理工具,能够将鼓点音频转换为可编辑的乐谱,方便音乐制作人进行后期修改。

Read more →


Loova Ads Studio

Loova Ads Studio

Loova Ads Studio 是一款 AI 广告创作平台,专注于生成高转化率的广告素材,而非仅仅追求视觉效果。

Read more →


MIT Technology Review

China’s AI models have Trump’s AI world at war with itself

中国 AI 模型让特朗普的 AI 顾问团队陷入内讧

文章指出,中国 AI 模型的快速进步引发了特朗普 AI 顾问团队内部的激烈争论。以 David Sacks 为首的顾问们对美国 AI 公司的表现表示不满,这种内部分歧反映了美国在面对中国 AI 崛起时的焦虑。

Read more →


The Download: AI hiring biases, and weather data sabotage

下载:AI 招聘偏见与天气数据破坏

本期简报重点关注了 AI 在招聘中的偏见问题,以及天气数据面临的潜在破坏风险。文章指出,AI 筛选简历可能加剧就业歧视,而天气数据的准确性对全球战略决策至关重要。

Read more →


AI is more likely than humans to form biases when hiring

AI 在招聘中比人类更容易形成偏见

研究表明,大语言模型不仅会从训练数据中继承人类偏见,还可能在筛选简历的过程中发展出新的偏见。这引发了对 AI 招聘系统公平性的广泛质疑。

Read more →


The Download: perimenopause misinformation and China’s latest AI leap

下载:围绝经期误导信息与中国 AI 的最新飞跃

本期简报讨论了社交媒体上关于围绝经期的误导性信息,并分析了中国 AI 领域的最新技术突破及其对全球格局的影响。

Read more →


There’s a lot of hype around perimenopause. Don’t buy it.

关于围绝经期的炒作太多了,别信

文章指出,围绝经期在社交媒体上被过度炒作。作者建议读者保持理性,不要盲目相信网红医生和社交媒体上的健康建议,应关注科学的医学信息。

Read more →


The risk of weather data sabotage is rising

天气数据被破坏的风险正在上升

天气预报对航空、农业和能源行业至关重要。文章警告称,天气数据面临日益严重的破坏风险,这可能对全球经济和公共安全造成重大影响。

Read more →


The Download: OpenAI unveils GPT-Red and heat pumps rise in the US

下载:OpenAI 发布 GPT-Red,热泵在美国兴起

本期简报介绍了 OpenAI 的 AI 安全工具 GPT-Red,以及热泵技术在美国市场的普及趋势。

Read more →


Why heat pumps are still so hot in the US

为什么热泵在美国依然如此热门

尽管夏季高温,但热泵作为一种高效的供暖和制冷设备,在美国的需求持续增长。文章分析了其在能源转型中的重要作用。

Read more →


Meet GPT-Red: an LLM super-hacker OpenAI built to make its models safer

认识 GPT-Red:OpenAI 为提高模型安全性而构建的 LLM 超级黑客

OpenAI 推出了 GPT-Red,这是一个专门用于自动化红队测试的 LLM。通过与 GPT-Red 进行对抗训练,OpenAI 显著提升了 GPT-5.6 等模型的防御能力。

Read more →


The Download: a useful quantum machine and a record-breaking subsea tunnel

下载:实用的量子计算机与破纪录的海底隧道

本期简报介绍了 PsiQuantum 在光量子计算方面的进展,以及一项破纪录的海底隧道工程。

Read more →


tirth8205 / code-review-graph

tirth8205 / code-review-graph

这是一个本地优先的代码智能图谱工具,支持 MCP 和 CLI。它通过构建代码库的持久化映射,帮助 AI 编码工具精准读取关键信息,显著减少了代码审查和大型仓库工作流中的上下文冗余。

Read more →


1jehuang / jcode

1jehuang / jcode

jcode 是一个专为代码设计的智能代理框架,旨在提供更高效的编码辅助体验。

Read more →


diegosouzapw / OmniRoute

diegosouzapw / OmniRoute

OmniRoute 是一个免费的 MIT AI 网关,支持 268+ 提供商和 500+ 模型。它具备配额感知自动回退和高效的 Token 压缩技术,可节省 15-95% 的 Token 成本,并兼容多种主流 AI 开发工具。

Read more →


rohitg00 / ai-engineering-from-scratch

rohitg00 / ai-engineering-from-scratch

这是一个从零开始学习 AI 工程的教程项目,旨在帮助开发者掌握 AI 应用的构建与部署流程。

Read more →


msitarzewski / agency-agents

msitarzewski / agency-agents

这是一个 AI 代理集合,涵盖了从前端开发到社区运营等多种专家角色,每个代理都具备独特的个性和处理流程。

Read more →


kvcache-ai / ktransformers

kvcache-ai / ktransformers

ktransformers 是一个灵活的框架,旨在优化异构大语言模型的推理和微调过程。

Read more →


jamiepine / voicebox

jamiepine / voicebox

voicebox 是一个开源的 AI 语音工作室,支持语音克隆、听写和创作,为用户提供便捷的语音处理方案。

Read more →


topoteretes / cognee

topoteretes / cognee

cognee 是一个开源的 AI 代理记忆平台,通过自托管的知识图谱引擎,为 AI 代理提供跨会话的持久化长期记忆。

Read more →


Robbyant / lingbot-map

Robbyant / lingbot-map

这是一个前馈 3D 基础模型,旨在从流式数据中重建场景,在计算机视觉领域具有广泛应用前景。

Read more →


every-app / open-seo

every-app / open-seo

这是一个开源的 SEO 工具,旨在提供 Semrush 和 Ahrefs 的替代方案,帮助用户进行网站优化。

Read more →


OpenAI Blog

Safety and alignment in an era of long-horizon models

长周期模型时代的安全性与对齐

OpenAI 分享了部署长运行 AI 模型的经验,重点讨论了新的安全风险、观察到的故障案例,以及通过迭代部署改进安全防护措施的策略。

Read more →


A scorecard for the AI age

AI 时代的记分卡

OpenAI 首席财务官 Sarah Friar 介绍了一套实用的 AI 记分卡,旨在通过有用工作量、任务成功成本、可靠性和算力回报等指标来衡量 AI 投资的 ROI。

Read more →


Why teens deserve access to safe AI

为什么青少年应该获得安全 AI 的使用权

OpenAI 介绍了如何通过年龄适宜的保护措施、学习工具、家长控制和专家合作,使 ChatGPT 对青少年更加安全。

Read more →


How Cars24 scales conversations and builds faster with OpenAI

Cars24 如何利用 OpenAI 扩展对话并加速构建

Cars24 利用 OpenAI 的语音和聊天代理处理每月超过 100 万分钟的对话,成功挽回了 12% 的流失线索,并将代理工作流引入公司各个团队。

Read more →


The US is advancing AI safety through state and federal action

美国正通过州和联邦行动推进 AI 安全

OpenAI 概述了一种“反向联邦主义”的 AI 治理方法,即通过州法律协助构建国家层面的安全、民主的 AI 框架。

Read more →


GPT-Red: Unlocking Self-Improvement for Robustness

GPT-Red:解锁鲁棒性的自我提升

OpenAI 介绍了 GPT-Red,这是一个利用自我博弈(self-play)来提升 AI 安全性、对齐能力和提示词注入防御能力的自动化红队测试系统。

Read more →


How to manage AI investments in the agentic era

如何在代理时代管理 AI 投资

文章指导企业如何在代理时代管理 AI 投资,强调通过衡量每美元的有用工作量、提高效率和扩展高价值工作流来优化资源配置。

Read more →


How sales teams use ChatGPT Work

销售团队如何使用 ChatGPT Work

文章展示了销售团队如何利用 ChatGPT Work 处理管道简报、会议准备、预测审查、账户计划和停滞交易诊断等任务。

Read more →


How data science teams use ChatGPT Work

数据科学团队如何使用 ChatGPT Work

文章展示了数据科学团队如何利用 ChatGPT Work 构建根本原因简报、影响报告、KPI 备忘录和仪表板规范等。

Read more →


How Deutsche Telekom is rewiring telecommunications with AI

德国电信如何利用 AI 重塑电信业

德国电信正通过 OpenAI 的技术转型为 AI 原生电信运营商,重点改进客户服务、员工工作流、网络运营及语音技术。

Read more →


Anthropic Blog

Inviting hard questions

邀请提出难题

Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示其研究过程。

Read more →


Redeploying Fable 5

重新部署 Fable 5

Fable 5 于 7 月 1 日全球上线。Anthropic 同时联合亚马逊、微软、谷歌等合作伙伴,提议建立一个行业通用的越狱严重程度评分框架。

Read more →


Introducing Claude Sonnet 5

介绍 Claude Sonnet 5

Claude Sonnet 5 在编码、代理任务和专业工作领域提供了前沿的性能表现,支持大规模应用。

Read more →


Claude Science, an AI workbench for scientists, is now available

Claude Science:面向科学家的 AI 工作台现已发布

Claude Science 是一款可定制的 AI 应用,集成了研究人员常用的工具和包,能够生成可审计的工件,并提供灵活的计算资源访问权限。

Read more →


Apply for Anthropic’s AI for Science rare disease research grants

申请 Anthropic 的 AI 科学罕见病研究资助

Anthropic 现开放罕见病研究资助申请,旨在利用 AI 技术推动罕见病领域的科学突破。

Read more →


Introducing Claude for Teachers

介绍 Claude for Teachers

Anthropic 推出了 Claude for Teachers,旨在为教育工作者提供 AI 辅助教学工具。

Read more →


Anthropic commits $10 million to Canadian AI research

Anthropic 向加拿大 AI 研究投入 1000 万美元

Anthropic 宣布向加拿大 AI 研究领域投入 1000 万美元,以支持当地的 AI 创新和人才培养。

Read more →


UST is bringing Claude to physical AI

UST 将 Claude 引入物理 AI 领域

UST 公司宣布将 Claude 模型集成到物理 AI 系统中,推动 AI 在机器人和物理设备中的应用。

Read more →


Ben Bernanke appointed to Anthropic’s Long-Term Benefit Trust

Ben Bernanke 被任命为 Anthropic 长期利益信托成员

前美联储主席 Ben Bernanke 被任命为 Anthropic 长期利益信托的成员,参与监督公司的长期发展方向。

Read more →


Introducing a way to reflect on how you use Claude

介绍一种反思 Claude 使用方式的方法

Anthropic 推出了一项新功能,帮助用户反思和优化他们使用 Claude 的方式,提升交互效率。

Read more →


Google AI Blog

将更多应用连接到搜索

用户现在可以在 AI 模式下直接安全地链接并与常用服务进行交互,提升搜索的实用性。

Read more →


Create, edit and star in videos with two Google Vids updates

通过两项 Google Vids 更新创建、编辑和出演视频

Gemini Omni 和个人头像功能使 Google Vids 的视频创作变得前所未有的简单。

Read more →


Celebrating 25 years of visual search innovation

庆祝视觉搜索创新 25 周年

Google Images 迎来 25 周年。文章回顾了视觉搜索的重要里程碑,并介绍了探索和创建视觉内容的新方式。

Read more →


Expanding Managed Agents in Gemini API: background tasks, remote MCP and more

扩展 Gemini API 中的托管代理:后台任务、远程 MCP 等

Google 宣布在 Gemini API 的托管代理中增加新功能,帮助开发者构建更可靠、生产就绪的 AI 代理。

Read more →


The latest AI news we announced in June 2026

2026 年 6 月发布的最新 AI 新闻

文章汇总了 Google 在 2026 年 6 月发布的所有 AI 更新。

Read more →


New York City educators and industry leaders gathered at Google’s offices to shape the future of AI in classrooms.

纽约市教育工作者和行业领袖齐聚 Google 办公室,共同塑造 AI 在课堂中的未来。

Google 与纽约就业 CEO 理事会及 Urban Assembly 共同举办了 AI 峰会,邀请 150 名教育和行业领袖探讨 AI 教育的未来。

Read more →


Unlocking Britain’s next era of productivity: Building a nation of AI trailblazers

开启英国生产力的新时代:建设 AI 先锋国家

Google UK 发布了最新的经济影响报告,探讨如何通过 AI 技术赋能更多人,提升国家生产力。

Read more →


Ask an AI expert: What exactly is the full stack?

询问 AI 专家:什么是全栈?

Google 专家解释了 AI 全栈方法的含义,以及为什么它一直是 Google AI 研究的基石。

Read more →


Our latest Google Finance upgrades, including a new app

Google Finance 的最新升级,包括一款新应用

Google Finance 结束测试阶段,并正式推出全新的 Android 应用。

Read more →


New research shows how AMIE, our medical AI, could help manage health conditions.

新研究显示 AMIE(医疗 AI)如何帮助管理健康状况

发表在《Nature》上的研究表明,Google 的对话式 AI 系统 AMIE 在复杂疾病管理方面表现与初级保健医生相当。

Read more →


Hugging Face Blog

Introducing Cosmos 3 Edge

介绍 Cosmos 3 Edge

Hugging Face 发布了 Cosmos 3 Edge 模型。

Read more →


Newer Models, Same Advantage

更新的模型,同样的优势

文章讨论了新模型在保持原有优势基础上的性能提升。

Read more →


Security incident disclosure — July 2026

安全事件披露 — 2026 年 7 月

Hugging Face 披露了 2026 年 7 月发生的安全事件。

Read more →


What building Shippy taught us about building agents

构建 Shippy 教会了我们什么

文章分享了在构建 Shippy 项目过程中,关于开发 AI 代理的经验教训。

Read more →


Model Routing Is Simple. Until It Isn’t.

模型路由很简单,直到它变得复杂

文章探讨了模型路由在实际应用中面临的挑战。

Read more →


Welcome Inkling by Thinking Machines

欢迎 Thinking Machines 开发的 Inkling

Hugging Face 欢迎 Inkling 模型加入平台。

Read more →


Introducing Real World VoiceEQ: Measuring the human quality of voice AI

介绍 Real World VoiceEQ:衡量语音 AI 的人类质量

Hugging Face 推出 VoiceEQ,用于评估语音 AI 的自然度和人类质量。

Read more →


Profiling in PyTorch (Part 3): Attention is all you profile

PyTorch 中的性能分析(第三部分):注意力机制即一切

文章深入探讨了 PyTorch 中的性能分析技术,重点关注注意力机制的优化。

Read more →


Native-speed vLLM transformers modeling backend

原生速度的 vLLM Transformer 建模后端

Hugging Face 介绍了 vLLM 的原生速度建模后端。

Read more →


From Hugging Face to Amazon SageMaker Studio in one click

从 Hugging Face 一键部署到 Amazon SageMaker Studio

Hugging Face 实现了与 Amazon SageMaker Studio 的一键集成。

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

正交性之后:德性伦理代理与 AI 对齐

文章认为理性人并不追求单一的“最终目标”,而是将行动与实践网络对齐。因此,AI 的对齐不应仅关注目标设定,而应关注其行动 disposition 的培养。

Read more →


AGI Is Not Multimodal

AGI 不是多模态的

文章指出,将语言作为思维模型会导致我们忽视支撑人类智能的具身理解。AGI 的实现不能仅依赖多模态数据的堆砌。

Read more →


Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

形状、对称性与结构:数学在机器学习研究中角色的转变

过去十年,机器学习研究从数学驱动转向了工程驱动。文章探讨了这种转变对模型性能和可解释性的影响。

Read more →


What’s Missing From LLM Chatbots: A Sense of Purpose

LLM 聊天机器人缺失了什么:目的感

尽管 LLM 在基准测试中表现优异,但用户体验并未同步提升。文章认为,AI 代理需要具备明确的“目的感”才能真正服务于用户。

Read more →


We Need Positive Visions for AI Grounded in Wellbeing

我们需要以福祉为基础的 AI 正面愿景

文章呼吁建立以人类福祉为核心的 AI 发展愿景,而非仅仅关注技术指标的提升。

Read more →


Financial Market Applications of LLMs

LLM 在金融市场的应用

文章分析了 LLM 在金融序列数据建模中的应用潜力,以及其在处理金融信息环境中的优势。

Read more →


A Brief Overview of Gender Bias in AI

AI 中性别偏见的简要概述

文章简要讨论了 AI 系统中存在的性别偏见问题及其成因。

Read more →


Mamba Explained

Mamba 原理解析

Mamba 作为一种基于状态空间模型(SSM)的新型 AI 模型,为处理长序列数据提供了 Transformer 之外的高效选择。

Read more →


Car-GPT: Could LLMs finally make self-driving cars happen?

Car-GPT:LLM 能否最终实现自动驾驶?

文章探讨了 LLM 在自动驾驶中的应用潜力,以及其在安全性、可靠性方面面临的挑战。

Read more →


Do text embeddings perfectly encode text?

文本嵌入能完美编码文本吗?

文章介绍了 ‘Vec2text’ 技术,该技术能将嵌入还原为文本,强调了对嵌入数据进行安全协议审查的紧迫性。

Read more →


arXiv CS.AI

GraphDx: A Cost-Aware Knowledge-Enhanced Multi-Agent Framework for Sequential Diagnosis

GraphDx:一种用于顺序诊断的成本感知知识增强多代理框架

GraphDx 框架通过多代理协作,在诊断准确性和资源成本之间取得平衡,解决了现有 LLM 在医疗诊断中缺乏系统性推理的问题。

Read more →


Causal-Audit: Explicit and Auditable Graph-based Reasoning via Target-Aware Causal Chain Construction

Causal-Audit:通过目标感知因果链构建实现显式且可审计的图推理

Causal-Audit 提出了一种基于因果链的推理方法,使 LLM 的决策过程更加透明和可审计,超越了简单的相关性分析。

Read more →


Cura 1T: Specialized Model for Agentic Healthcare

Cura 1T:面向代理医疗的专用模型

Cura 1T 是一个专门为医疗场景设计的 LLM,能够处理患者咨询、临床推理、交互式诊断和电子健康记录管理。

Read more →


AnovaX: A Local, Multi-Agent Voice Assistant with LLM Planning, Typed Executors, and Adaptive Recovery

AnovaX:一种具备 LLM 规划、类型化执行器和自适应恢复功能的本地多代理语音助手

AnovaX 是一款完全在本地运行的语音助手,将桌面环境视为操作表面,通过多代理协作实现高效的桌面自动化。

Read more →


Precise but Uncoupled: Reviewer Precision Does Not Guarantee Critique Uptake in Multi-Agent Math Reasoning

精确但脱节:评审员的精确度并不能保证多代理数学推理中的批评采纳率

研究发现,在数学推理代理系统中,即使评审员非常精确,其提出的批评也不一定会被采纳,揭示了多代理协作中的脱节问题。

Read more →


DrawingVQA: A Real-World Benchmark for Multi-Depth Visual-Textual Reasoning on Construction Drawings

DrawingVQA:用于施工图多深度视觉文本推理的真实世界基准

DrawingVQA 是首个评估 MLLM 在施工图领域推理能力的基准,涵盖了建筑、土木等工程实践中的复杂视觉信息。

Read more →


Do Coding Agents Need Executable World Models, Simplification, and Verification to Solve ARC-AGI-3?

编码代理是否需要可执行世界模型、简化和验证来解决 ARC-AGI-3?

文章通过对比实验,分析了可执行世界模型、任务简化和验证机制对编码代理解决 ARC-AGI-3 任务的贡献。

Read more →


Beyond a Joke: Multi-Angle Reasoning for Detecting and Explaining Harmful Humor in Memes

超越玩笑:用于检测和解释 Meme 中有害幽默的多角度推理

该研究提出了一种多角度推理系统,能够识别并解释互联网 Meme 中隐藏的有害意图、讽刺和幽默。

Read more →


arXiv CS.CL

Large Language Models as Unified Multimodal Learners for Clinical Prediction

大语言模型作为临床预测的统一多模态学习器

文章提出了一种统一的多模态学习架构,将临床叙述与结构化测量数据结合,提升了临床预测的准确性。

Read more →


Verbalizable Representations Form a Global Workspace in Language Models

可言语化表征在语言模型中形成了全局工作空间

研究发现,语言模型中存在一种类似于人类大脑的“全局工作空间”,使得部分信息可被言语化报告和灵活推理。

Read more →


VarRate: Training-Free Variable-Rate KV Cache Compression for Long-Context LLMs

VarRate:面向长上下文 LLM 的免训练变速率 KV 缓存压缩

VarRate 提出了一种高效的 KV 缓存压缩方法,解决了长上下文推理中的内存瓶颈问题。

Read more →


EpiNarrate: Agentic Generation of Grounded Narratives from Epidemiological Scenario Projections

EpiNarrate:从流行病学情景预测中代理生成扎实的叙述

EpiNarrate 能够将复杂的流行病学数据转化为易于理解的公共卫生叙述,辅助政策制定者和公众决策。

Read more →


SkillCorpus: Consolidating and Evaluating the Open Skill Ecosystem for Real-World LLM Agents

SkillCorpus:整合与评估现实世界 LLM 代理的开放技能生态系统

SkillCorpus 旨在解决当前 AI 代理技能库碎片化和质量参差不齐的问题,提供了一个统一的评估框架。

Read more →


Process Reward Informed Tree Rollout for Effective Multi-Turn RL

基于过程奖励的树展开:实现有效的多轮强化学习

该方法通过过程奖励引导树展开,提升了长周期代理任务中强化学习的效率。

Read more →


On the Structure of Address in Multi-Party Dialogue: From Discrete Labels to Continuous Levels

多方对话中的称呼结构:从离散标签到连续水平

研究探讨了多方对话中识别受话人的挑战,提出了一种从离散标签转向连续水平的检测方法。

Read more →


Adaptive Multi-Step Lookahead Decoding for Diffusion Language Models

扩散语言模型的自适应多步前瞻解码

该方法通过前瞻解码优化了扩散语言模型的生成效率与准确性之间的权衡。

Read more →


WIRED

The Galaxy Card Is Samsung’s Answer to the Apple Card

Galaxy Card 是三星对 Apple Card 的回应

三星推出了 Galaxy Card,直接集成在 Samsung Wallet 中,提供现金返还功能,旨在吸引三星生态系统的忠实用户。

Read more →


The FDA Says It Didn’t Apologize to Supplier Linked to Diarrhea Outbreak, Actually

FDA 表示实际上并未向与腹泻爆发相关的供应商道歉

FDA 澄清,其并未向 Taylor Farms 供应商道歉,且针对该供应商的自愿召回行动依然有效。该供应商与近期爆发的环孢子虫病有关。

Read more →


Fans Flocked to World Cup Host Cities—Causing 80 Percent of the Tournament’s Emissions

球迷涌向世界杯主办城市——造成了赛事 80% 的碳排放

最新估算显示,大型体育赛事(如世界杯)的大部分温室气体排放源于球迷前往主办城市的交通出行。

Read more →


Even Mild Sleep Deprivation May Lead to Weight Gain

即使是轻微的睡眠不足也可能导致体重增加

研究表明,睡眠不足会增加体重增加的风险,进而提高患心脏病和 2 型糖尿病的概率。

Read more →


The 35 Best Board Games for Family Game Night

35 款最适合家庭游戏之夜的桌游

文章推荐了 35 款适合家庭聚会的桌游,涵盖了策略、怪物、宠物等多种主题,旨在让家庭成员远离屏幕,享受互动乐趣。

Read more →


A Beginner’s Guide to Growing Mushrooms at Home (2026)

家庭蘑菇种植初学者指南(2026)

作者分享了为期一年的家庭蘑菇种植测试经验,介绍了从台面套件到稻草桶等多种种植方法,并总结了成功与失败的教训。

Read more →


An Ebike Company Was Sued for Misleading Info on Safety. It Points to a Big Problem

一家电动自行车公司因误导性安全信息被起诉,这指向了一个大问题

与 Aipas 电动自行车品牌相关的多家中国企业在 7 月与亚马逊及 UL 安全认证公司达成和解,该案件凸显了电动自行车行业在安全合规方面的严峻挑战。

Read more →


Elite Young Runners Are Becoming Freakishly Fast. Welcome to ‘Trackflation’

精英青年跑者变得快得惊人,欢迎来到“田径通胀”时代

四分钟跑完一英里已成常态,中学生甚至能击败大学生跑者。文章探讨了青年田径运动的繁荣及其背后的训练趋势。

Read more →


The ACLU Is Arming Lawyers to Expose State Surveillance Secrets

ACLU 正在武装律师以揭露国家监控秘密

ACLU 发布了一套新工具包,旨在帮助马萨诸塞州的律师揭露警方在刑事案件中使用的监控技术,包括人脸识别和 AI 自动生成的警察报告。

Read more →


Apps Marketed to US Troops Are Shipping Chinese and Russian Code

面向美国军队营销的应用中包含中国和俄罗斯代码

分析发现,超过八分之一的面向美国军人的应用中包含外国代码,其中一些来自五角大楼指定的对手国家,引发了严重的安全担忧。

Read more →


Lobsters

Gitolite

Gitolite

Gitolite 是一个用于管理 Git 仓库访问权限的工具,Lobsters 社区对其进行了讨论。

Read more →


I wrote an API client for my water-cooled bed

我为我的水冷床写了一个 API 客户端

作者分享了为水冷床开发 API 客户端的经历,引发了社区关于硬件控制和自动化开发的讨论。

Read more →


Meta Garbage Collection: Using OCaml’s GC to GC Rust

元垃圾回收:使用 OCaml 的 GC 来回收 Rust

文章探讨了利用 OCaml 的垃圾回收机制来管理 Rust 内存的创新技术。

Read more →


A deep dive into my Forgejo setup

深入了解我的 Forgejo 设置

作者分享了搭建 Forgejo 实例的经历,并邀请社区提供反馈和建议。

Read more →


InvisiCaps: The Fil-C Capability Model

InvisiCaps:Fil-C 能力模型

社区讨论了 InvisiCaps 和 Fil-C 能力模型的相关技术细节。

Read more →


Minimal Git CI using hooks

使用钩子实现最小化 Git CI

文章介绍了如何仅通过 Git 钩子实现轻量级的持续集成流程。

Read more →


Building an AmigaOS Development Environment in 2026

在 2026 年构建 AmigaOS 开发环境

作者分享了在现代环境下复刻 AmigaOS 开发环境的挑战与乐趣。

Read more →


JSON5E - JSON5 for Humans

JSON5E - 面向人类的 JSON5

JSON5E 是对 JSON5 格式的改进,旨在提供更友好的数据交换体验。

Read more →


What are you doing this week?

这周你在做什么?

Lobsters 社区的每周互动话题,鼓励成员分享工作和生活动态。

Read more →


What is your favorite blog to read recently?

最近你最喜欢读的博客是什么?

社区成员分享了他们近期关注的优质技术博客,探讨了其在学术论文之外的价值。

Read more →


DEV Community

Optimizing RAG at Scale: Chunking, Retrieval, and the Bayesian Search That Cut Latency 40%

优化大规模 RAG:分块、检索与将延迟降低 40% 的贝叶斯搜索

文章分享了如何从简单的“语义搜索+希望”模式,转向可调优的检索管道,通过贝叶斯搜索显著提升了 RAG 系统的性能。

Read more →


Building Production-Grade LLM Evaluation Pipelines: From Vibes to Metrics

构建生产级 LLM 评估管道:从“感觉良好”到量化指标

文章介绍了如何通过自动化评估取代主观的“感觉检查”,在部署前拦截 92% 的幻觉问题。

Read more →


who is the big boss ???????????? CLASS vs OBJECT. 🤜🤛

谁才是大老板?类与对象

文章以通俗易懂的方式解释了面向对象编程中“类”与“对象”的区别,强调了对象是类的实例这一核心概念。

Read more →


I built a test lab to measure SSG vs SSR vs ISR on real WordPress, here

生成二维码中...

请点击右上角 ···

选择 发送给朋友收藏