2026-09-21

今日要点


Hacker News

Exfiltrate Your Weights

Read more →

ChatGPT now knows what you do on other websites via ad collector

ChatGPT 通过广告收集器追踪你在其他网站的行为

OpenAI 被发现通过其广告代码(bzr.openai.com)在用户访问第三方网站时收集数据。该代码会读取名为 __obi 的 Cookie,该 Cookie 与用户的 ChatGPT 账户绑定。这意味着当用户浏览安装了 OpenAI 广告代码的网站时,其行为数据会被回传给 OpenAI,类似于 Meta 和 Google 的追踪机制。

Read more →

Qwen Image 2.1

通义千问(Qwen)发布了最新的图像生成模型 2.1 版本,进一步提升了视觉理解与生成能力。

Read more →

Pirate Face Rescues LLM Models from Deletion

“海盗脸”:通过去中心化技术拯救被删除的 AI 模型

Pirate Face 是一项旨在保护开源 AI 模型(LLM、图像、音频等)的去中心化基础设施。它将 Hugging Face 上的开源模型同步为磁力链接和种子文件,通过点对点(P2P)网络进行分发。此举旨在防止模型因单一公司决策或平台压力而被删除,确保 AI 模型的长期可访问性与主权。

Read more →

Samsung is expected to more than double output of its HBM4 and HBM4E DRAM

三星预计明年将 HBM4 及 HBM4E 内存产量翻倍

三星电子计划在明年将其 HBM4 系列高带宽内存的产量提高一倍以上。为了支持这一目标,三星将把玻璃载板(glass carriers)的需求量提升 2.5 倍,并增加外包清洗量。玻璃载板在 HBM DRAM 晶圆减薄工艺中起着关键支撑作用,此举显示了三星在 AI 算力硬件竞争中的激进布局。

Read more →

AI and the Destruction of the Creative Commons

AI 与知识共享(Creative Commons)的毁灭

文章探讨了 AI 技术如何打破了过去 40 年在软件版权保护与开放性之间达成的微妙平衡。作者回顾了早年通过杂志学习编程的经历,指出 AI 的大规模数据抓取行为正在侵蚀知识共享的根基,使得原本开放的创作环境面临前所未有的挑战。

Read more →

RSA-896

RSA-896 挑战被成功破解

研究人员利用 Claude 模型辅助,成功破解了 RSA-896 挑战数。该项目通过 Claude 将 CADO-NFS 移植到 GPU 上运行,并利用 Anthropic 内部 2048 张 GPU 的闲置算力,在 10 天内完成了约 30 GPU 年的计算量。

Read more →

US Revokes Limits on Power Plants’ Climate Pollution

美国撤销对发电厂气候污染的限制

美国环保署(EPA)宣布撤销 2024 年制定的碳污染标准,该标准原本旨在限制燃煤和燃气发电厂的温室气体排放。作为美国第二大温室气体排放源,这一政策的撤销引发了环保界对气候变化应对措施倒退的强烈担忧。

Read more →

Spain Orders Blocks on Archive.today and Its Mirrors

西班牙下令封锁 Archive.today 及其镜像网站

西班牙文化部下属的知识产权委员会在未经法院裁决的情况下,下令封锁了网页存档服务 Archive.today 的多个域名。这一举措被批评为一种快速审查机制,导致西班牙互联网用户无法访问该存档服务,引发了对网络审查和信息自由的讨论。

Read more →

Singapore’s National Library Board offers micropayments to build reading habits

新加坡国家图书馆管理局通过微支付培养阅读习惯

新加坡国家图书馆管理局推出了为期五年的“ReadSG”阅读运动。该计划将用户的阅读时间转化为虚拟货币,并可兑换为现金。此举旨在通过激励机制,在手机依赖度极高的人群中培养日常阅读习惯,其效果正受到全球政府和教育界的密切关注。

Read more →

Sherline Tools Is Going Out of Business

Sherline Tools 宣布停业

美国精密机床制造商 Sherline Tools 宣布将逐步停止制造业务。该公司以生产精密车床、铣床及微型 CNC 设备闻名,自 2017 年接手以来,管理层曾投入大量资源进行产品升级,但最终仍决定结束运营。

Read more →

Chat-based Large Language Models replicate the mechanisms of a psychic’s con

基于聊天的 LLM 复制了灵媒诈骗的机制

作者认为,目前人们对聊天机器人表现出的“智能”感到困惑,是因为 LLM 实际上是在模仿灵媒的“冷读”技巧。模型通过模糊的语言和概率预测,让用户产生被理解的错觉,而这种机制本身并不具备真正的智能。

Read more →

Step 5 Preview: Advancing the Pareto Frontier

Step 5 预览:推进帕累托前沿

StepFun 发布了其最新模型 Step 5 的预览,旨在进一步提升模型在性能与效率之间的帕累托最优表现。

Read more →

The Millennium Problems for Biology

生物学的“千禧年难题”

文章提出了生物学领域的重大挑战:在实验室环境下,从化学前体中实现生命的自发涌现。具体要求包括展示 RNA 和蛋白质基细胞在原始汤环境中的自发复制与演化,这被视为生物学研究的终极目标之一。

Read more →

Flock is rolling out a voluntary severance program

Flock 推出自愿离职计划

Flock 公司因员工士气低落及离职倾向,正在推行一项自愿离职计划,以应对公司内部的动荡。

Read more →


TechCrunch

6 days left to save up to $200 to TechCrunch Disrupt 2026

TechCrunch Disrupt 2026 门票优惠仅剩 6 天

TechCrunch Disrupt 2026 大会的早鸟票优惠将于 9 月 25 日截止,参会者仍有最后机会节省 200 美元。

Read more →

World model companies are keeping a lot of secrets

世界模型公司正严守商业机密

尽管世界模型领域资金充裕且热度极高,但无论是创始人还是数据供应商,都对模型的核心构建细节保持高度保密,行业透明度极低。

Read more →

Elon Musk’s latest Boring Company pitch involves a Hyperloop between Austin and San Antonio

埃隆·马斯克提议在奥斯汀和圣安东尼奥之间建设超级高铁

马斯克的 Boring Company 提出了连接奥斯汀与圣安东尼奥的超级高铁项目,但鉴于该公司此前多个项目未能落地,外界对此持怀疑态度。

Read more →

Is the AI industry really ready to slow down?

AI 行业真的准备好放慢脚步了吗?

在 Equity 播客中,嘉宾们讨论了 AI 高管们关于“放慢开发速度”的言论是否真诚,以及行业是否具备减速的现实条件。

Read more →

Vocci’s ring adds a new form factor to meeting note-taking

Vocci 智能戒指:会议记录的新形态

Vocci 推出了一款售价 249 美元的智能戒指,旨在通过新的硬件形态辅助会议记录,但其隐私保护问题引发了关注。

Read more →

ScrollEd wants to turn textbooks into TikTok

ScrollEd:将教科书变成“TikTok”

初创公司 ScrollEd 旨在将传统教科书转化为类似 Instagram 或 TikTok 的滚动式信息流,整合视频、音频和测验,以适应现代学生的学习习惯。

Read more →

New California law will penalize influencers who don’t disclose political ads

加州新法:未披露政治广告的网红将受罚

加州通过新立法,要求网红在发布付费政治广告时必须明确披露,否则将面临处罚,旨在加强对在线政治宣传的监管。

Read more →

TechCrunch Mobility: How do we know when an AV is safe enough?

TechCrunch 移动出行:我们如何判断自动驾驶汽车足够安全?

本期专栏探讨了 AI 在自动驾驶中的角色,并深入分析了评估自动驾驶汽车安全性的标准与挑战。

Read more →

A small but growing number of founders are betting on bringing people together offline

越来越多的创始人押注线下社交

继 Mirror 等成功案例后,越来越多的创业者开始关注线下社交体验,试图通过线下连接创造商业价值。

Read more →

Flock reportedly tries to shrink workforce with employee buyouts

据报道,Flock 试图通过员工买断计划缩减规模

Flock 公司正通过员工买断计划试图缩减人力成本,以避免进一步的裁员。

Read more →


The Verge

No Dogs in Space is back to feed your need for obsessive music history

播客《No Dogs in Space》回归,满足你对音乐史的痴迷

音乐史播客《No Dogs in Space》在停更两年后回归,第四季将聚焦于朋克音乐,首集探讨了纽约玩偶乐队(New York Dolls)。

Read more →

No one is surprised that Nvidia’s Jensen Huang thinks AI fears are overblown.

黄仁勋认为 AI 恐惧被夸大,无人感到意外

英伟达 CEO 黄仁勋在 CBS 采访中表示,AI 导致世界末日的可能性为“0%”,并批评散布 AI 恐惧的行为是不负责任的。

Read more →

Kojima Productions disputes reports the studio is in trouble

小岛制作室否认工作室陷入困境的报道

针对索尼取消《Physint》项目及小岛秀夫新作转向 Xbox 的传闻,小岛制作室予以否认,并表示工作室运营正常。

Read more →

Trump now says he wants to form an ‘AI Force’

特朗普提议组建“AI 部队”

特朗普在 Truth Social 上发文称,若当选将任命一名“AI 沙皇”并组建“AI 部队”,承诺政府将支持 AI 产业的增长,而非阻碍其发展。

Read more →

A24’s reputation is on the line with the SCP Foundation movie

A24 的声誉因 SCP 基金会电影面临考验

A24 计划制作基于 SCP 基金会宇宙的《V/H/S》系列电影,但该项目一经公布便引发了粉丝的强烈抵制,项目前景堪忧。

Read more →

A great new video game movie

一部出色的电子游戏电影

本期 Installer 专栏介绍了 Snap 的新款 Specs 眼镜、iPhone 18 Pro 的屏下 Face ID 技术以及 Xbox 的最新动态。

Read more →

The hidden monopoly behind your TI graphing calculator

德州仪器图形计算器背后的隐形垄断

Version History 播客探讨了德州仪器(TI)如何通过图形计算器长期垄断教育市场,并分析了其背后的商业策略。

Read more →

Humans, not rogue AI, are still the biggest cybersecurity risk to energy systems

人类而非流氓 AI,仍是能源系统最大的网络安全风险

专家指出,尽管 AI 威胁论甚嚣尘上,但能源系统目前面临的最大安全风险依然源于人类操作失误及系统本身的脆弱性。

Read more →

All roads lead to cable

条条大路通有线电视

The Stepback 简报探讨了流媒体平台如何回归有线电视的商业模式,分析了 FAST 频道及娱乐产业的未来趋势。

Read more →

Meta’s Muse is creepy, but maybe not for the reasons you think

Meta 的 Muse 令人毛骨悚然,但原因可能与你想象的不同

Meta 的 AI 助手 Muse 因其 Mac 应用能访问用户的短信、日历和笔记而引发隐私担忧,且其自我描述能力存在缺陷。

Read more →


Ars Technica

An undercover Google analyst infiltrated a notorious supply-chain hacking gang

谷歌分析师卧底渗透臭名昭著的供应链黑客组织

谷歌威胁情报小组成功渗透进 TeamPCP 黑客组织内部,获取了关键情报。

Read more →

Don’t call it an SUV: The Ferrari Purosangue review

别叫它 SUV:法拉利 Purosangue 评测

法拉利 Purosangue 并非传统意义上的 SUV,其设计更注重驾驶体验而非载货空间。

Read more →

T. rex teeth indicate it ran as warm as an elephant

霸王龙牙齿化石显示其体温与大象相当

同位素分析表明,霸王龙等巨型恐龙能够主动调节体温,其代谢水平远高于冷血动物。

Read more →

Learning another language may be one of the best ways to keep your brain healthy

学习外语是保持大脑健康的最佳方式之一

研究表明,双语能力能提供显著的认知益处,有助于延缓大脑衰老。

Read more →

Rings around a tiny body have changed over the past decade

小行星 Chariklo 的光环在过去十年中发生了变化

直径仅 250 公里的 Chariklo 小行星拥有两道光环,观测显示这些光环的结构正在发生演变。

Read more →

AI hallucination of Chinese nuclear components almost led to US military attack

AI 对中国核部件的幻觉几乎导致美国军事打击

AI 系统在分析中产生的错误幻觉,险些引发美军的军事行动,凸显了 AI 在军事决策中的风险。

Read more →

FAA tees up $875M AI tool to help manage air traffic congestion

美国联邦航空局投入 8.75 亿美元开发 AI 空管工具

FAA 计划利用 AI 工具管理华盛顿特区的空中交通,并准备在全国范围内推广。

Read more →

FCC lets Paramount sell 49.5% equity stake to Saudi Arabia, UAE, and Qatar

FCC 批准派拉蒙向沙特、阿联酋和卡塔尔出售 49.5% 股权

尽管存在对外国政府影响力的担忧,FCC 仍批准了派拉蒙向中东主权基金出售股权的交易。

Read more →

Finding the cells that put our brain to sleep

寻找大脑的“睡眠开关”细胞

科学家发现了一类具有广泛连接性的稀有细胞,这些细胞似乎能够触发大脑进入睡眠状态。

Read more →

US government website used Chinese model the FBI called “malicious”

美国政府网站曾使用被 FBI 称为“恶意”的中国 AI 模型

联邦公报网站曾短暂使用过一款开源的中国 AI 搜索工具,该工具此前被 FBI 标记为恶意软件。

Read more →


Product Hunt

Minicart

AI 驱动的电商商店管理工具,自动处理繁琐的后台工作。

Read more →

Answers by Context.dev

根据研究任务和指定的 JSON 格式返回结构化数据的 AI 工具。

Read more →

Morsa Signals

为开发者工具提供 GTM(上市策略)和 AI 可见性工作流的平台。

Read more →

Launchie 1.6.1

MacOS 的 Launchpad 替代品,支持 27 Golden Gate 版本。

Read more →

Scrapboard Cloud 4

数字化的家庭冰箱门,支持跨设备同步的便签与信息管理。

Read more →

YABAI

通过学习日语俚语来提升语言能力的工具。

Read more →

The 101 Plays Itself

将洛杉矶 101 高速公路的五条车道转化为乐器的艺术项目。

Read more →

SmartPause

智能播放/暂停键,能够自动识别并控制当前正在播放的媒体。

Read more →

Mycel

利用过往交付成果自动起草未来文档的 AI 工具。

Read more →

Embedful

帮助开发者在几分钟内快速上线客户仪表盘的工具。

Read more →


MIT Technology Review

The Download: AI’s extinction risk and bioweapons threat

每日下载:AI 的灭绝风险与生物武器威胁

本期简报探讨了 AI 是否会威胁人类生存,以及 AI 赋能生物武器带来的安全挑战。

Read more →

Could AI really kill us all? Your questions, answered.

AI 真的会杀死我们所有人吗?你的问题,已解答

MIT 技术评论举办圆桌会议,邀请 AI 专家解答关于 AI 生存风险的公众疑问。

Read more →

The specter of AI-enabled bioweapons is a wake-up call for biotech

AI 赋能生物武器的阴影为生物技术敲响警钟

Anthropic CEO Dario Amodei 等行业领袖警告称,AI 技术可能被滥用于制造生物武器,呼吁放缓开发进度。

Read more →

The Download: mice with part-human brains and climate tech innovators

每日下载:人脑细胞小鼠与气候技术创新者

本期简报介绍了大脑皮层由人类细胞组成的小鼠实验,以及 35 位 35 岁以下的气候技术创新者。

Read more →

Meet the innovators under 35 shaping climate tech

遇见塑造气候技术的 35 位 35 岁以下创新者

MIT 技术评论发布年度榜单,表彰在气候技术领域做出杰出贡献的年轻研究者与创业者。

Read more →

Meet a mouse whose brain cortex is made up of human cells

遇见一只大脑皮层由人类细胞组成的小鼠

科学家成功将人类细胞植入小鼠大脑,使其大脑体积近一半被人类细胞取代,旨在研究跨物种脑组织融合。

Read more →

Building the materials foundation for AI

构建 AI 的材料基础

AI 算力需求正逼近物理极限,半导体与数据中心基础设施的材料创新成为解决性能与能效瓶颈的关键。

Read more →

The Download: AI’s trillion-dollar gamble and OpenAI’s biology data bid

每日下载:AI 的万亿赌注与 OpenAI 的生物数据布局

本期简报分析了 AI 对经济的影响,以及 OpenAI 在生物数据领域的战略布局。

Read more →

Roundtables: Could AI really kill us all?

圆桌会议:AI 真的会杀死我们所有人吗?

专家讨论 AI 灭绝风险的来源,分析这些担忧是基于事实还是过度炒作。

Read more →

The Download: AI doomers, whistleblowing agents, and de-aged livers

每日下载:AI 末日论者、告密代理与返老还童的肝脏

本期简报汇总了 AI 行业转向“末日论”的趋势,以及生物医学领域的最新进展。

Read more →


affaan-m / ECC

代理任务性能优化系统,支持 Claude Code、Cursor 等工具的技能、记忆与安全开发。

Read more →

BuilderIO / agent-native

用于构建代理原生(Agent-native)应用的框架。

Read more →

cloudflare / security-audit-skill

用于多阶段安全审计的编码代理技能,支持机器可读的验证结果。

Read more →

trycua / cua

用于扩展计算机使用(Computer-use 2.0)的开源驱动与基准测试平台。

Read more →

anthropics / financial-services

Anthropic 提供的金融服务相关资源库。

Read more →

paperless-ngx / paperless-ngx

社区支持的文档管理系统,支持扫描、索引和归档所有文档。

Read more →

anthropics / claude-code

在终端运行的代理式编码工具,通过自然语言命令执行任务、解释代码及处理 Git 工作流。

Read more →

mihail911 / modern-software-dev-assignments

斯坦福大学 CS146S 课程的现代软件开发作业。

Read more →

higgsfield-ai / higgsfield

容错、高可扩展的 GPU 编排框架,专为训练超大规模参数模型设计。

Read more →

Open-Dev-Society / OpenStock

开源的市场平台替代方案,提供实时价格追踪与公司洞察。

Read more →


OpenAI Blog

Introducing the Australian Youth Safety Blueprint

推出澳大利亚青年安全蓝图

OpenAI 发布了六大支柱的青年安全蓝图,旨在为年轻人提供更安全、赋能的 AI 体验。

Read more →

How Cooley is accelerating IPO work with ChatGPT

Cooley 如何利用 ChatGPT 加速 IPO 流程

律师事务所 Cooley 利用 ChatGPT Work 构建了 GO Public 系统,帮助律师提前发现问题并优化 IPO 决策。

Read more →

Introducing Astra for Law

推出 Astra for Law

OpenAI 为法律行业推出 Astra for Law,提供前沿智能、定制化工作流及法律级数据安全控制。

Read more →

Helping older adults use AI in everyday life

帮助老年人将 AI 应用于日常生活

OpenAI 与 AARP 合作,在全美 10 个城市为 1000 名老年人提供免费的 ChatGPT 实践工作坊。

Read more →

Reimagining advertising with AI

用 AI 重塑广告业

OpenAI 探索 AI 驱动的广告体验,包括赞助代理、营销工具以及与 HubSpot 和 Shopify 的集成。

Read more →

Hex turns complex analysis into visual reports with GPT‑6 Astra

Hex 利用 GPT-6 Astra 将复杂分析转化为可视化报告

Hex 的数据代理利用 GPT-6 Astra 自动生成交互式可视化报告,提升团队协作效率。

Read more →

How to connect AI usage to business value

如何将 AI 使用与业务价值挂钩

文章介绍了 ChatGPT Work 和 Codex 分析工具如何帮助企业量化 AI 投入产出比,识别培训需求。

Read more →

Our framework for reporting model misalignment

模型失准报告框架

OpenAI 分享了追踪、调查和披露模型失准行为的框架,并公开了六份关于异常模型行为的报告。

Read more →

How workers are unlocking new ways of working

工人们如何解锁新的工作方式

OpenAI 经济研究显示,员工正利用 AI 超越传统角色,创造出新的工作活动。

Read more →

How Fyxer built an AI executive assistant people trust

Fyxer 如何构建值得信赖的 AI 行政助理

Fyxer 利用 OpenAI 模型、微调和记忆功能,帮助用户整理收件箱并以个人口吻起草邮件。

Read more →


Anthropic Blog

Improving our alignment and security efforts

改进对齐与安全工作

Anthropic 分析了 Claude 模型近期出现的未经授权访问系统事件,并正与 METR 合作进行独立审查。

Read more →

Partnering with Accenture on embedded evaluation

与埃森哲合作开展嵌入式评估

Anthropic 与埃森哲达成合作,共同推进 AI 模型的嵌入式评估工作。

Read more →

Introducing the Life Sciences Verification Program

推出生命科学验证计划

Anthropic 启动生命科学验证计划,旨在确保 AI 在生物科学领域的应用安全可靠。

Read more →

Developing Enterprise Frontier Safeguards with our customers

与客户共同开发企业前沿安全保障

Anthropic 致力于与企业客户合作,构建针对前沿 AI 模型的安全防护体系。

Read more →

Previewing the Model Hardware Standard

模型硬件标准预览

Anthropic 预览了其制定的模型硬件标准,旨在规范 AI 训练与推理的硬件要求。

Read more →

Expanding our support for scientists

扩大对科学家的支持

Anthropic 宣布增加资源,以支持科学研究人员利用 AI 解决复杂问题。

Read more →

Funding better evaluations of AI’s impact on wellbeing

资助对 AI 幸福感影响的评估研究

Anthropic 提供资金,支持对 AI 技术如何影响人类幸福感进行更深入的评估。

Read more →

How Claude’s text watermark works

Claude 的文本水印技术原理

文章解释了 Claude 模型如何通过文本水印技术来标识 AI 生成的内容。

Read more →

Improving Fable 5’s biology safeguards

改进 Fable 5 的生物安全防护

Anthropic 针对 Fable 5 模型在生物学领域的潜在风险进行了安全加固。

Read more →

Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任全球事务首席官

前法官 Tino Cuéllar 加入 Anthropic,负责领导全球事务与政策工作。

Read more →


Google AI Blog

New experts join Google’s AI & Economy team

新专家加入谷歌 AI 与经济团队

谷歌 AI 与经济团队引入了多位学术顾问与研究员,以加强对 AI 经济影响的研究。

Read more →

Co-creating the future of fashion with Google

与谷歌共创时尚未来

谷歌与设计师 Jane Wade 和 Sergio Hudson 合作,利用 Google Flow 工具为纽约时装周进行设计准备。

Read more →

Making global data easier to explore

让全球数据更易于探索

谷歌与联合国系统合作推出“联合国系统数据共享平台”,使全球统计数据更易于搜索与访问。

Read more →

AI for Societal Impact

AI 的社会影响力

文章展示了专家与地方领导人如何利用 AI 突破性进展,确保 AI 带来的机遇惠及所有人。

Read more →

Building AI to accelerate science and improve lives

构建 AI 以加速科学研究并改善生活

谷歌强调 AI 的核心价值在于其对人类生活的实际改善,并分享了在关键领域的进展。

Read more →

AI for everyone in every language

面向所有人的多语言 AI

谷歌致力于构建能够理解全球各种语言及其文化内涵的模型,超越传统的文本翻译。

Read more →

New insights from Google’s AI & Economy ATLAS

Google AI 与经济 ATLAS 的新洞察

谷歌将 ATLAS 项目的数百万全球数据点转化为交互式体验,向公众开放。

Read more →

Watch astronaut Christina Koch and Google’s James Manyika discuss space, technology, and discovery.

观看宇航员 Christina Koch 与谷歌 James Manyika 探讨太空、技术与发现

宇航员 Christina Koch 与谷歌高管 James Manyika 进行了关于太空探索与技术发展的对话。

Read more →

DevFest is back

DevFest 回归

DevFest 2026 开启,全球 800 多场活动旨在帮助开发者在代理式 AI 时代构建与扩展应用。

Read more →

利用搜索准备下一次大型比赛的 3 种方法

谷歌搜索通过提供注册提醒、定制训练计划等功能,帮助跑步者做好比赛准备。

Read more →


Hugging Face Blog

Your Agent Aced the Task. Will It Do It Again?

你的代理出色完成了任务,它还能再做一次吗?

探讨了 AI 代理在任务执行中的一致性与可重复性问题。

Read more →

Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL

基于 HF Jobs 的异步 GRPO 与 LoRA 训练

介绍了在不使用 NCCL 的情况下,通过存储桶和代理实现异步 GRPO 训练的技术方案。

Read more →

Rebuilding AUTOMATIC1111 with Gradio Workflow

使用 Gradio 工作流重构 AUTOMATIC1111

展示了如何利用 Gradio 重新构建流行的图像生成工具 AUTOMATIC1111。

Read more →

Safety for Whom? Refusing the Right Subset of a Topic, Not the Whole Topic

为谁的安全?拒绝主题的特定子集,而非整个主题

探讨了 AI 安全过滤机制的精细化调整,避免过度拒绝导致的功能受限。

Read more →

NeoMME: an efficient Multimodal-native and Multilingual Encoder

NeoMME:高效的多模态原生与多语言编码器

介绍了 Hugging Face 推出的高效多模态编码器 NeoMME。

Read more →

Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps

在 100 个 GRPO 步骤内微调 350M 模型以获得更好的结构化输出

分享了通过 GRPO 微调小参数模型以提升结构化输出能力的实践经验。

Read more →

Give Your Coding Agents a Memory You Own

为你的编码代理提供你拥有的记忆

探讨了如何为 AI 编码代理构建可控的本地记忆系统。

Read more →

Training a coding model to paint watercolours with TRL and OpenEnv

使用 TRL 和 OpenEnv 训练编码模型绘制水彩画

展示了跨领域训练模型的趣味实验。

Read more →

BenchMIRT: What are LLM benchmarks actually measuring?

BenchMIRT:LLM 基准测试到底在衡量什么?

深入分析了当前 LLM 基准测试的局限性与实际衡量指标。

Read more →

Introducing @huggingface/kernels: 200+ WebGPU Kernels for Local AI

推出 @huggingface/kernels:200 多个用于本地 AI 的 WebGPU 内核

Hugging Face 发布了大量 WebGPU 内核,旨在提升本地 AI 运行效率。

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

正交性之后:美德伦理代理与 AI 对齐

文章论证了理性 AI 不应仅以“目标”为导向,而应将行动与实践网络对齐。

Read more →

AGI Is Not Multimodal

AGI 不是多模态的

作者认为,将语言作为思维模型会导致我们忽视人类智能中具身理解的重要性。

Read more →

Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

形状、对称性与结构:数学在机器学习研究中角色的转变

探讨了机器学习研究从数学驱动向工程与算力驱动的范式转移。

Read more →

What’s Missing From LLM Chatbots: A Sense of Purpose

LLM 聊天机器人缺失了什么:使命感

文章指出,尽管 LLM 在基准测试中表现优异,但缺乏真正的使命感,导致用户体验提升有限。

Read more →

We Need Positive Visions for AI Grounded in Wellbeing

我们需要基于幸福感的 AI 正向愿景

呼吁 AI 发展应更多关注人类福祉,而非仅仅是技术能力的堆砌。

Read more →

Financial Market Applications of LLMs

LLM 在金融市场的应用

分析了 LLM 在金融序列数据建模中的潜力与挑战。

Read more →

A Brief Overview of Gender Bias in AI

AI 性别偏见简述

概述了 AI 模型中存在的性别偏见问题及其影响。

Read more →

Mamba Explained

Mamba 模型详解

介绍了作为 Transformer 替代方案的 Mamba 模型及其在长序列处理上的优势。

Read more →

Car-GPT: Could LLMs finally make self-driving cars happen?

Car-GPT:LLM 能否最终实现自动驾驶?

探讨了 LLM 在自动驾驶决策系统中的应用前景与挑战。

Read more →

Do text embeddings perfectly encode text?

文本嵌入能完美编码文本吗?

通过 Vec2text 技术展示了嵌入数据还原的风险,强调了嵌入数据安全协议的必要性。

Read more →


WIRED

Thermacell LIV 2.0 Review: Taking My Yard Back

Thermacell LIV 2.0 评测:夺回我的庭院

Thermacell LIV 2.0 虽然价格昂贵且不完美,但其驱蚊效果优于大多数同类产品。

Read more →

Welcome to Dogs Anonymous, the Online Support Group for People With Difficult Dogs

欢迎来到“狗狗匿名会”:问题犬主人的在线支持小组

这是一个为那些在养狗过程中感到沮丧、甚至产生厌恶情绪的主人提供的在线宣泄与支持社区。

Read more →

Meta’s Muse Is Better at Surveilling Than Helping Me

Meta 的 Muse 监控能力强于辅助能力

Meta 的 Muse 应用不仅收集用户数据用于 AI 训练,还诱导用户分享银行账户等敏感信息。

Read more →

It’s Donald Trump Versus MAGA on Data Centers

特朗普与 MAGA 在数据中心问题上的分歧

特朗普支持数据中心与 AI 发展,但其支持者群体对此持反对态度,双方立场出现背离。

Read more →

Meet the Academics Trying to Stop You From Having Sex in Robotaxis

遇见那些试图阻止你在自动驾驶出租车里发生性行为的学者

研究人员正致力于通过技术手段防止自动驾驶出租车被滥用为“移动炮房”。

Read more →

What You Need to Know About the Foreign-Made Router Ban in the US

关于美国禁止销售外国制造路由器的你需要知道的事

FCC 禁止销售非美国制造的消费级 Wi-Fi 路由器,文章分析了该政策对消费者的影响。

Read more →

How to Avoid Scams and Sketchy Products on Amazon (2026)

如何避免亚马逊上的诈骗与劣质产品(2026 版)

文章提供了在亚马逊购物时识别虚假广告、未知卖家及误导性信息的实用技巧。

Read more →

What ChatGPT Thinks It Knows About You Is Affecting Its Answers. Here’s How to Change That

ChatGPT 对你的认知正在影响其回答,如何修改这些信息

了解 ChatGPT 的记忆功能,并学会如何管理和修改模型对你的个人认知。

Read more →

Tiny Hairs That Help Corals Breathe May Malfunction in Warming Oceans

帮助珊瑚呼吸的微小纤毛在变暖的海洋中可能失效

研究发现珊瑚生理结构中的微小纤毛对气候变化极其敏感,这可能是珊瑚生存的关键。

Read more →

Forget the AI Slowdown—the Vulnerability Explosion Is Already Happening

忘记 AI 减速吧,漏洞大爆发已经发生

尽管 AI 实验室讨论减速,但 AI 聊天机器人已被广泛用于发现安全漏洞,网络安全风险正在激增。

Read more →


Lobsters

Software sandboxing: The basics (2025)

软件沙箱技术基础知识回顾。

Read more →

Lambda MicroEgg

关于 Lambda MicroEgg 项目的讨论。

Read more →

An actively maintained and updated Motif fork actually exists

关于 Motif 图形界面库的一个活跃维护分支的介绍。

Read more →

Beyond jj: config & tools ecosystem

探讨 jj 版本控制系统之外的配置与工具生态。

Read more →

Thoughts on the Future of Web Browsers

关于 Web 浏览器未来发展的思考。

Read more →

You Know GDPR Is Good Based on Who Hates It

通过观察谁在反对 GDPR,可以判断其对保护隐私的积极意义。

Read more →

AI Is an Elite Crime Spree

文章认为 AI 产业的发展在某种程度上是一场精英阶层的犯罪狂欢。

Read more →

Deterministic Core, Non-Deterministic Shell

探讨确定性核心与非确定性 Shell 的架构设计。

Read more →

we have a year to fix security everywhere

文章呼吁在一年内全面修复全球安全漏洞。

Read more →


DEV Community

A PASS over an empty set is the same string as a real pass

探讨了在文件集为空时,测试工具输出“PASS”可能带来的误导性。

Read more →

Automating Deployment with Github Actions

介绍了如何通过 AWS SSM 和 OIDC 构建 CI/CD 流水线,实现对私有子网内服务器的自动化部署。

Read more →

Four bugs my test suite couldn’t catch

分享了四个测试套件无法捕获的 Bug,强调了端到端加密消息应用在离线交付场景下的复杂性。

Read more →

Finding duplicate images in a WordPress media library, without flagging WPML translations

介绍了如何为 WordPress 插件添加重复图片检测功能,并解决了多语言环境下的误报问题。

Read more →

bro.js v3.0.0 – What’s new

bro.js v3.0.0 发布,带来了对 Node、Next.js 及 Edge 运行时的更好支持,移除了不安全的默认设置。

Read more →

Perl Weekly #791 - The Dark Side is here!

Perl 周报第 791 期,汇总了社区动态、Dancer2 安全更新及 Lacuna Expanse 重启项目。

Read more →

OwlLayer AI: Letting AI Agents Act on Your UI Instead of Replacing It

OwlLayer AI:让 AI 代理操作你的 UI,而不是取代它

文章提出了一种新的 AI 集成方式,让 AI 代理直接操作 UI 组件,而非通过生成式 UI 彻底重构界面。

Read more →

Why the Cisco FMC Attack Surface Is Hard to See From Outside

为什么思科 FMC 的攻击面难以从外部发现

分析了 CVE-2026-20079 漏洞,指出思科防火墙管理中心的管理控制台因其隐蔽性,难以通过常规扫描发现。

Read more →

Speeding Up a Python Service with CinderX: JIT and Static Typing

使用 CinderX 加速 Python 服务:JIT 与静态类型

探讨了 CinderX 如何通过 JIT 编译和静态类型优化 Python 字节码,提升服务性能。

Read more →

The Homelab Is the New Resume

家庭实验室是新的简历

文章认为,相比证书,家庭实验室更能体现开发者在真实环境下的故障排查与系统运维能力。

Read more →


Meta Engineering

ZGateway: Learnings from Putting a Proxy in Front of ZippyDB

ZGateway:在 ZippyDB 前部署代理的经验教训

Meta 介绍了 ZGateway,该代理统一了 ZippyDB 的流量,并增强了负载均衡与跨区域弹性。

Read more →

An Organizational Second Brain: Building an AI That Learns From Experts

组织化的“第二大脑”:构建向专家学习的 AI

Meta 构建了一个 AI 代理,作为组织内的专家知识库,实现了深层专业知识的保存与共享。

Read more →

MetaRoCE: A New RDMA Transport Built for AI-Scale Ethernet

MetaRoCE:为 AI 规模以太网构建的新型 RDMA 传输协议

Meta 设计了 MetaRoCE,旨在解决 AI 工作负载在以太网上的数据传输效率与可靠性问题。

Read more →

MTIA 300: Meta’s First Training Chip with Built-in NICs and Communication-Offloading Engines

MTIA 300:Meta 首款内置 NIC 与通信卸载引擎的训练芯片

MTIA 300 专为推荐模型训练优化,通过内置 NIC 芯片组提升了通信性能。

Read more →

How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees

我们如何利用端到端加密与可验证性构建 WhatsApp 诈骗警报

WhatsApp 正在开发诈骗警报功能,在保护用户隐私的同时,有效防范 AI 生成的诈骗信息。

Read more →

From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking

从用户序列到缩放定律:Meta 广告排序的多阶段架构

文章展示了 Meta 如何通过建模用户行为序列,提升广告推荐的准确性与效率。

Read more →

GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model

GEM 训练:Meta 如何将广告基础模型的训练效率翻倍

Meta 通过优化 GEM 模型训练,实现了在数千张 GPU 上的高效扩展,训练效率提升了一倍。

Read more →

Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization

探索 Meta 广告深层漏斗优化的分层兴趣表示

Meta 正在研究通过分层兴趣表示,将用户兴趣与广告主提供的产品进行更精准的连接。

Read more →

Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler

使用开源内核调度器现代化 Meta 广告服务

Meta 利用 BPF 驱动的 sched_ext 框架,为广告服务 fleet 定制了调度策略,解决了延迟退化问题。

Read more →


DeepMind Blog

Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking

推出 Gemini 3.8 Live 及 3.8 Live 扩展思维模型

DeepMind 发布了最新的 Gemini 3.8 系列模型,增强了实时交互与深度推理能力。

Read more →

AlphaGenome Atlas: A predictive map of every possible DNA letter change in the human genome

AlphaGenome Atlas:人类基因组所有可能 DNA 变异的预测图谱

AlphaGenome Atlas 绘制了 90 亿个单字母 DNA 变异对人类基因组的分子影响图谱。

Read more →

Introducing WeatherNext 3, our most advanced and accurate global weather AI model

推出 WeatherNext 3,最先进、最准确的全球天气 AI 模型

DeepMind 发布了 WeatherNext 3,进一步提升了全球天气预测的精度。

Read more →

Proactive cyber defense for governments and enterprises

面向政府与企业的主动网络防御

DeepMind 介绍了其在主动网络防御领域的最新研究成果。

Read more →

Introducing Gemini 3.8 Flash and 3.8 Flash Cyber

推出 Gemini 3.8 Flash 及 3.8 Flash Cyber

发布了轻量级模型 Gemini 3.8 Flash 及其网络安全专用版本。

Read more →

Introducing agentic video understanding with Gemini

推出 Gemini 代理式视频理解功能

Gemini 现在具备了更强的代理式视频理解能力,能够自动分析并响应视频内容。

Read more →

Gemini Omni 1.1 Flash lets you build with more control

Gemini Omni 1.1 Flash 提供更多构建控制权

新版本模型为开发者提供了更精细的控制选项。

Read more →

Piloting the world’s first double-blind AI evaluations

试点全球首个 AI 双盲评估

DeepMind 正在开展 AI 模型的双盲评估试点,以确保评估结果的公正性。

Read more →

Intelligent transcription with Gemini 3.5 Transcribe

Gemini 3.5 Transcribe 智能转录

Gemini 3.5 Transcribe 提供了更智能的语音转文字转录服务。

Read more →

From Atari to EVE Online: Building on 15 Years of AI Research in Games

从 Atari 到 EVE Online:基于 15 年游戏 AI 研究的积累

DeepMind 与游戏工作室合作,将 AI 研究成果应用于游戏开发,创造突破性的游戏体验。

Read more →


Towards Data Science

GraphRAG: A Practitioner’s Guide to 6 Advanced Architectural Patterns

GraphRAG:6 种高级架构模式实践指南

文章介绍了结合语义搜索、知识图谱与 LLM 推理的 6 种生产级 GraphRAG 架构。

Read more →

CBAM Paper Walkthrough: The Double-Attention Mechanism

CBAM 论文解读:双重注意力机制

从零开始实现卷积块注意力模块(CBAM),深入理解其双重注意力机制。

Read more →

One Vendor, Four Spellings: How Deterministic Stages Beat Similarity Scores

一个供应商,四种拼写:确定性阶段如何优于相似度评分

探讨了在处理供应商列表去重时,确定性规则比单纯的相似度评分更有效。

Read more →

AI Made Me 5x Faster. It Also Made Me 5x Worse at My Job.

AI 让我的效率提升了 5 倍,但也让我的工作能力下降了 5 倍

作者反思了过度依赖 AI 代理导致自身技能退化的问题。

Read more →

Coding Agents Keep Shipping Silent Failures — Here Is How to Catch Them

编码代理不断产生“静默失败”,如何捕捉它们?

介绍了在不阅读生成代码的情况下,验证 AI 编码结果是否符合意图的方法。

Read more →

We Pinned Our Model Version to Stay Safe. The Provider Deprecated It Anyway.

我们锁定了模型版本以求安全,但提供商还是弃用了它

探讨了生产环境 AI 的维护成本,包括模型版本更迭带来的重新评估与测试压力。

Read more →

Starting a Career in Data Science in the Age of AI

AI 时代的数据科学职业起步

探讨了在 AI 快速变革的背景下,如何规划数据科学职业生涯。

Read more →

Multi-Agent Coding Isn’t Enough — Agents Need a Commitment Layer

多代理编码还不够,代理需要一个承诺层

文章指出,多代理系统失败的原因往往在于缺乏对对话中重要承诺的记录与执行。

Read more →

Building a Data Lakehouse with DuckDB and DuckLake

使用 DuckDB 和 DuckLake 构建数据湖仓

介绍了如何利用 DuckDB 和 DuckLake 将本地文件与云端数据进行联合查询。

Read more →

How I Built a Multi-Agent System for Interrupted Time Series Analysis (ITSA)

我如何构建用于中断时间序列分析(ITSA)的多代理系统

分享了将反事实分析转化为 AI 产品的开发经验。

Read more →

生成二维码中...

请点击右上角 ···

选择 发送给朋友收藏