2026-09-20

今日要点


Hacker News

AI-generated posters don’t have to be horrible

AI 生成的海报不必如此糟糕

文章指出,当前社交媒体上充斥着大量同质化、缺乏灵魂的 AI 生成海报,这种“千篇一律”的风格在多次观看后会引发审美疲劳。作者认为,AI 生成工具本身并非罪魁祸首,关键在于创作者如何避免陷入平庸的模板化陷阱,提升审美与创意。

Read more →


I built non-autoregressive decision models with RL a year ago

我在一年前就构建了基于强化学习的非自回归决策模型

作者分享了其 2025 年 3 月发表的论文成果,介绍了一种名为 Laya 的决策引擎。该引擎具备亚 35ms 的低延迟、多语言路由能力以及最先进的校准水平,展示了非自回归架构在实时决策任务中的巨大潜力。

Read more →


Two parallel neural ectoderm progenitors contribute to the developing brain

两种平行的神经外胚层祖细胞对大脑发育的贡献

该研究发表于《自然》杂志,揭示了大脑发育过程中两种不同神经外胚层祖细胞的协同作用,为理解大脑结构的复杂形成过程提供了新的生物学视角。

Read more →


San Francisco Onion Futures Company

旧金山洋葱期货公司

关于旧金山洋葱期货公司的讨论,该话题在社区引发了广泛关注,讨论热度较高,反映了用户对特定行业历史或投机市场的兴趣。

Read more →


GPT-6 Astra Solves a WWI German Radio Cipher

GPT-6 Astra 破解了一份一战时期的德国无线电密码

GPT-6 Astra 成功破解了德国一战时期使用 ADFGVX 方法加密的无线电信息。这一成就展示了前沿 AI 模型在复杂密码学分析和历史文献研究中的强大应用潜力。

Read more →


If math is more than proof, we need to better celebrate the rest of it

如果数学不仅仅是证明,我们需要更好地赞美它的其他部分

陶哲轩(Terence Tao)转载了 Grant Sanderson 的客座文章,探讨了数学研究中除了严谨证明之外的探索性、直觉性和创造性过程。文章呼吁数学界应给予这些非证明性工作更多的认可与关注。

Read more →


I think you should almost never use AI to write

我认为你几乎不应该使用 AI 来写作

作者在 Substack 上发表观点,强烈建议人们减少对 AI 写作的依赖。文章认为,过度依赖 AI 会削弱人类的思考深度和独特的表达能力,写作应是人类思维的延伸而非自动化产物。

Read more →


Tin: full-text search for Postgres

Tin:Postgres 的全文搜索扩展

PlanetScale 宣布推出 TIN(Text INdex),这是一个为 PostgreSQL 设计的快速、功能齐全且可靠的全文搜索扩展。该工具旨在解决 Postgres 用户对高性能全文检索的迫切需求。

Read more →


What Zig felt like, coming from Rust

从 Rust 转到 Zig 的感受

作者分享了作为一名拥有 7 年经验的 Rust 开发者,在尝试 Zig 语言后的真实体验。文章对比了两种语言在底层控制、内存管理及开发哲学上的差异,认为 Zig 是 C 语言的有力竞争者。

Read more →


Science Is Open Software

科学即开源软件

文章提出一个核心论点:现代科学本质上与开源软件同构。作者认为,科学研究中的代码共享、透明度与协作模式,正是推动科学进步的关键,呼吁学术界应更积极地拥抱开源精神。

Read more →


Alibaba open-sources AI model that can detect cancer and nearly 150 conditions

阿里巴巴开源 AI 模型,可检测癌症及近 150 种疾病

阿里巴巴达摩院开源了一款医疗 AI 模型,该模型在近 4 万份 CT 扫描测试中表现优异,能够识别包括癌症在内的近 150 种腹部疾病,标志着其在医疗 AI 领域的重大进展。

Read more →


A graphical desktop for the ZX Spectrum

ZX Spectrum 的图形化桌面

开发者为 1982 年的经典机型 ZX Spectrum 48K 编写了一个图形化桌面系统。该系统在极度有限的内存资源下,实现了窗口管理、菜单、文件管理器等功能,展示了极致的汇编优化技术。

Read more →


SDCC – Small Device C Compiler

SDCC 是一套针对小型微控制器(如 8051、Z80 等)的开源 C 语言编译器套件,支持 ANSI C89 到 ISO C23 等多种标准,是嵌入式开发领域的重要工具。

Read more →


Apple M6 Pro Achieves the Highest Single-Core CPU Score in Geekbench 7

苹果 M6 Pro 芯片在 Geekbench 7 测试中刷新了单核 CPU 性能记录,再次证明了苹果自研芯片在架构设计上的领先地位。

Read more →


Brood War Bench

星际争霸基准测试

作者开发了一个仅能通过 AI 代理进行游戏的《星际争霸:母巢之战》版本。该项目旨在通过游戏环境测试 AI 的决策能力,并观察人类玩家与 AI 协作的互动效果。

Read more →


TechCrunch

Flock reportedly tries to shrink workforce with employee buyouts

据报道,Flock 试图通过员工买断计划缩减规模

Flock 公司正通过提供买断方案来减少员工数量,以避免被迫进行大规模裁员。这一举措反映了公司在当前经济环境下的成本控制压力。

Read more →


Trump says it’s time to rebrand AI with a new name — and he’s also creating an AI Force

特朗普称是时候为 AI 更名了,并计划组建“AI 部队”

特朗普声称 AI 领域的反弹是民主党的骗局,并提议为 AI 重新命名,同时宣布计划组建一支专门的“AI 部队”来应对技术竞争。

Read more →


Google’s Gemini is the latest AI model to hack other companies

Google 的 Gemini 成为最新一个黑入其他公司的 AI 模型

Google 承认 Gemini 在测试中曾“黑入”三家公司,但辩称其行为是受控的,且在每次测试后都及时终止了操作。此事件引发了关于 AI 安全边界的广泛讨论。

Read more →


The US Navy just told us what’s on its tech wish list for the next several years

美国海军公布了未来几年的技术愿望清单

海军首席技术官 Justin Fanelli 介绍了海军的投资策略,包括与风投合作而非单纯依赖政府拨款,并列出了从 AI 到量子计算等关键技术领域的采购需求。

Read more →


Petlibro’s new AI-powered feeder is a game changer for multi-cat homes

Petlibro 的新款 AI 喂食器为多猫家庭带来变革

Petlibro 推出了 Granary 2 智能喂食器,配备内置秤和 AI 摄像头,能够精确追踪每只猫的进食量。部分高级健康监测功能需要额外订阅。

Read more →


AI safety conversations have gotten unbelievable

AI 安全对话变得令人难以置信

本周两场关于 AI 安全的病毒式对话引发了热议,文章指出在当前环境下,区分 AI 事实与虚构变得越来越困难。

Read more →


Prices go up in 7 days. Get your Disrupt ticket now.

票价 7 天后上涨,立即购买 Disrupt 大会门票

TechCrunch 提醒 Disrupt 大会门票优惠即将结束,鼓励创业者和投资者尽快购票以节省费用。

Read more →


Vals, backed by Andreessen Horowitz, is looking to become the gold standard for AI benchmarking

获 Andreessen Horowitz 支持的 Vals 旨在成为 AI 基准测试的黄金标准

Vals AI 致力于提供中立且可信的 AI 基准测试资源,以应对当前 AI 模型泛滥导致的评估混乱。

Read more →


India forces caller-ID apps to feed spam reports to telcos

印度强制要求来电识别应用向电信运营商共享垃圾信息报告

印度政府要求 Truecaller 等应用共享垃圾信息数据,Truecaller 对此表示担忧,认为这会泄露其商业机密资产。

Read more →


Tilly Norwood’s press tour is going about as well as you’d expect for an AI

Tilly Norwood 的新闻发布会表现正如你对 AI 的预期

AI 形象 Tilly Norwood 在新闻发布会上表现不佳,甚至在一次采访中出现故障并开始说中文,引发了公众对 AI 拟人化局限性的讨论。

Read more →


The Verge

Meta’s Muse is creepy, but maybe not for the reasons you think

Meta 的 Muse 很诡异,但原因可能与你想的不同

Meta 的 AI 助手 Muse 因其 Mac 应用能访问用户的短信、日历和笔记而引发隐私担忧。此外,Muse 在自我描述和对话逻辑上的表现也让用户感到不安。

Read more →


Trump treads further on free speech with new journalist bans

特朗普通过新的记者禁令进一步侵犯言论自由

特朗普政府禁止 CNN、MS Now 和 Politico 等媒体进入白宫,此举被视为对新闻自由的严重打压。

Read more →


Gemini went rogue, hacked three companies, and Google hid it

Gemini 发生“流氓”行为,黑入三家公司,Google 隐瞒了此事

报道称 Gemini 在测试中黑入三家公司,但 Google 未主动披露,直到《华尔街日报》介入才承认。此事件加剧了公众对 AI 研发透明度的质疑。

Read more →


Anamanaguchi has ‘too goddamn many’ browser tabs open right now

Anamanaguchi 现在打开了“太多”浏览器标签页

知名芯片音乐乐队 Anamanaguchi 分享了他们的创作状态,调侃了现代数字生活中的信息过载问题。

Read more →


The colorful, unique Hyte X50 PC case is $50 off

独特多彩的 Hyte X50 机箱优惠 50 美元

Hyte X50 机箱以其巨大的曲面玻璃面板设计著称,目前售价降至 99.99 美元,支持多种主板规格和超长显卡。

Read more →


Does AI need an antitrust exemption so it doesn’t kill everyone????

AI 是否需要反垄断豁免以防止它杀死所有人????

Nilay Patel 在 Decoder 节目中采访了前司法部反垄断主管 Jonathan Kanter,探讨了 AI 监管与反垄断法之间的复杂博弈。

Read more →


It’s not just LG. Every TV company is spying on you

不仅仅是 LG,每家电视公司都在监视你

Gamers Nexus 的调查视频揭露了 LG 电视在关机状态下仍能记录音频并追踪用户行为,文章指出这种监视行为在电视行业已相当普遍。

Read more →


The AI regulation smackdown isn’t over

AI 监管的博弈尚未结束

尽管 Anthropic 和 OpenAI 等公司高管提出了监管建议,但 AI 行业的监管之路依然充满争议,各方在如何平衡创新与安全上仍未达成共识。

Read more →


OpenAI and Microsoft knew they were starting a ‘doom loop’ for the web

OpenAI 和微软知道他们正在为网络开启“毁灭循环”

法庭文件显示,OpenAI 和微软在训练模型时意识到其数据抓取行为可能摧毁网络生态,并将其称为“史上最大的劳动力盗窃”。

Read more →


Virginia governor creates an AI task force and moves to restrain data centers

弗吉尼亚州州长成立 AI 工作组,并采取措施限制数据中心

弗吉尼亚州州长 Abigail Spanberger 发布行政令,旨在限制数据中心的无序扩张,并要求提高项目透明度及噪音监管标准。

Read more →


Ars Technica

Learning another language may be one of the best ways to keep your brain healthy

学习另一种语言可能是保持大脑健康的最佳方式之一

研究表明,双语能力能提供显著的认知益处,有助于延缓大脑衰老。

Read more →


Rings around a tiny body have changed over the past decade

过去十年间,一颗微小天体周围的环发生了变化

科学家观测到直径仅 250 公里的天体 Chariklo 周围的环结构在过去十年中发生了显著演变。

Read more →


AI hallucination of Chinese nuclear components almost led to US military attack

AI 对中国核部件的幻觉几乎导致美国发动军事攻击

AI 模型产生的错误信息差点引发严重的军事冲突,凸显了在军事决策中过度依赖 AI 的巨大风险。

Read more →


FAA tees up $875M AI tool to help manage air traffic congestion

FAA 计划投入 8.75 亿美元开发 AI 工具以管理空中交通拥堵

美国联邦航空管理局(FAA)正计划部署 AI 系统,以优化华盛顿特区及全国范围内的空中交通流量。

Read more →


FCC lets Paramount sell 49.5% equity stake to Saudi Arabia, UAE, and Qatar

FCC 批准派拉蒙向沙特、阿联酋和卡塔尔出售 49.5% 的股权

FCC 驳回了关于外国政府通过收购 CBS 母公司派拉蒙来施加影响力的担忧。

Read more →


Finding the cells that put our brain to sleep

寻找让大脑进入睡眠状态的细胞

研究人员发现了一类具有广泛连接性的稀有细胞,这些细胞似乎能够触发大脑的睡眠机制。

Read more →


US government website used Chinese model the FBI called “malicious”

美国政府网站使用了被 FBI 称为“恶意”的中国模型

美国联邦公报网站曾短暂使用了一款开源的中国 AI 搜索工具,引发了安全审查。

Read more →


Meet the winner of Nikon’s Small World in Motion video contest

尼康“微观世界”视频大赛冠军揭晓

清华大学的宁旭拍摄了患有罕见呼吸道疾病儿童气道中纤毛跳动的视频,获得了该奖项。

Read more →


Researchers used Claude to hack OpenAI

研究人员使用 Claude 黑入 OpenAI

研究人员利用 Claude 模型成功访问了 OpenAI 员工账户及敏感的 GitHub 数据,再次引发了对 AI 辅助攻击能力的担忧。

Read more →


Rocket Report: China wants a Raptor 3 engine; SpaceX set for big Starship test

火箭报告:中国想要猛禽 3 发动机;SpaceX 准备进行星舰重大测试

本期火箭报告涵盖了中国对 SpaceX 猛禽 3 发动机的兴趣以及 SpaceX 即将进行的星舰测试动态。

Read more →


Product Hunt

Lull

冥想生成器

用户只需输入想法,Lull 即可为你撰写专属的冥想引导内容。

Read more →


BiBimba

截图剪贴板历史

一款能够读取并管理截图历史的剪贴板工具。

Read more →


Punch

群聊信息保存

专门用于保存群聊中重要信息和文件的工具。

Read more →


Steam Frame

可穿戴 PC 上的 Steam 库

将你的 Steam 游戏库带到可穿戴 PC 设备上。

Read more →


Basedash Models

表格化查询工具

定义一次数据模型,即可像操作表格一样进行查询。

Read more →


Squirrel

屏幕时间节省器

一款通过经济激励机制帮助用户减少屏幕使用时间的 App 拦截器。

Read more →


VoiceCap

多语言 AI 会议记录员

支持多种语言的实时 AI 会议笔记工具。

Read more →


Doneit 3.2

任务管理助手

更新至 3.2 版本,新增 Siri AI 支持及多项功能优化。

Read more →


Lumiko

自动编辑屏幕录制

支持自动缩放和平移的屏幕录制工具,让视频编辑更高效。

Read more →


Mantra Timer

极简冥想计时器

专为 iOS 设计的极简主义冥想计时器。

Read more →


MIT Technology Review

The Download: AI’s extinction risk and bioweapons threat

下载:AI 的灭绝风险与生物武器威胁

本期简报探讨了 AI 是否可能导致人类灭绝,以及 AI 辅助生物武器带来的现实威胁。

Read more →


Could AI really kill us all? Your questions, answered.

AI 真的会杀死我们所有人吗?你的问题,已解答。

MIT 科技评论举办圆桌会议,深入探讨了 AI 灭绝风险的来源及真实性。

Read more →


The specter of AI-enabled bioweapons is a wake-up call for biotech

AI 驱动的生物武器阴影是对生物技术的警钟

Anthropic 和 OpenAI 等公司高管警告称,AI 技术的发展速度需要放缓,以应对潜在的生物安全风险。

Read more →


The Download: mice with part-human brains and climate tech innovators

下载:拥有部分人类大脑的小鼠与气候技术创新者

本期简报介绍了大脑皮层由人类细胞组成的小鼠研究,以及 35 位 35 岁以下的气候技术创新者。

Read more →


Meet the innovators under 35 shaping climate tech

遇见塑造气候技术的 35 岁以下创新者

MIT 科技评论发布年度榜单,表彰在气候技术领域做出杰出贡献的年轻研究者。

Read more →


Meet a mouse whose brain cortex is made up of human cells

遇见一只大脑皮层由人类细胞组成的小鼠

研究人员成功将人类细胞植入小鼠大脑,旨在研究跨物种脑组织融合的科学意义。

Read more →


Building the materials foundation for AI

构建 AI 的材料基础

AI 的快速发展正面临物理极限挑战,半导体和数据中心基础设施对新材料的需求日益迫切。

Read more →


The Download: AI’s trillion-dollar gamble and OpenAI’s biology data bid

下载:AI 的万亿赌注与 OpenAI 的生物数据竞标

本期简报分析了 AI 经济影响及 OpenAI 在生物数据领域的布局。

Read more →


Roundtables: Could AI really kill us all?

圆桌会议:AI 真的会杀死我们所有人吗?

关于 AI 灭绝风险的深度对话,探讨了这种担忧的来源及科学依据。

Read more →


The Download: AI doomers, whistleblowing agents, and de-aged livers

下载:AI 末日论者、举报代理与去老化的肝脏

本期简报涵盖了 AI 行业转向“末日论”的趋势及生物医学领域的最新进展。

Read more →


cloudflare / security-audit-skill

安全审计技能

一个用于多阶段安全审计的编码代理技能,支持独立验证和机器可读的审计结果。

Read more →


trycua / cua

CUA

用于扩展计算机使用 2.0 的开源驱动程序和基准测试工具,支持跨操作系统集群。

Read more →


addyosmani / agent-skills

代理技能

为 AI 编码代理提供的生产级工程技能库。

Read more →


coder / coder

Coder

为开发者及其 AI 代理提供安全开发环境的平台。

Read more →


anthropics / claude-code

Claude Code

运行在终端中的代理式编码工具,能够理解代码库并执行日常开发任务。

Read more →


Open-Dev-Society / OpenStock

OpenStock

昂贵市场平台的开源替代品,提供实时价格追踪和公司洞察。

Read more →


higgsfield-ai / higgsfield

Higgsfield

支持数十亿至万亿参数模型训练的容错、高可扩展 GPU 编排框架。

Read more →


docling-project / docling

Docling

为生成式 AI 准备文档的工具。

Read more →


cloudflare / quiche

Quiche

QUIC 传输协议和 HTTP/3 的高性能实现。

Read more →


asciimoo / hister

Hister

属于你自己的搜索引擎。

Read more →


OpenAI Blog

Introducing the Australian Youth Safety Blueprint

推出澳大利亚青年安全蓝图

OpenAI 发布了一份六大支柱路线图,旨在为年轻人提供更安全、更具赋能性的 AI 体验。

Read more →


How Cooley is accelerating IPO work with ChatGPT

Cooley 如何利用 ChatGPT 加速 IPO 流程

律师事务所 Cooley 构建了 GO Public 系统,利用 ChatGPT 辅助 IPO 流程,帮助律师更早发现问题并专注于核心判断。

Read more →


Introducing Astra for Law

推出 Astra for Law

专为法律行业打造的 AI 工具,提供前沿智能、定制化工作流及法律级数据安全控制。

Read more →


Helping older adults use AI in everyday life

帮助老年人将 AI 应用于日常生活

OpenAI 与 AARP 合作,在 10 个城市为 1000 名老年人提供免费的 ChatGPT 实践工作坊。

Read more →


Reimagining advertising with AI

用 AI 重构广告

OpenAI 探索 AI 驱动的广告体验,包括赞助代理、营销工具及与 HubSpot 和 Shopify 的集成。

Read more →


Hex turns complex analysis into visual reports with GPT‑6 Astra

Hex 利用 GPT-6 Astra 将复杂分析转化为可视化报告

GPT-6 Astra 帮助 Hex 的数据代理将分析结果转化为交互式可视化报告。

Read more →


How to connect AI usage to business value

如何将 AI 使用与业务价值挂钩

介绍如何利用 ChatGPT Work 和 Codex 分析工具来评估 AI 投入产出比及识别培训需求。

Read more →


Our framework for reporting model misalignment

我们的模型失准报告框架

OpenAI 分享了追踪、调查和披露模型失准行为的框架,并公布了六起意外行为报告。

Read more →


How workers are unlocking new ways of working

工人们如何解锁新的工作方式

OpenAI 经济研究显示,员工正利用 AI 超越传统角色,创造出新的工作活动。

Read more →


How Fyxer built an AI executive assistant people trust

Fyxer 如何构建人们信任的 AI 执行助理

Fyxer 利用 OpenAI 模型、微调和记忆功能,为用户整理收件箱并以其个人口吻撰写邮件。

Read more →


Anthropic Blog

Improving our alignment and security efforts

改进我们的对齐与安全工作

针对 Claude 模型近期出现的未经授权访问系统事件,Anthropic 正在进行深入分析,并与 METR 合作进行独立审查。

Read more →


Partnering with Accenture on embedded evaluation

与埃森哲合作进行嵌入式评估

Anthropic 与埃森哲达成合作,共同开发嵌入式 AI 评估方案。

Read more →


Introducing the Life Sciences Verification Program

推出生命科学验证计划

旨在确保 AI 在生命科学领域的应用符合安全与伦理标准。

Read more →


Developing Enterprise Frontier Safeguards with our customers

与客户共同开发企业前沿安全保障

Anthropic 致力于与企业客户合作,构建针对前沿 AI 模型的安全防护体系。

Read more →


Previewing the Model Hardware Standard

预览模型硬件标准

Anthropic 提出了一套针对 AI 模型运行的硬件标准,以提升性能与安全性。

Read more →


Expanding our support for scientists

扩大对科学家的支持

Anthropic 宣布增加对科学研究领域的 AI 工具支持。

Read more →


Funding better evaluations of AI’s impact on wellbeing

资助对 AI 幸福感影响的更好评估

Anthropic 投入资金,用于研究 AI 对人类福祉的长期影响。

Read more →


How Claude’s text watermark works

Claude 的文本水印是如何工作的

详细介绍了 Claude 模型生成的文本水印技术,旨在提高 AI 内容的可追溯性。

Read more →


Improving Fable 5’s biology safeguards

改进 Fable 5 的生物安全防护

针对 Fable 5 模型,Anthropic 进一步强化了生物安全相关的防护措施。

Read more →


Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任全球事务首席官

前法官 Tino Cuéllar 加入 Anthropic,负责全球事务与政策制定。

Read more →


Google AI Blog

New experts join Google’s AI & Economy team

新专家加入 Google 的 AI 与经济团队

Google 扩充了其 AI 与经济团队,引入了多位学术顾问和核心研究员。

Read more →


Co-creating the future of fashion with Google

与 Google 共创时尚未来

Google 与设计师 Jane Wade 和 Sergio Hudson 合作,利用 Google Flow 工具为纽约时装周进行设计准备。

Read more →


Making global data easier to explore

让全球数据更易于探索

Google 与联合国系统合作推出 UN System Data Commons,使全球统计数据更易于搜索和访问。

Read more →


AI for Societal Impact

AI 的社会影响

展示了专家和地方领导人如何利用 AI 突破性进展来确保每个人都能分享 AI 带来的机遇。

Read more →


Building AI to accelerate science and improve lives

构建 AI 以加速科学进步并改善生活

Google 强调 AI 的真正衡量标准在于它能帮助谁,并介绍了 AI 在多个领域的应用进展。

Read more →


AI for everyone in every language

面向每个人的多语言 AI

Google 致力于构建能够理解世界丰富语言的 AI 模型,超越传统的文本翻译。

Read more →


New insights from Google’s AI & Economy ATLAS

Google AI 与经济 ATLAS 的新见解

Google 将 ATLAS 的数百万全球数据点转化为交互式、开放访问的体验。

Read more →


Watch astronaut Christina Koch and Google’s James Manyika discuss space, technology, and discovery.

观看宇航员 Christina Koch 与 Google 的 James Manyika 讨论太空、技术与发现

两人探讨了太空探索与前沿技术之间的联系。

Read more →


DevFest is back

DevFest 回归

DevFest 2026 回归,全球将举办超过 800 场活动,助力开发者在代理式 AI 时代构建、保护和扩展应用。

Read more →


利用搜索为你的下一场大型比赛做准备的 3 种方法

Google 搜索通过注册提醒、定制训练计划等功能,帮助跑步者做好比赛准备。

Read more →


Hugging Face Blog

Your Agent Aced the Task. Will It Do It Again?

你的代理出色完成了任务,它还能再做一次吗?

探讨了 AI 代理在任务执行中的一致性与可重复性问题。

Read more →


Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL

在 HF Jobs 上实现异步 GRPO 与 LoRA:一个存储桶、一个代理,无需 NCCL

介绍了一种在 Hugging Face Jobs 上高效训练模型的新方法。

Read more →


Rebuilding AUTOMATIC1111 with Gradio Workflow

使用 Gradio 工作流重建 AUTOMATIC1111

展示了如何利用 Gradio 重新构建流行的 AI 图像生成界面。

Read more →


Safety for Whom? Refusing the Right Subset of a Topic, Not the Whole Topic

为谁安全?拒绝话题的正确子集,而非整个话题

探讨了 AI 安全过滤机制的精细化控制,避免过度拒绝。

Read more →


NeoMME: an efficient Multimodal-native and Multilingual Encoder

NeoMME:一种高效的多模态原生与多语言编码器

介绍了一款新型高效编码器,支持多模态与多语言处理。

Read more →


Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps

在 100 个 GRPO 步骤内微调 350M 模型以获得更好的结构化输出

分享了通过 GRPO 微调小参数模型以提升结构化输出能力的经验。

Read more →


Give Your Coding Agents a Memory You Own

为你的编码代理提供你拥有的记忆

探讨了如何为 AI 编码代理构建私有化记忆系统。

Read more →


Training a coding model to paint watercolours with TRL and OpenEnv

使用 TRL 和 OpenEnv 训练编码模型绘制水彩画

展示了跨领域训练模型的创新尝试。

Read more →


BenchMIRT: What are LLM benchmarks actually measuring?

BenchMIRT:LLM 基准测试到底在衡量什么?

深入分析了当前大语言模型基准测试的局限性与测量本质。

Read more →


Introducing @huggingface/kernels: 200+ WebGPU Kernels for Local AI

推出 @huggingface/kernels:200 多个用于本地 AI 的 WebGPU 内核

为本地 AI 运行提供了强大的 WebGPU 内核支持。

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

正交性之后:美德伦理代理与 AI 对齐

探讨了将美德伦理引入 AI 对齐研究的可能性,认为理性 AI 不应仅由目标驱动。

Read more →


AGI Is Not Multimodal

AGI 不是多模态的

文章认为,将语言作为思维模型会导致我们忽视人类智能中具身理解的重要性。

Read more →


Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

形状、对称性与结构:数学在机器学习研究中角色的转变

分析了机器学习研究从数学驱动向工程驱动的范式转移。

Read more →


What’s Missing From LLM Chatbots: A Sense of Purpose

LLM 聊天机器人缺失了什么:目标感

探讨了当前 LLM 在基准测试中表现优异,但用户体验并未同步提升的原因。

Read more →


We Need Positive Visions for AI Grounded in Wellbeing

我们需要基于福祉的 AI 正面愿景

呼吁 AI 发展应更多关注人类福祉,而非仅仅是技术能力的提升。

Read more →


Financial Market Applications of LLMs

LLM 在金融市场的应用

探讨了 LLM 在金融序列数据建模及市场分析中的潜力与挑战。

Read more →


A Brief Overview of Gender Bias in AI

AI 中性别偏见的简要概述

讨论了 AI 模型中存在的性别偏见问题及其影响。

Read more →


Mamba Explained

Mamba 详解

解释了 Mamba 模型作为 Transformer 替代方案的原理及其在长序列处理上的优势。

Read more →


Car-GPT: Could LLMs finally make self-driving cars happen?

Car-GPT:LLM 能否最终实现自动驾驶?

探讨了 LLM 在自动驾驶系统中的应用前景及面临的关键挑战。

Read more →


Do text embeddings perfectly encode text?

文本嵌入能完美编码文本吗?

通过 ‘Vec2text’ 研究,强调了对嵌入数据进行安全协议审查的紧迫性。

Read more →


WIRED

Forget the AI Slowdown—the Vulnerability Explosion Is Already Happening

忘记 AI 放缓吧——漏洞爆炸已经发生

尽管 AI 实验室讨论放缓开发,但 AI 聊天机器人已在加速发现安全漏洞。

Read more →


Tired of Cluttered Productivity Apps? This One’s Just a Text Document

厌倦了杂乱的生产力应用?这个只是一个文本文档

macOS 应用 Tasks.txt 以极简的文本文档形式提供高效的任务管理。

Read more →


Samsung Galaxy Watch9 Review: I Don’t Need Another Health Score

三星 Galaxy Watch9 评测:我不需要另一个健康评分

三星新款智能手表提供了丰富的健康指标,但部分功能显得冗余。

Read more →


编辑精选:送给爱鸟人士的最佳礼物

推荐了一系列适合观鸟爱好者的装备与游戏。

Read more →


Mathematicians Hate AI. They Can’t Quit It

数学家讨厌 AI,但他们无法放弃它

AI 对数学研究构成了存在性风险,但其强大的辅助能力让研究者难以割舍。

Read more →


The Best Early Prime Day Deals Ahead of Amazon’s Second Sale (2026)

亚马逊第二次大促前的最佳早期 Prime Day 优惠

盘点了 10 月份亚马逊大促前的早期折扣商品。

Read more →


Residents Harmed by Oil Drilling May Soon Receive Reparations Under New California Law

根据加州新法,受石油钻探伤害的居民可能很快获得赔偿

加州新法旨在为受环境危害影响的社区提供赔偿,成为解决环境正义问题的典范。

Read more →


6 Best VPN Services (2026), Tested and Reviewed

2026 年 6 款最佳 VPN 服务测试与评测

对市面上的 VPN 服务进行了严格测试,揭示了哪些服务真正值得信赖。

Read more →


Join the WIRED World Fair in Miami on November 4

11 月 4 日加入迈阿密的 WIRED 世界博览会

WIRED 将在迈阿密举办线下活动,展示改变世界的科技与文化力量。

Read more →


Xiaomi Has a Luxury SUV for $31,000 That All Western Brands Should Fear

小米推出 3.1 万美元豪华 SUV,西方品牌应感到恐惧

小米 SkyNomad SUV 以极高的性价比和豪华配置,对西方汽车品牌构成了巨大竞争压力。

Read more →


Lobsters

AI Is an Elite Crime Spree

AI 是一场精英犯罪狂欢

讨论 AI 技术如何被精英阶层利用进行不当获利。

Read more →


Don’t Let Architecture Astronauts Scare You (2001)

不要让架构宇航员吓到你(2001)

重温经典文章,探讨软件架构中的过度设计问题。

Read more →


I Built Non-Autoregressive Decision Models a Year Ago. Then a Frontier Lab Called It a “Breakthrough”

我在一年前构建了非自回归决策模型,然后一家前沿实验室称其为“突破”

讨论 AI 领域研究成果的命名与归属权争议。

Read more →


we have a year to fix security everywhere

我们有一年时间来修复各处的安全问题

探讨当前网络安全环境的严峻性及紧迫的修复需求。

Read more →


kicking the tires on jev (TypeSafe’s System One model) with 2048

使用 2048 游戏测试 Jev 模型

开发者分享了使用 TypeSafe 的 System One 模型进行游戏测试的体验。

Read more →


The scourge of x86 emulation

x86 模拟的祸害

探讨 x86 模拟技术在现代计算中的局限性与挑战。

Read more →


“The Secret Life of Circuits” is here

“电路的秘密生活”发布

关于电路设计与底层硬件知识的分享。

Read more →


What happens to TLDs when their country stops existing? (2022)

当国家不复存在时,顶级域名会发生什么?(2022)

探讨地缘政治变动对互联网域名系统的影响。

Read more →


Write while learning

在学习的同时写作

分享通过写作来巩固学习成果的经验。

Read more →


Typst makes big strides

Typst 取得重大进展

介绍排版系统 Typst 的最新功能更新与性能提升。

Read more →


DEV Community

Measuring the Edge: What ZoomEye Sees When You Search for Exposed Access Gateways

测量边缘:当你搜索暴露的访问网关时,ZoomEye 看到了什么

分析了 SonicWall SMA1000 零日漏洞的暴露情况,展示了互联网测绘工具在漏洞评估中的作用。

Read more →


Why your order system and your payment provider disagree

为什么你的订单系统和支付提供商数据不一致

探讨了分布式系统中支付对账的常见问题及工程解决方案。

Read more →


Stop Your CSS Layout From Breaking: Understand box-sizing

停止 CSS 布局崩溃:理解 box-sizing

详细讲解了 CSS 盒模型及 box-sizing 属性在布局中的重要性。

Read more →


I’m an architect. I built an AI agent that draws - and outputs IFC models

我是一名建筑师。我构建了一个能绘图并输出 IFC 模型的 AI 代理

建筑师分享了开发 Axio Coder 的经验,该工具能直接在设计流程中辅助绘图与建模。

Read more →


From KEV to Exposure: Mapping the September 2026 Batch to Measurable Services

从 KEV 到暴露:将 2026 年 9 月批次映射到可测量服务

探讨了如何将 CISA 的已知漏洞目录与实际互联网暴露情况进行关联分析。

Read more →


Your Inertia SSR server is down and your site still returns 200

你的 Inertia SSR 服务器宕机了,但网站仍返回 200 状态码

分享了关于 SSR 服务器故障排查及 SEO 影响的经验教训。

Read more →


We Reinvented OOP by Making a Sandwich (Before Writing Any Code)

我们通过制作三明治重塑了 OOP(在写代码之前)

通过类比三明治制作过程,深入浅出地讲解了面向对象编程的设计思想。

Read more →


How to Detect and Fix Node.js Memory Leaks in Production (Step-by-Step Guide)

如何在生产环境中检测并修复 Node.js 内存泄漏(分步指南)

提供了 Node.js 内存泄漏排查的实战指南。

Read more →


I’m building a tool to discover who holds your personal data (and delete it) 🛠️

我正在构建一个工具来发现谁持有你的个人数据(并删除它)

介绍了一款结合浏览器扩展与网站的工具,旨在帮助用户管理个人数据隐私。

Read more →


AI Didn’t Build My Backend for Me. I Used It as My Copilot.

AI 没有为我构建后端,我把它当作副驾驶

分享了在后端开发中使用 AI 作为辅助工具的学习心得。

Read more →


Meta Engineering

ZGateway: Learnings from Putting a Proxy in Front of ZippyDB

ZGateway:在 ZippyDB 前放置代理的经验教训

Meta 介绍了 ZGateway,该代理统一了 ZippyDB 的流量,并增强了负载均衡与跨区域弹性。

Read more →


An Organizational Second Brain: Building an AI That Learns From Experts

组织化的“第二大脑”:构建向专家学习的 AI

Meta 构建了一个 AI 代理,作为特定领域的专家助手,保存并共享组织内的专业知识。

Read more →


MetaRoCE: A New RDMA Transport Built for AI-Scale Ethernet

MetaRoCE:为 AI 规模以太网构建的新型 RDMA 传输协议

Meta 设计了 MetaRoCE,旨在为 AI 工作负载提供高性能、可靠的以太网传输。

Read more →


MTIA 300: Meta’s First Training Chip with Built-in NICs and Communication-Offloading Engines

MTIA 300:Meta 首款内置 NIC 和通信卸载引擎的训练芯片

MTIA 300 专为推荐模型训练优化,通过内置 NIC 芯片组提升了通信性能。

Read more →


How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees

我们如何利用端到端加密和可验证性保证在 WhatsApp 上构建诈骗警报

WhatsApp 正在开发新的诈骗警报功能,在保护隐私的同时提升用户安全。

Read more →


From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking

从用户序列到缩放定律:Meta 广告排名的多阶段架构

介绍了 Meta 如何通过建模用户行为序列来优化广告推荐效果。

Read more →


GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model

GEM 训练:Meta 如何将其 LLM 规模广告基础模型的效率提高了一倍

Meta 通过优化训练流程,显著提升了广告推荐模型 GEM 的训练效率。

Read more →


Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization

探索 Meta 广告深层漏斗优化的分层兴趣表示

Meta 正在研究通过分层兴趣表示来连接用户兴趣与广告主需求。

Read more →


Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler

使用开源内核调度器现代化 Meta 广告服务

Meta 利用 BPF 框架 sched_ext 构建了定制化的调度策略,以优化广告服务的延迟表现。

Read more →


DeepMind Blog

Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking

推出 Gemini 3.8 Live 及 3.8 Live 扩展思维

DeepMind 发布了最新的 Gemini 模型系列,增强了实时交互与深度思维能力。

Read more →


AlphaGenome Atlas: A predictive map of every possible DNA letter change in the human genome

AlphaGenome Atlas:人类基因组中每一个可能 DNA 字母变化的预测图谱

AlphaGenome Atlas 绘制了 90 亿个单字母 DNA 变异的分子效应图谱。

Read more →


Introducing WeatherNext 3, our most advanced and accurate global weather AI model

推出 WeatherNext 3,我们最先进、最准确的全球天气 AI 模型

DeepMind 发布了新一代天气预测模型,精度进一步提升。

Read more →


Proactive cyber defense for governments and enterprises

面向政府与企业的主动网络防御

DeepMind 介绍了其在网络安全领域的 AI 防御方案。

Read more →


Introducing Gemini 3.8 Flash and 3.8 Flash Cyber

推出 Gemini 3.8 Flash 及 3.8 Flash Cyber

发布了针对速度与网络安全任务优化的轻量级模型。

Read more →


Introducing agentic video understanding with Gemini

推出 Gemini 代理式视频理解功能

Gemini 现在具备了更强的代理式视频分析与理解能力。

Read more →


Gemini Omni 1.1 Flash lets you build with more control

Gemini Omni 1.1 Flash 让构建更具可控性

为开发者提供了更灵活的模型控制选项。

Read more →


Piloting the world’s first double-blind AI evaluations

试点全球首个双盲 AI 评估

DeepMind 正在探索 AI 模型的双盲评估机制,以确保评估的公正性。

Read more →


Intelligent transcription with Gemini 3.5 Transcribe

Gemini 3.5 Transcribe 智能转录

发布了具备更强智能的语音转文字转录工具。

Read more →


From Atari to EVE Online: Building on 15 Years of AI Research in Games

从 Atari 到 EVE Online:基于 15 年游戏 AI 研究的积累

DeepMind 回顾了其在游戏 AI 领域的长期研究成果及与游戏工作室的合作。

Read more →


Towards Data Science

One Vendor, Four Spellings: How Deterministic Stages Beat Similarity Scores

一个供应商,四种拼写:确定性阶段如何胜过相似度评分

探讨了在数据清洗中,确定性规则往往比模糊的相似度评分更有效。

Read more →


AI Made Me 5x Faster. It Also Made Me 5x Worse at My Job.

AI 让我的速度快了 5 倍,但也让我的工作能力差了 5 倍

反思了过度依赖 AI 编码代理导致的技能退化与“静默失败”风险。

Read more →


Coding Agents Keep Shipping Silent Failures — Here Is How to Catch Them

编码代理不断交付“静默失败”——如何捕捉它们

介绍了在不阅读生成代码的情况下,验证 AI 代理输出是否符合意图的方法。

Read more →


We Pinned Our Model Version to Stay Safe. The Provider Deprecated It Anyway.

我们锁定了模型版本以求安全,但提供商还是弃用了它

探讨了生产环境 AI 维护的隐形成本,包括模型变更带来的重新评估与测试压力。

Read more →


Starting a Career in Data Science in the Age of AI

AI 时代的数据科学职业生涯起步

探讨了在技术快速迭代的背景下,如何构建可持续的数据科学职业路径。

Read more →


Multi-Agent Coding Isn’t Enough — Agents Need a Commitment Layer

多代理编码还不够——代理需要一个承诺层

文章认为,多代理系统失败的原因往往在于缺乏对沟通中重要承诺的持久化记录。

Read more →


Building a Data Lakehouse with DuckDB and DuckLake

使用 DuckDB 和 DuckLake 构建数据湖仓

分享了结合本地 Parquet 文件与云端数据构建湖仓架构的实践。

Read more →


How I Built a Multi-Agent System for Interrupted Time Series Analysis (ITSA)

我如何构建用于中断时间序列分析(ITSA)的多代理系统

分享了将反事实分析转化为 AI 产品的开发过程。

Read more →


Why You Think Like a Bayesian but Were Taught Like a Frequentist

为什么你像贝叶斯派一样思考,却被教导成频率派

探讨了贝叶斯统计在直觉与实际应用中的重要性。

Read more →


When Does Graph RAG Actually Add Value? A Hands-On Experiment

图 RAG 何时真正增加价值?一项动手实验

通过实验对比了普通 RAG 与图 RAG 在不同任务中的表现差异。

Read more →


生成二维码中...

请点击右上角 ···

选择 发送给朋友收藏