写点什么
亚马逊云科技在 Aurora DSQL 中引入外键约束
亚马逊云科技在 Aurora DSQL 中引入外键约束

长期以来因高效而备受推崇的项目管理工具 Linear,已完成将其 React 应用程序从 styled-components 迁移至 Meta 原子化 CSS-in-JS 库 StyleX。

Linear 通过 1000 多次 PR 从 styled-components 迁移到 Meta 的 StyleX
Linear 通过 1000 多次 PR 从 styled-components 迁移到 Meta 的 StyleX

长期以来因高效而备受推崇的项目管理工具 Linear,已完成将其 React 应用程序从 styled-components 迁移至 Meta 原子化 CSS-in-JS 库 StyleX。

单次RL后训练烧掉260万美元、每步37亿Token,小米披露MiMo-V2.6“规模化强化学习”路线
单次RL后训练烧掉260万美元、每步37亿Token,小米披露MiMo-V2.6“规模化强化学习”路线

Pro 的 RL 后训练成本约 260 万美元,Flash 约 90 万美元

模型开放之后,AI能力为什么仍难以复用?
模型开放之后,AI能力为什么仍难以复用?

AI 开源的价值,正在从“开放了什么”,进一步转向“开放的能力能否被验证、复用和持续迭代”。

Java 近期新闻:TornadoVM 7.0、Groovy 6.0、GraalVM、Hibernate、Quarkus、Gradle、Maven
Java 近期新闻:TornadoVM 7.0、Groovy 6.0、GraalVM、Hibernate、Quarkus、Gradle、Maven

本文为 Java 近期新闻,内容涉及:TornadoVM 7.0、Groovy 6.0、GraalVM、Hibernate、Quarkus、Gradle、Maven。

GKE Pod 快照可缩短模型加载时间
GKE Pod 快照可缩短模型加载时间

谷歌发布 GKE Pod 快照的基准测试结果。根据报告,启动延迟最高可以降低 89%:一个 700 亿参数的模型仅需 37 秒即可加载完毕,而一个 80 亿参数的模型仅需 15 秒。

Rails 之父 DHH 狂吹 Rust 快 150 倍,被开发者翻代码后群嘲
Rails 之父 DHH 狂吹 Rust 快 150 倍,被开发者翻代码后群嘲

过去:Rust 是“过去 40 年里发明的最丑陋的编程语言”;现在:Rust 真香!

CLAUDE.md 还是 AGENTS.md?Anthropic 的答案是:以后都不用
CLAUDE.md 还是 AGENTS.md?Anthropic 的答案是:以后都不用

CLAUDE.md 该删了,harness 也迟早过时:Anthropic 工程师拆解 Claude Code 的下一步

OpenAI 只用 15 天,就杀死了估值 100 亿美元的 Jev?
OpenAI 只用 15 天,就杀死了估值 100 亿美元的 Jev?

“如果模型质量真的很重要,那么我们将在很长一段时间里处于非常有利的位置。”

金融监管领域的 Harness 实践:让知识与数据驱动 Agent 稳定运行
金融监管领域的 Harness 实践:让知识与数据驱动 Agent 稳定运行

让大模型在零容错场景下“照章办事”。

10 秒视频很惊艳,为什么 AI 做一部短剧还是这么难?
10 秒视频很惊艳,为什么 AI 做一部短剧还是这么难?

“能生成”解决的是能力问题,“能生产”解决的是稳定交付问题。

Pallas 内核怎么调优?Google 给出的答案是“少信模型,多看寄存器”
Pallas 内核怎么调优?Google 给出的答案是“少信模型,多看寄存器”

Google 为 XProf 添加周期级内核性能分析功能。

从 Coding 到 Running:AI Native SRE Agent 的工程实践
从 Coding 到 Running:AI Native SRE Agent 的工程实践

「写得更快」越来越不是问题,「跑得更稳」却依然主要靠人。

企业AI 走向生产环境,如何避免新一轮技术锁定
企业AI 走向生产环境,如何避免新一轮技术锁定

如果未来需要更换模型、芯片或平台,现有架构能否支持迁移?

黄仁勋为微软站台:没有 Windows 就不会有英伟达,Satya 当场“讨市值”
黄仁勋为微软站台:没有 Windows 就不会有英伟达,Satya 当场“讨市值”

“Windows 已经陪了我 34 年,看起来它还会再陪我 34 年。”

Codex 和 Claude Code 都跑偏了,前 OpenAI 研究员称 Jev 出现前 AI 世界是个悲剧
Codex 和 Claude Code 都跑偏了,前 OpenAI 研究员称 Jev 出现前 AI 世界是个悲剧

“下一个时代并不是 Claude Code 时代。”

OpenAI 高管亲述:我们是怎么在一周内做出 Jev 竞品的
OpenAI 高管亲述:我们是怎么在一周内做出 Jev 竞品的

计算机操作现在究竟能做到哪一步,支撑智能体完成任务的能力又发生了什么变化?

@ 一下就能派活?谷歌推出办公 Agent,拥有独立账号、能够创建子 Agent,还能调用 Claude
@ 一下就能派活?谷歌推出办公 Agent,拥有独立账号、能够创建子 Agent,还能调用 Claude

谷歌推出 Gemini agent 化身“数字同事”,能写文档,做表格,还能组织会议

Modal 破解 Kubernetes 限制,在几秒内扩展 100 万个并发沙箱
Modal 破解 Kubernetes 限制,在几秒内扩展 100 万个并发沙箱

在最近的一篇文章中,Modal 工程师 Colin Weld 和 Connor Adams 介绍了他们如何从头重建沙箱基础设施,以支持数百万个并发沙箱以及每秒数万次沙箱创建。

乱序 HTML 流技术从 JavaScript 框架转移到浏览器中
乱序 HTML 流技术从 JavaScript 框架转移到浏览器中

乱序 HTML 流是一种允许用户在页面完全加载之前即可查看并与之交互的模式。该模式正逐渐被引入 Web 浏览器。

全球最大独立 AI 原生影视公司,开始打破工具与制片厂的边界
全球最大独立 AI 原生影视公司,开始打破工具与制片厂的边界

AI 与其说是一种新的内容类型,不如说是一种新的制作能力。

Cloudflare 通过测量源站 TLS 偏好将握手重试率从 52% 降至 3.7%
Cloudflare 通过测量源站 TLS 偏好将握手重试率从 52% 降至 3.7%

Cloudflare 将其源站 TLS 握手过程中的静态假设替换为针对每个源站的实际测量值,从而将扫描到的源站中的 HelloRetryRequests 比例从约 52% 降至 3.7%,并将 p90 握手延迟缩短了 150 多毫秒。

从 Demo 到生产:AI Agent 缺的到底是什么?
从 Demo 到生产:AI Agent 缺的到底是什么?

AI Agent 自己搭还是用托管?用同一个案例看清差别。

全球扩散语言模型最大融资诞生:经纬、顺为、君联数亿元押注扩散智能DiffuSpace
全球扩散语言模型最大融资诞生:经纬、顺为、君联数亿元押注扩散智能DiffuSpace

扩散语言模型公司「DiffuSpace」完成数亿人民币融资

在生产环境中保护MCP:超越网关的纵深防御
在生产环境中保护MCP:超越网关的纵深防御

本文提出了一种用于在生产环境中保护模型上下文协议(Model Context Protocol,MCP)部署的纵深防御方法。文章概述了四个架构控制层,分别是安全执行、管理基础设施、出站信任与语义完整性,文章主张生产安全性需要在最早的可信控制点而不是仅在网关处进行强制检查。

谷歌借助 AI 与差分模糊测试将 C 语言依赖库改写为 Rust
谷歌借助 AI 与差分模糊测试将 C 语言依赖库改写为 Rust

谷歌安全团队推出一种方案,用 Rust 语言替换 giflib 图像处理库中的传统 C 语言代码,旨在解决原生存在的内存漏洞。