-
1
GLM-5.3编码狂飙,网络防御反超对手
Z.ai发布GLM-5.3,Terminal Bench从4.6分飙升至28.3,漏洞挖掘跑分超越Anthropic Mythos 5和GPT-5.6,但深度攻击利用能力仍落后,权重两周安全评审后开源
GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ↗4.4 -
2
苹果联手阿里为中国定制AI模型
苹果为中国市场与阿里巴巴联合训练本地化大语言模型,是跨越中美科技紧张关系的一次罕见跨境合作
Apple trained its own AI model for China with help from Alibaba ↗3.8 -
3
谷歌Gemini Flash追平前沿模型
Gemini 3.7 Flash更新缩小与Claude 4.8+、GPT 5.5+系列的差距,此前3.5/3.6 Flash版本明显落后于同期前沿模型
[AINews] Gemini 3.7 Flash brings GDM back to the forefront ↗3.2 -
4
多模态预训练:图像生成数据仅需5%
Meta/Oxford研究发现语言训练已能提升视觉理解,最优配比中图像生成数据占比仅5%,过晚引入视觉会让模型产生语言捷径依赖('vision laziness')
Towards Physics of Multimodal Pretraining: Knowledge Flow, Modality Synergy, Early Unification, and Recipes ↗3.1 -
5
Ruby4.0曝通用反序列化RCE
安全公司elttam披露Ruby 4.0通用反序列化gadget链,可导致远程代码执行,影响面覆盖广泛的Ruby应用
Ruby 4.0 Universal RCE Deserialization Gadget Chain ↗2.8 -
6
开发者热议Opus5体验变差
HN热帖52赞、50条评论,开发者讨论Claude Opus 5实际编码体验不如预期,引出模型迭代与基准测试脱节的争议
Why does Opus 5 feel worse to work with? ↗2.8 -
7
DeepSeek推出峰谷分时定价
DeepSeek更新API定价策略,推出高峰/低谷分时段计费,HN开发者社区讨论调用成本变化
DeepSeek peak/off-peak pricing update ↗2.7 -
8
AI数据中心燃气电厂污染更重
Wired调查发现得州为数据中心新建的燃气电厂采用效率更低的涡轮技术,污染排放显著高于常规燃气电厂
The Real Reason Data Center Gas Power Plants Are So Dirty ↗2.6