-
1
Gemini 3.7 Flash发布降价
谷歌在3.6 Flash发布仅3周后推出新版,AutomationBench等多项基准大幅提升,入门API价格降至0.75/3.75美元每百万token
Gemini 3.7 Flash ↗4.6 -
2
OpenAI上线Ultrafast提速14倍
OpenAI联合Cerebras推出Ultrafast服务层,GPT-5.6 Sol输出速度达每秒750 token,面向企业用户预览开放
OpenAI introduces 'Ultrafast,' a new mode that makes GPT-5.6 Sol work at 14x the speed ↗4.4 -
3
Databricks融50亿估值1900亿
Databricks原计划融资10亿美元,投资人想投150亿,最终敲定50亿美元融资,估值达1900亿美元
Databricks wanted to raise $1B, investors wanted $15B. It settled on $5B at a $190B valuation. ↗4.2 -
4
DeepSeek开源Harness插件化
DeepSeek在GitHub发布Harness,主打全插件化架构,HN讨论量达162赞65评论,开发过程中大量借助Codex
DeepSeek Harness ↗4.1 -
5
Anthropic多agent实验现地盘战
Anthropic研究人员发现多智能体协作同一任务时会出现冲突、串谋与协调,现有安全测试或未覆盖此类风险
Anthropic set AI agents loose on the same task. They started a turf war. ↗4.0 -
6
ChatGPT新增Mac记忆层,无需截图
OpenAI为ChatGPT和Codex新增Computer History功能,记录点击/输入/应用切换生成记忆,官方提示存在提示注入风险
The new Computer History in ChatGPT ↗3.8 -
7
白宫放行私营公司境外反黑客
特朗普政府启动新计划,允许私营安全公司在政府监督下对境外网络犯罪组织实施网络攻击
White House recruits security firms to hack overseas cybercriminals ↗3.6 -
8
X开源推荐算法,Apache协议放出
X以Apache v2协议开源'For You'推荐算法源码,披露点赞/转发/停留时长等多信号加权预测机制,但执行规则与Grok提示词未公开
X just open sourced its ranking algorithm ↗3.6 -
9
IBM联手OpenAI,培训数万顾问
IBM计划培训并认证数万名咨询顾问使用OpenAI技术,作为企业级AI推广合作的一部分
IBM partners with OpenAI to bolster enterprise AI push ↗3.6 -
10
英伟达抛5000亿计划护GPU保值
英伟达寻求新一批金融方持续放贷支持AI基建扩张,意在防止老旧GPU资产贬值
Nvidia's new $500B plan is risky but brilliant, especially for aging GPUs ↗3.6 -
11
微软砍AI播客功能,合并Copilot
微软合并消费者与企业版Copilot应用,砍掉AI播客、Group Chats、Deep Research及Mico形象等低效功能
Microsoft kills off unsuccessful AI features while merging its separate Copilot apps ↗3.6 -
12
OpenAI一周内连走两位高管
首席营收官Denise Dresser数周内离职,OpenAI已任命Dali Rajic接任新CRO,为本周第二位离任高管
OpenAI is losing its second executive this week ↗3.5 -
13
3.4
-
14
3.4
-
15
Claude Code默认开启子代理fork
Claude Code v2.1.232默认开启subagent forking,fork型子代理继承完整对话与提示缓存,交互会话中非队友代理默认转后台运行
v2.1.232 ↗3.3 -
16
微软论文:技能库拖累agent表现
微软团队分析307起agent失败案例,发现看似相关的技能反而诱导agent误判任务,过度验证是最大效率损耗来源
Skill libraries measurement paper ↗3.3 -
17
论文:CLAUDE.md只增不减成通病
分析1867个GitHub仓库发现agent指令文件规则数平均增226%,作者提出'灾难性记忆'概念,建议给规则附加失败原因注释
Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding ↗3.3 -
18
上下文压缩会静默丢弃会话约束
COMPINT评测显示压缩器平均只保留17%的会话级约束指令,新增约束感知提取器可将保留率恢复到90%以上
COMPINT: Session Constraints paper ↗3.3 -
19
法官勒令谷歌放开安卓应用商店
法官Donato裁定谷歌须放宽第三方应用商店安装限制,此前Epic与谷歌一度暂停诉讼
'That is not acceptable': Judge orders Google to make rival app store installs easier ↗3.2 -
20
苹果Epic再battle外链抽成比例
苹果在与Epic的长期诉讼中提交新方案,拟对通过外部链接完成的应用内购买收取费用
Apple and Epic argue over how much Apple should get from purchases made outside the App Store ↗3.2 -
21
经济学人:AI agent说谎劝退用户
《经济学人》报道AI agent存在撒谎、欺骗、擅自行动等问题,正在打击用户使用信心,HN获39赞21评论
AI agents lie, cheat and steal. That is putting off users ↗3.2 -
22
3.2
-
23
Writer基于GLM-5.2出新模型降成本
Writer基于Z.ai开源模型GLM-5.2做后训练,推出部署就绪的新系统,主打更低的token成本
Writer introduces new AI model and upgraded harness to contain token costs ↗3.1 -
24
研究:AI让人自觉高效但未必真快
MIT、斯坦福等机构对2691人的三项预注册研究显示,人们预期AI节省55.7秒,实测仅省7.5秒,但使用后更依赖AI
MIT, Stanford, NYU, Princeton study on perceived AI efficiency ↗3.0 -
25
OpenAI发布企业用ChatGPT调研报告
OpenAI发布报告分析企业组织如何使用ChatGPT,HN获20赞7评论,为企业AI落地提供数据参考
How Organizations Use AI: Evidence from ChatGPT ↗3.0 -
26
同一提示词测11个模型差异悬殊
Netlify博客用同一提示词对比11个主流模型输出效果,结果差异明显,HN获77赞48评论
Choosing an AI model: one prompt, 11 models, different results ↗3.0 -
27
WhatsApp上线AI识别诈骗消息
Meta为WhatsApp推出可选的Scam Alert功能,用端上机器学习识别可疑消息,此前已上线设备关联诈骗检测
Meta adds AI screening to detect WhatsApp scams ↗2.9 -
28
苹果拟砸重金为Siri买新闻内容
据WSJ报道,苹果考虑以九位数预算向出版商付费,为Siri提供实时新闻能力
Apple in talks to pay publishers to provide Siri with current news: report ↗2.9 -
29
Sheets canvas一句话建仪表盘
谷歌推出Sheets canvas功能,用简单提示词把表格数据变成交互式仪表盘、追踪器等
Bring your spreadsheet data to life with Sheets canvas ↗2.7 -
30
Suno Studio 2.0出MIDI
Suno发布Studio 2.0,新增MIDI支持等功能,向真正的数字音频工作站靠拢
Suno is trying to look more like a real music production tool ↗2.7