-
AI Agent 日志里的幽灵工具:为什么 Trace 可信度要从目录哈希开始
AI Agent 日志中出现未注册工具名,暴露出 Trace 系统常忽略模型实际看到的工具目录。通过冻结目录并计算哈希,可以把工具契约纳入可观测性体系,提升回放与审计可信度。
-
三星显示拟投3000亿韩元布局12英寸RGB OLEDoS,XR微显示路线或迎新变量
三星显示拟投资约3000亿韩元建设12英寸RGB OLEDoS量产线,为XR头显与AI眼镜提供新的微显示方案。
-
Claude Code 成功率逼近九成,但“AI 自我改进”仍缺少关键证据
Anthropic 内部数据显示,Claude Code 多类任务成功率已接近九成。但高成功率是否意味着 AI 能递归自我改进?现有证据仍不充分。
-
从第一视角拍摄到视线交互:千问AI眼镜N1系列正式亮相,10月13日开售
千问在云栖大会展示AI眼镜N1、N1 Pro和AI耳夹式耳机。新品主打第一视角拍摄、眼动追踪、虹膜支付与AI助理能力,10月13日现货发售。
-
给 AI Agent 上锁:用 Policy Gates 划定行为边界
当 AI Agent 开始发邮件、改记录、删文件,仅靠提示词已经不够。Policy Gates 的核心,是把 Agent 从执行者降级为提议者。
-
0.6B小模型不做文本生成:NanoJev把决策压缩成一次概率输出
NanoJev用0.6B模型直接输出概率分布,减少自回归文本生成带来的解码开销,为游戏智能体和批量决策任务提供了一种更轻量的模型形态。
-
Nscale冲刺纽交所:一家深度绑定微软与Anthropic的AI算力公司,正在接受资本市场的风险定价
Nscale即将登陆纽交所,但其约85%的合同收入来自微软与Anthropic。这场IPO不仅是一家算力公司的上市,也成为检验AI基础设施客户集中风险的新样本。
-
AI眼镜上半年出货大增263%:Meta主导无显示市场,带显示AR仍处早期放量
Counterpoint数据显示,2026年上半年全球AI眼镜出货量同比增长263%,但96%仍由无显示产品贡献。Meta以94%份额主导无显示AI眼镜;带显示AR+AI眼镜增长449%,Rokid、Meta、Even Realities等厂商开始形成初步竞争格局。
-
剑桥提出“无限参数LLM”:把对话上下文编译进权重,而非继续塞进提示词
剑桥大学研究者提出“无限参数LLM”:不把运行时信息持续塞进上下文,而是在会话中动态生成并调整权重补丁。该机制可减少重复读取上下文的成本,为长期记忆和参数化知识更新提供新路径,但泛化能力、等算力成本、可审计性和生产安全仍是待解问题。
-
AI 编程把代码写快了,却把 CI 卡住了:Linear 的持续集成改造记录
AI Agent 让代码产出更快,但 Linear 发现验证代码的 CI 成为新瓶颈。通过更换运行环境、优化编译器、减少关键路径开销和降低重复初始化成本,Linear 在测试套件接近四倍增长的情况下,将 PR 等待时间从 6 分钟以上压缩到略高于 5 分钟,并把单次测试的 runner 时间削减约一半。