-
NVIDIA 提出 FlashREINFORCE:用单轨迹异步训练解决长程 Agent 强化学习瓶颈
长程 Agent 训练正在暴露 GRPO 的同步与成本瓶颈。NVIDIA 提出的 FlashREINFORCE 通过每个 prompt 单轨迹采样、异步批处理和样本均值优化,尝试解决长尾轨迹、方差控制与工具调用行为坍缩问题。
-
OpenAI基金会出资补上生物AI短板:失败试验与破产药企资料成了新训练语料
OpenAI 基金会宣布资助生物医疗数据项目,其中包括从破产生物技术公司获取失败实验与监管文件。此举显示,垂直领域大模型的瓶颈正在从模型能力转向高质量专业数据供给。
-
AI智能体安全赛道获资本加码:AIUC完成4000万美元A轮融资
AIUC完成4000万美元A轮融资,试图通过第三方审计和认证机制,为企业AI智能体提供安全边界评估。
-
光粒科技再获Pre-B轮融资,粤科母基金与维度资本入局
光粒科技完成新一轮Pre-B轮融资,粤科母基金与维度资本参投。作为消费级AR智能运动眼镜厂商,公司正加快在光学技术、产品矩阵和渠道端布局。
-
3亿美元买下手机相机团队:OpenAI把影像能力纳入硬件版图
OpenAI以超过3亿美元收购Glass Imaging,将前苹果人像模式团队纳入麾下。这笔交易显示,OpenAI正把计算摄影能力作为未来AI硬件和多模态终端感知的重要基础。
-
AI 编辑 Agent 总出错?一次真实复盘:问题不在模型,而在系统设定
当 AI Agent 在内容发布中频繁出错,真正的问题未必是模型理解偏差,而可能是旧的角色定义被带入了新的读者场景。
-
天玑9600系列把30B模型装进手机,端侧AI开始从问答走向代办
联发科天玑9600系列将30B MoE模型带入移动端,结合2nm工艺与能效优化,端侧AI正从简单问答走向更复杂的本地任务执行。
-
Agent 编排进入动态调度阶段:LangGraph 的 Command 与 Send 如何改变并行执行
LangGraph 的 Command 与 Send 将 Agent 流程控制从静态分支推向动态调度。本文围绕并行执行、Map-Reduce 派发与 InvalidUpdateError 等实践问题,梳理这一机制的应用边界。
-
苹果谈 AI 可穿戴隐私边界:智能眼镜不能只让用户自己放心
苹果新任 CEO John Ternus 在谈及 AI 可穿戴设备时表示,相关功能设计不仅要让使用者舒适,也要让使用者周围的人对设备存在感到舒适。这一表态指向智能眼镜等 AI 硬件长期面临的旁观者隐私争议。
-
当雪花视频让大模型集体交白卷:视频理解真正缺的是时间感
一项“雪花视频”测试显示,人类能轻松识别动态噪声中的内容,主流多模态大模型却几乎全部失败。问题不在图像识别,而在现有架构缺少稳定的时间感知能力。