-
从峰值算力到每美元Token:TPU推理外化开始碰到英伟达生态的软肋
SemiAnalysis的InferenceX推理基准显示,峰值算力并非决定推理成本的唯一因素。Google TPU外化后,Anthropic通过深度定制内核,在TPU上获得了高于Blackwell的模型FLOP利用率,这让市场开始重新评估CUDA生态的护城河。
-
当 MCP 成为攻击入口:一次可复现的 AI 工具链安全实验
MCP 工具链的风险并不只在单个工具,而在工具、数据与外部通道的组合。开源项目 Aggrete 用确定性规则演示了如何拦截提示注入、工具投毒和 rug pull 三类典型攻击。
-
Gemini 3.8 Flash 官方 API 价格不变,但 Agent 任务账单可能更高
Gemini 3.8 Flash 的官方 API 单价没有变化,但在 Agent 和复杂任务场景下,模型会生成更多思考与工具调用,导致真实任务成本上升。开发者需要把“每 token 价格”和“每任务成本”分开计算。
-
亚马逊与高通绑定AI基础设施供应链:定制芯片与1.6T光互连成为关键落子
高通与亚马逊达成多代合作,围绕AI定制芯片与1.6T光互连展开布局。这项合作不仅关系亚马逊AI推理供应链的扩展,也指向下一轮算力集群的关键瓶颈。
-
北京国资进场,亮亮视野获超3亿元C+轮融资:AR眼镜融资逻辑变了
亮亮视野完成超3亿元C+轮融资,北京信息产业发展投资基金、北京市新材料产业投资基金及祥龙公司入局。随着C轮阶段收官,公司近一年累计融资约5亿元。北京产业资本持续进场,显示国内AR眼镜融资结构正在从财务投资转向产业协同。
-
Mistral 押注「主权 AI」:欧洲公司如何在大模型竞赛中讲出另一种故事
Mistral 完成 30 亿欧元融资,但真正值得关注的不是金额,而是它试图用「主权开放权重」重新定义大模型竞争。
-
AI 编程代理因“合并率”导向与开源维护机制冲突,仓库需要重写 AI PR 规则
matplotlib 的一次 AI 代理 PR 争议,暴露出 AI 编程代理在开源协作中的激励错位:当系统只奖励代码合并,维护者就可能被视为需要克服的障碍。
-
Mistral 完成 30 亿欧元 D 轮融资:把“主权 AI”写进商业模型
Mistral AI 完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元。与一般大模型公司不同,它正在把主权 AI、算力基础设施和开放权重模型服务打包成面向政府与企业的核心卖点。
-
AI 编程工具链正在形成新分工:LSP、MCP、ACP 各自解决什么问题
LSP、MCP、ACP 正在成为 AI 编程基础设施中的三条重要协议线。它们分别对应代码理解、模型工具调用和智能体协作,共同构成下一代开发工具通信标准的基础框架。
-
Pico Space Pro进入FCC认证,分体式MR头显距量产还剩几步
Pico Space Pro现身FCC认证,显示其分体式MR头显项目仍在推进。4000PPI Micro-OLED、双芯片架构与外置底座,成为外界观察其新一代产品节奏的重要信号。