-
本地跑大模型不再只拼显卡:llama.cpp 量化优化里的两条关键路径
llama.cpp 的 Q4_K_M 量化方案通过混合精度和双重量化,在压缩模型体积的同时保留关键层效果,为本地大模型部署提供了更现实的工程路径。
-
Code Agent 崩溃后如何恢复:一篇技术文章拆解状态持久化机制
当 Code Agent 执行长任务时,一次崩溃可能让几十步探索全部丢失。一篇技术文章详细拆解了 Transcript、事件流恢复和 Session Memory 等机制。
-
OpenAI 首次公布 Jalapeño 推理芯片成绩:以更省电方式追赶英伟达 GB300
OpenAI 在 Hot Chips 大会上首次披露 Jalapeño 推理系统基准成绩。在 InferenceX 测试中,其每瓦完成工作量为对比系统的 1.5 至 1.9 倍,端到端延迟约为 28% 至 59%。
-
一个小型 AI 日志分析助手的制作过程:从统一模型接口到可用排查结果
该实战项目展示了如何利用统一模型 API 和结构化提示词,把服务器日志转换为可操作的故障分析结果。
-
立讯精密上半年净利78.43亿元:营收高增下的经营现金流承压
立讯精密2026年上半年营收1745.04亿元,同比增长40.16%;归母净利润78.43亿元,同比增长18.04%,但经营现金流为-24.46亿元。
-
AI 办公进入「大厂统一入口」阶段:豆包、千问、WorkBuddy 与金山灵犀的同台竞争
字节将 TRAE、扣子相关能力并入豆包体系,并计划推出「豆包工作」;阿里、腾讯、金山也在加快整合 AI 办公产品。国内 AI 办公正从聊天助手走向企业工作流,竞争重点开始转向文档、会议、知识库等真实生产场景。
-
大朋VR加码商用游艺市场:P1 PRO Max发布并获千万级采购订单
8月21日,大朋联合宽恒科技在广州举办游艺行业新品品鉴会,发布P1 PRO Max商用VR一体机,并推出百万适配扶持计划,现场达成千万级战略采购订单。
-
Uni-Agent Gateway 重构 Agent 强化学习训练链路,黑盒系统也能无改造接入
VERL RFC #5790 提出的 Uni-Agent Gateway,用统一 OpenAI 兼容接口连接黑盒与白盒 Agent,并把 token 级轨迹采集从训练循环中剥离。
-
Codex 底层换到 Rust:OpenAI 开源 Agent 运行时,重写了 AI 编程工具的基础设施
OpenAI 开源 Codex Agent Harness,并将其底层从 TypeScript 重写为 Rust。本文梳理其三层接口设计、性能收益与 Agent 运行时工程化意义。
-
PICO Space Pro未发先曝:高端XR定价逼近1.85万元,显示与芯片配置成焦点
PICO Space Pro发布会前曝光:16GB+256GB版本预计16999元,16GB+512GB版本预计18499元。设备主打Micro-OLED、8K级输出和双芯片架构,最终价格将在9月2日发布会上确认。