全部 AI技术 安全技术 IT技术
AI技术

注意你的语气:提示词礼貌程度如何影响大语言模型的准确性

Kumo.AI 团队通过系统性研究揭示:提示词的礼貌程度对 LLM 准确性有显著影响,但关系复杂微妙。在 72 个模型、20 种礼貌变体和 6 个基准测试的大规模实验中,41% 的情况下礼貌提示提升准确性,28% 降低性能,31% 无显著影响。研究发现越先进的模型从礼貌提示中获益越大,且礼貌效应与人类感知的社会温暖度正相关。

2026/5/27 230
AI技术

SPEX:大规模识别LLM中交互效应的可解释性方法

规模化洞察:为LLM高效识别关键交互效应 Landon Butler, Justin Singh Kang, Yigit Efe Erginbas, Abhineet Agarwal, Bin Yu, Kannan Ramchandran 2026年3月13日 理解复杂机器学习系统,特别是大语...

2026/5/26 242
AI技术

StruQ与SecAlign:基于微调的高效提示注入防御机制

结构化查询 (StruQ) 与偏好优化 (SecAlign):应对提示注入攻击的强力防御机制 Sizhe Chen, Julien Piet, Chawin Sitawarin, David Wagner, Arman Zharmagambetov, Saeed Mahloujifar, Ka...

2026/5/26 240
AI技术

构建生成式AI应用的十大常见陷阱

警惕!构建生成式AI应用时最容易踩的10大“坑” 2025年1月16日 • Chip Huyen 由于我们仍在基础模型(foundation models)应用构建的早期阶段,犯错是完全正常的。这是一篇简短的笔记,分享了一些我从公开案例研究和个人经验中观察到的最常见的陷阱。

2026/5/26 197
AI技术

Apple PICO:面向人类视觉系统的实用学习型图像编解码器

Apple发布PICO感知图像编解码器,相比AV1节省2.3-3倍码率,在iPhone上仅需230ms编码150ms解码。

2026/5/25 182
AI技术

约束衰减:LLM Agent在后端代码生成中的脆弱性剖析

最新arXiv研究发现:随着结构性约束增加,LLM Agent代码生成性能平均下降30个百分点,数据层缺陷占总失败的45%。

2026/5/25 231
AI技术

AI芯片成本结构深度解析:HBM驱动的支出激增与组件占比重塑

Epoch AI最新分析显示AI芯片中内存(HBM)成本占比已从52%攀升至63%,总组件支出从220亿激增至520亿美元。本文深度解读这一趋势背后的技术经济学。

2026/5/25 191
AI技术

AI Agent 全面解析:工具、规划与失败模式

智能体(Agent)被许多人视为 AI 的终极目标。本文从 Chip Huyen 的经典著作《AI Engineering》中摘录改编,全面解析 AI 智能体的核心概念。文章从智能体的定义出发,深入探讨决定智能体能力的两个关键方面:工具(Tools)与规划(Planning),并通过 SWE-agent 和 RAG 系统等实例说明智能体的工作原理与失败模式。

2026/5/24 228
AI技术

Mamba 深度解读:用状态空间模型挑战 Transformer 霸主地位

Mamba 是一种挑战 Transformer 的新型状态空间模型(SSM),首次在百万级 token 长序列上实现了与 Transformer 相当的性能,同时解决了注意力机制的二次复杂度瓶颈。本文用直观的比喻和数学推导,深入浅出地讲解了 Mamba 的核心原理、选择机制及其对 AI 未来的意义。

2026/5/24 230
AI技术

自适应并行推理(APR):高效推理扩展的下一个范式

BAIR 博客深度综述:自适应并行推理(APR)通过让语言模型自行决定何时并行化、产生多少线程以及如何协调,将并行化从外部强加变为模型的生成控制流。文章系统梳理了从简单分支合并、启发式搜索到 ParaThinker、GroupThink、Hogwild! 等方法的演进,深入比较了 Multiverse(引擎级 KV 缓存复用)与 ThreadWeaver(客户端编排)两种推理系统路线,并讨论了并行化奖励设计的关键问题——仅结构奖励易被钻空子,效率奖励需追踪关键路径,并行效率应以保证正确性为前提。

2026/5/24 191