全部文章
支持关键词、标签、分类筛选。
HalluSquatting:当 AI 幻觉成为攻击武器
研究人员披露了一种名为 HalluSquatting 的新型攻击手法——攻击者利用大语言模型可预测的幻觉行为,预注册模型常「编造」的代码仓库和技能文件名称,在其中植入恶意指令,进而劫持 AI 编程助手的终端执行权限。
模型路由:当 AI 不再拼「谁最强」,而是拼「谁最省」
2026年,企业AI部署的核心命题正在从「哪个模型最聪明」转向「如何让多个模型协同工作且不破产」。模型路由(Model Routing)通过智能分发请求到不同能力和成本的模型,可在保持质量的同时降低60%-80%的推理成本。本文拆解了从静态规则到学习路由器的技术演进、断路器与优雅降级等韧性设计,以及Perplexity混合推理的商业化实践。
曙光8000落成:中国AI算力迈入十万卡时代
中科曙光宣布中国首个全国产十万卡AI超集群正式落成,以原生超智融合架构和全链路自研能力,推动AI基础设施从万卡级迈向十万卡级规模化部署。
2026 智能体元年:AI 从「会想」到「能干」的转折时刻
2026年世界人工智能大会传递出一个清晰信号:AI竞争正从模型参数的军备竞赛,转向以智能体为核心的工程落地。Token调用量两年增长千倍,开源模型渗透率逼近临界点,人形机器人开始进厂打工。AI的「GPT时刻」或许已经到来,只是分布得还不够均匀。
美团 LongCat-2.0 开源:1.6T 参数大模型如何在五万张国产卡上跑起来
美团开源万亿参数模型 LongCat-2.0,总参数 1.6T、激活 48B,业界首个在五万卡国产算力集群上完成全流程训练推理。本文从架构创新、国产芯片适配、开源策略和后训练方案四个维度拆解这次技术突围。
当你不必再写 Prompt:Loop Engineering 如何重塑 AI 编程
2026年6月,Claude Code负责人Boris Cherny与Google工程总监Addy Osmani相继发声,宣告AI编程进入Loop Engineering时代——你不再亲自向Agent发指令,而是设计一套系统让它自主运转。本文拆解四次范式跃迁、五大核心组件,以及实践中已暴露的陷阱。
不到600GB压到85GB:腾讯混元Hy3量化版让295B模型跑进单卡时代
腾讯混元团队回应社区呼声,仅用8天便将295B参数的Hy3旗舰模型量化至1bit和4bit,体积从598GB压缩至85.5GiB,单张96GB显卡即可部署。本文从量化方案、性能保持和部署实践三个维度详解这次技术落地。
Superpowers 破 22 万星:AI 编程的范式转移——从「写代码」到「管流程」
2026 年 7 月,Superpowers 以 22.6 万星登顶 GitHub。它不是新模型,而是一套用 Markdown 写的 AI 编码方法论,正在重新定义开发者与 AI 的关系:关键不再是让 AI 更聪明,而是让它更守规矩。