论文解读、算法突破、架构分析
当 AI 接管编码工作,软件工程的重心全面收拢到两端:精准定义需求与严格验证交付。传统 Gherkin 缺乏严密的守卫条件,容易让 Agent 脑补规则。引入清晰的条件守卫与双 Agent 隔离,是解决测试假绿灯的关键路径。
OpenAI 近日披露并拦截了一起有组织的对抗性模型蒸馏行动。攻击者试图通过提示词漏洞提取受保护的内部推理数据,涉及超 1.5 万名用户。OpenAI 指出部分核心活动与月之暗面关联人员有关。
OpenAI 披露并阻断了一起协同对抗性模型蒸馏行动。攻击者试图通过操纵交互系统性窃取受保护的内部推理链以复现模型能力,核心活动被归因于月之暗面(Moonshot AI)相关人员。
多数业务不需要大模型写长文,而是需要打分与分类。作者借助 TypeSafe 的 Jev 模型打造了 Chrome 插件 Grounds,仅需 100 毫秒单次调用,就能精准评估文章是基于论据推导还是纯情绪宣泄。
线上故障往往不是低级语法错误,而是藏在异常边界、类型假设与资源消耗中的隐形炸弹。本文盘点从静态检查、模糊测试到内存分析的9款Python质量工具,构建多层防御体系,帮你在代码交付前堵死盲区。
很多Agent把大量算力浪费在简单的意图路由和状态跳转上。引入“快思考”强类型决策层后,确定性判断延迟降至毫秒级,推理速度提升近200倍、成本直降440倍,大模型得以专注深度规划。
当单靠刷榜的大模型迭代逐渐放缓,AI 竞争的主战场正转向 Agent Harness。决定智能体真正上限的,不仅是底层基模能力,更是包围它的状态机、工具链与容错闭环框架。
大模型调用工具出错时,报错重试或后台静默修补都会在上下文留下错误痕迹,导致后续推理变形。其实还有第三种解法:时间旅行式篡改历史。抹掉错误记录,让它以为自己一次就做对了,推理质量反而更高。
随着AI从单纯回答问题转向智能体解决现实任务,算力重心正从GPU训练吞吐向端到端低延迟迁移。英特尔在Connection大会上提出,CPU正成为AI推理的核心调度中枢,并通过端侧异构芯片破局具身智能。
Anthropic 宣布建立生命科学实验室,并公布一项早期研究成果:约 950 个 Claude 智能体耗时 21 小时,自主发现了一种具有类似 CRISPR 特征的新型逆转录酶系统(ART),展示了 AI 加速生物学发现的强大能力。
SpaceX星舰第14次试飞将打破前13次的亚轨道惯例,首次真正进入约275公里的近地轨道,运行近10小时并绕地六圈。这次任务不仅要验证长时间在轨推进剂与姿态管理,还将首次在轨部署26颗Starlink V3卫星,标志着星舰正从飞行验证迈向真正的轨道运输。
技术博客与 Go 官方博客本周同时更新:一篇纠正关闭 channel 的常见误解并系统梳理并发机制,另一篇介绍 1.26/1.27 新增的跨平台 SIMD 实验 API,覆盖 amd64、arm64 和 wasm。
开源推理框架Colibrì在GitHub斩获超3万Star。该框架利用MoE稀疏激活特性与多层内存调度机制,直接将SSD作为模型后备存储,仅凭普通CPU和24GB内存即可运行744B参数模型,大幅降低超大模型本地运行门槛。
在云栖大会上,米哈游揭秘了其AI游戏研发与玩法落地的完整技术布局。从具备多层记忆与情绪表达的AI NPC,到内部协作研发的多Agent平台,再到用强化学习自进化的游戏闭环,米哈游正在押注千亿打造全新的动态互动体验。
推理初创公司Inferact通过手写megakernel与结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3的速度达到每秒709 Token,比英伟达GB200快57%,相关代码已全面开源。
阿里平头哥在发布新一代真武V900芯片后,宣布进一步开源类CUDA软件栈T-Head SAIL,涵盖框架适配、算子优化与通信库。此举意在降低代码迁移门槛,让开发者与头部企业能够深度参与算子定制与底层调优。
Meta 在 Connect 大会上推出手持 AI 设备 Muse Charm;谷歌计划发射搭载 TPU 的试验卫星探索太空计算;Anthropic 内部测试揭示高阶 AI 具备更强议价能力;表演艺术家游本昌逝世。