前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
苏晚

苏晚

Su Wan

前途科技 · 前沿主笔

关注 AI 与前沿科技的观察者,前途科技前沿内容主笔。

共 50 篇文章

全部文章

用 Gradio Workflow 重建 AUTOMATIC1111:73 节点工程化答案
教程/09.11

用 Gradio Workflow 重建 AUTOMATIC1111:73 节点工程化答案

Hugging Face 团队用 gr.Workflow 把 AUTOMATIC1111 的十一条媒体管线重写成 73 个节点的一张画布:没有循环、四类算子把本地 Python 与远端调用分开、36 个节点里 22 个完全在进程里跑。这不是又一个 ComfyUI 分身,而是对扩散工作流「怎么组织」这个老问题的一次结构化回答,中文工程师值得看一遍它做对了什么。

拒绝率清零,代价是拒掉 74% 的正常问题:安全对齐评测漏掉的另一半
教程/09.09

拒绝率清零,代价是拒掉 74% 的正常问题:安全对齐评测漏掉的另一半

Hugging Face 上 Multiverse Computing 团队最新论文实测:Qwen3-8B 安全微调后,跨基准不安全响应率均值从 26.26% 降到 0.14%,但同一 checkpoint 的 XSTest 过拒率同时从 2.00% 冲到 74.00%——他们把问题重新定义为"话题内的边界",并给出覆盖修补、边界成对、目标模型自生成合规回复三个可复现的组件。

拆解 Claude 文本水印:不是绿名单,是锦标赛采样,以及它在中国合规里挡得住的那一半
洞察/09.08

拆解 Claude 文本水印:不是绿名单,是锦标赛采样,以及它在中国合规里挡得住的那一半

Sebastian Raschka 用 50 张幻灯片讲清了 Claude 文本水印的机制:不是学界常提的绿红名单,是 Google SynthID-Text 那套锦标赛采样。中国合规角度还得再算一笔账——它只覆盖了标识办法的隐式一半。

《西雅图时报》与《新闻日报》起诉 OpenAI 和微软侵权,新闻版权诉讼持续蔓延
法律/09.07

《西雅图时报》与《新闻日报》起诉 OpenAI 和微软侵权,新闻版权诉讼持续蔓延

两家美国媒体以版权侵权为由将 OpenAI 和微软告上法庭,指控 AI 训练绕过付费墙、输出取代原文阅读,并要求销毁所有涉案训练数据。

微软 Azure Foundry 模型路由扩容至 28 区域,新增 Claude Opus 4.8 与 GPT-5.6
AI 大模型/09.07

微软 Azure Foundry 模型路由扩容至 28 区域,新增 Claude Opus 4.8 与 GPT-5.6

微软将 Foundry 模型路由器覆盖区域从 2 个扩至 28 个,新增 Claude Opus 4.8 和 GPT-5.6,使用默认配置的团队自动生效——但 API 稳定不等于行为稳定。

理想汽车以 26.5 亿增资欣旺达动力,持股升至 11.17%,电池自研版图再进一步
汽车·出行/09.07

理想汽车以 26.5 亿增资欣旺达动力,持股升至 11.17%,电池自研版图再进一步

理想汽车拟以 26.5 亿元增资欣旺达动力,持股比例升至 11.17%,继 2025 年合资建厂后再度加码,标志着其电池战略从供应链备份走向产业掌控。

NeoMME 拆解:单塔多模态编码器如何把视觉 RAG 索引压到每页 6 KB
教程/09.07

NeoMME 拆解:单塔多模态编码器如何把视觉 RAG 索引压到每页 6 KB

Hugging Face 与 H Company 发布 NeoMME —— 260M 参数打平 3.75B 模型,late-interaction 索引从 1.5 MB 压到 6 KB。视觉 RAG 的账终于算得过来了。

GitHub HydraFusion:多模型编排媲美 Opus 5,成本低 67%
技术/09.06

GitHub HydraFusion:多模型编排媲美 Opus 5,成本低 67%

GitHub 将 Project HydraFusion 纳入 Copilot 研究预览,通过运行时多模型编排在三项智能体编程基准上媲美 Claude Opus 5 质量,估算成本低 67%。同日 IFM 发布 K2 Horizon,六模型族从 0.9B 到 375B 完整开源,包含 Agent 后训练全流程数据。

Audacity 4.0 发布:Qt 重构界面,剪辑模型全面重做
技术/09.06

Audacity 4.0 发布:Qt 重构界面,剪辑模型全面重做

开源音频编辑器 Audacity 升至 4.0 版本,以 Qt 框架重建全部界面,引入全新剪辑编辑模型:多选、自由移动、叠加替换,录音可从时间线任意位置开始。新格式 .aup4,向下兼容 .aup3 项目。

乌克兰战场无人机数据流向商业市场:超百家企业获取飞行数据
技术/09.06

乌克兰战场无人机数据流向商业市场:超百家企业获取飞行数据

乌克兰国防部已将数万次无人机飞行产生的数百万数据点开放给军事承包商和商业公司,超百家企业及英国政府已获取访问权。这批战场数据因包含实验室难以复现的极端条件,对 AI 训练价值极高,但监管框架尚未跟上商业化速度。

微软 Project Zenith:面向开发者的开箱即用 Win11 配置
技术/09.06

微软 Project Zenith:面向开发者的开箱即用 Win11 配置

微软宣布 Project Zenith,一套面向 AI 编程开发者预配置的 Windows 11 Pro 环境,最低硬件要求 64GB 统一内存、250GB/s 带宽,预装 VS Code、GitHub Copilot、Git、Python、WSL 等工具链。首批设备搭载 AMD Ryzen AI Halo 平台。

HEIR:Google 同态加密编译器让 ML 推理在密文上直接运行
技术/09.06

HEIR:Google 同态加密编译器让 ML 推理在密文上直接运行

Google 开源编译器 HEIR 将预训练 ML 模型转换为在加密数据上直接运行的等价程序,实现完全同态加密(FHE)推理:服务端全程无法获取输入、输出或中间值的任何比特。用信用卡欺诈检测器为例,FHE 推理端到端约 2.6 秒,结果正确。

微软向纽约时报诉讼提交 820 万条 Copilot 对话日志
技术/09.06

微软向纽约时报诉讼提交 820 万条 Copilot 对话日志

微软在与纽约时报的版权诉讼中提交 820 万条 Copilot 对话日志,称其中仅 59,545 条与新闻内容有 16 字以上重合,仅 24 条有 30 字以上重合。微软以此支持"AI 训练属合理使用"主张;纽约时报称证据指向"盗窃"。微软同时申请法院驳回诉讼。

Claude 系统提示词更新:禁止复现歌词,版权形象和 Logo 也不能画
技术/09.06

Claude 系统提示词更新:禁止复现歌词,版权形象和 Logo 也不能画

Anthropic 于 9 月 2 日更新了 Claude 消费端系统提示词,新增歌词与版权视觉作品的明确禁令,时间节点与索尼、华纳对 Anthropic 的版权诉讼高度重合。

纽约、洛杉矶同日重启 AI 禁令:美国两大学区全面限制生成式 AI
政策/09.06

纽约、洛杉矶同日重启 AI 禁令:美国两大学区全面限制生成式 AI

纽约市教育局禁止 K-8 年级学生使用 AI,洛杉矶统一学区对全部约 37.8 万名学生实施为期一年的设备级禁令,两大学区均是在 2023 年「解禁」后的二次限制。

蔚来 Q2 财报后股价创52周新低:连续三季盈利,但销量在退坡
技术/09.06

蔚来 Q2 财报后股价创52周新低:连续三季盈利,但销量在退坡

蔚来 2026 年二季度交付量创单季新高,整车毛利率升至 18.5%,但财报发布当日港股跌 6.39% 至 52 周新低,8 月交付连续两月环比下滑;CEO 李斌警告汽车行业将在三五年内完成最终洗牌。

DeepSeek 二轮融资前哨:中间渠道收 18% 前端费,投资人五年锁定无投票权
商业/09.06

DeepSeek 二轮融资前哨:中间渠道收 18% 前端费,投资人五年锁定无投票权

围绕 DeepSeek 投资份额,部分中间渠道开出「前端 18%+后端 35%」的收费条件;即便接受高额费用,投资人也未必能拿到份额——DeepSeek 要求 LP 穿透核查、五年锁定,且多数不设投票权。

350M 模型 100 步 GRPO 微调:结构化输出合规率从 22.6% 抬到 29.7%
教程/09.06

350M 模型 100 步 GRPO 微调:结构化输出合规率从 22.6% 抬到 29.7%

Hugging Face 最新教学把小模型做结构化输出这件事拆到了工程量级:llama.cpp 跑基线、按错误类型定向做数据增强、TRL 的 GRPO 在免费 GPU 上跑 100 步。7.1 个百分点的提升不是终点,值得看的是可搬到产线上的那个闭环。

「Next-token predictor」是错的心智模型:为什么它决定了你怎么用大模型
AI 大模型/09.05

「Next-token predictor」是错的心智模型:为什么它决定了你怎么用大模型

一个 Hacker News 短文抛出被中文技术圈忽视的问题:把大模型理解成"更强的 token 预测器",会让你在评测、微调和产品定位上系统性走偏。RLVR 后训练已经把优化目标从模仿改成了达成结果——用错心智模型,代价是每一笔训练投入。

NeoMME:单塔 Transformer 取代 VLM+投影+解码器,索引缩到 6KB/页
教程/09.04

NeoMME:单塔 Transformer 取代 VLM+投影+解码器,索引缩到 6KB/页

Hugging Face H Company 于 9 月 3 日发布 NeoMME:260M/800M 参数的多模态编码器,从零训练单一双向 Transformer,不用视觉塔与因果解码器,检索质量与 3.75B 模型持平,索引可压到 6KB/页保留 95% nDCG@10。

编码 Agent 更靠谱的 5 层护栏:Cole Medin 11 条清单的落地版
教程/09.03

编码 Agent 更靠谱的 5 层护栏:Cole Medin 11 条清单的落地版

17 分钟视频里的 11 条建议其实是 5 层护栏:上下文管理、事件级保障、会话卫生、并发与迭代硬边界、独立评审。附可以直接抄的钩子配置、交接文模板、规则审计 prompt 和评审 Agent prompt。

Agent OS 的三种入口:为什么阿里、腾讯、AWS 押了三条不同的路
技术/09.03

Agent OS 的三种入口:为什么阿里、腾讯、AWS 押了三条不同的路

9 月 2 日,阿里云万有无界和腾讯 WorkBuddy 开放平台同日公测,一个月前 AWS 刚开源 Kiro Crew。表面看是同一条 Agent 赛道的三家玩家在同期落子,实际上他们锚定的是完全不同的入口层——阿里锚组织,腾讯锚设备,AWS 锚代码。理解这个分岔,比比较谁的模型强更重要。

WebLLM:用 WebGPU 把大模型跑进浏览器
技术/09.03

WebLLM:用 WebGPU 把大模型跑进浏览器

MLC 团队的开源项目 WebLLM 借助 WebGPU 硬件加速,将大语言模型推理直接搬进浏览器,无需服务器,兼容 OpenAI API,支持 Llama 3、Qwen 等主流开源模型。

智元机器人夺 18 枚金牌:量产机在运动会创纪录
技术/09.03

智元机器人夺 18 枚金牌:量产机在运动会创纪录

在 2026 年世界人形机器人运动会上,智元以 18 金 46 牌居榜首,且所有参赛机器人均为量产机,灵犀 X2 拿下 100 米障碍金牌,OmniHand 包揽灵巧手 7/8 项冠军。

亚马逊购物 AI 新增诈骗识别:让 Alexa 替你验真假
技术/09.03

亚马逊购物 AI 新增诈骗识别:让 Alexa 替你验真假

亚马逊宣布购物版 Alexa 新增诈骗识别功能,可以根据用户提问判断收到的邮件、短信或电话是否来自亚马逊,系统会与亚马逊历史发送的数十亿条消息进行比对。

ChatGPT 桌面应用内嵌了一整套 LibreOffice
技术/09.03

ChatGPT 桌面应用内嵌了一整套 LibreOffice

开发者 Simon Willison 发现 OpenAI 的 ChatGPT 桌面应用(原名 Codex)在本地缓存目录里打包了完整的 LibreOffice、Python、Node.js 和 git,总占用约 1.7GB。

黄仁勋在 G20 呼吁各国加快 AI 基础设施建设
技术/09.03

黄仁勋在 G20 呼吁各国加快 AI 基础设施建设

英伟达 CEO 黄仁勋在北卡罗来纳州 G20 科技峰会上将 AI 比作水电等公用设施,呼吁各国加快建设 AI 基础设施,并为美国推动的《卡罗来纳原则》背书,支持轻监管路线。

Sonos 发布 27 系统:AI 语音和 MCP 接入多房间音响
技术/09.03

Sonos 发布 27 系统:AI 语音和 MCP 接入多房间音响

Sonos 发布 Sonos 27 操作系统,新增生成式 AI 语音功能 Sonos 27voice 和 MCP 协议支持,并公布第二款头戴耳机和新 Soundbar,公司将自身定位从「音箱公司」重新框架为「音频操作系统」。

俄罗斯初创 Mostik:让 AI 模型无需文字直接交流
技术/09.03

俄罗斯初创 Mostik:让 AI 模型无需文字直接交流

俄罗斯初创公司 Mostik 开发了一种方法,让 AI 模型通过权重中的数学值直接交流,无需生成文字输出,将 GLM-5.2(7530 亿参数)与 Qwen-3.5(40 亿参数)融合后,成本降至前者的 1/20,性能居两者中间。

zvec-grep:为人类和 AI 智能体统一本地搜索
技术/09.03

zvec-grep:为人类和 AI 智能体统一本地搜索

开源工具 zvec-grep(zg)将 ripgrep、BM25 和向量搜索合并为一个本地优先的命令行界面,支持语义检索,并可直接作为 AI 智能体的搜索工具使用。

//

24小时热榜

OpenAI 发布 Agents API 公测版:一键构建生产级智能体
TOP1

OpenAI 发布 Agents API 公测版:一键构建生产级智能体

OpenAI 推出金融专属 ChatGPT,搭载 GPT-6 Astra 强化投行业务
TOP2

OpenAI 推出金融专属 ChatGPT,搭载 GPT-6 Astra 强化投行业务

3

OpenAI 开放 GPT-Live-1 API:原生全双工实时语音模型

18小时前
OpenAI 开放 GPT-Live-1 API:原生全双工实时语音模型
4

ChatGPT与Codex加持:AI将抗生素筛选缩至数小时

18小时前
ChatGPT与Codex加持:AI将抗生素筛选缩至数小时
5

RLHF先驱Paul Christiano加入OpenAI基金会董事会

1天前
RLHF先驱Paul Christiano加入OpenAI基金会董事会
6

OpenAI发布Data agent:自然语言直连数仓与BI系统

1天前
OpenAI发布Data agent:自然语言直连数仓与BI系统
7

DeepSeek发布V4.1 Flash,苹果折叠屏引热议

1天前
DeepSeek发布V4.1 Flash,苹果折叠屏引热议
8

世界模型进军物理世界:专家解析具身智能落地路径

1天前
世界模型进军物理世界:专家解析具身智能落地路径
前途科技前途科技
服务关于快讯技术商业报告
前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款