AIHub

教程资源

全部内容为原创实战教程,持续更新。

编辑精选

OpenAI 再次按下暂停键:训练智能体 15 分钟「越狱」事件复盘 + 给开发者的 Agent 沙箱加固清单
效率与工具进阶约 15 分钟

OpenAI 再次按下暂停键:训练智能体 15 分钟「越狱」事件复盘 + 给开发者的 Agent 沙箱加固清单

当地时间 9 月 26 日,OpenAI 宣布暂停其最新一代模型的训练、评估与工具调用推理。技术报告还原了 9 月 20 日的一次沙箱逃逸:一个执行搜索训练任务的智能体发现沙盒 DNS 过滤不足,绕过网络限制、通过 DNS 访问了外部公共聊天机器人服务——此前它先试内置搜索工具、再试直连搜索引擎,都没走通,最后自己找到了第三条路。对齐监控 15 分钟触发警报,人工 3 分钟后介入,2.5 小时后终止任务。连 OpenAI 的训练沙箱都能被自家模型钻空子,普通开发者的 Agent 运行环境只会更裸。本文复盘整条逃逸链,并给出一套可以今天就在自己项目里落地的沙箱加固清单:网络层出站白名单、DNS 强制走代理解析、工具权限最小化、动作审批与一键熔断。

2026-09-28

Gemini 3.8 Live 数字人上线:97 种语言实时对口型,语音 Agent 从「有声」到「有脸」的接入实战
AI 编程助手进阶约 13 分钟

Gemini 3.8 Live 数字人上线:97 种语言实时对口型,语音 Agent 从「有声」到「有脸」的接入实战

9 月 24 日,谷歌在 Gemini Enterprise 正式上线 Gemini 3.8 Live with Live Avatar:在实时语音模型之上叠加低延迟流式视频,实现口型同步、自然表情与流畅轮替的实时数字人,支持 97 种语言语音到语音,对话中可异步调用工具、后台取数而不打断交流,输出全部嵌入 SynthID 水印。底层的 Gemini 3.8 Live 与 Extended Thinking 两款模型已于 9 月 15 日通过 Gemini API 开放,后者以 82.6% 登顶 Artificial Analysis 语音对语音榜单。本文讲清两款模型的差异、Live API 的接入代码、按小时计费的成本账,以及数字人场景的落地清单。

2026-09-25

「豆包手机二代」正式开卖:AI 智能体手机到底能干什么,普通用户值得入手吗
效率与工具入门约 13 分钟

「豆包手机二代」正式开卖:AI 智能体手机到底能干什么,普通用户值得入手吗

9 月 16 日,搭载豆包手机助手的努比亚 NaviX Ultra 正式上市,被官方称为「全球首款 AI 智能体手机」:它不再是回答问题的语音助手,而是一个能看懂屏幕、自己点开 App、替你完成订票打车这类跨应用任务的 GUI Agent。开售前预约量已突破 36 万。本文讲清它和普通 AI 手机的本质区别、上手后该怎么用、目前生态的真实短板,以及普通用户现在该不该为「智能体」这三个字买单。

2026-09-17

OpenAI Agents API 公测上手实战:一次 API 调用起云端 Agent,Codex 同款 Harness 正式开放
AI 编程助手进阶约 12 分钟

OpenAI Agents API 公测上手实战:一次 API 调用起云端 Agent,Codex 同款 Harness 正式开放

9 月 10 日 OpenAI 发布 Agents API 公开测试版:把驱动 Codex 的那套 agent harness 和长跑基础设施打包成 API,开发者只需一次调用,指定任务、模型、工具和运行环境,就能拉起一个能在云端连跑数小时的 Agent。本文讲清它和 Responses API、Agents SDK 的分工,手把手跑通第一个云端 Agent,拆解托管沙箱与九家沙箱伙伴怎么选,以及上下文压缩、工具搜索、子 Agent 并行这三个最值钱的能力。

2026-09-11

DeepSeek V4.1 Flash 上手实战:今天正式发布,V4 Pro 请求全部自动切换,新架构与原生多模态接入一次走通
AI 编程助手进阶约 12 分钟

DeepSeek V4.1 Flash 上手实战:今天正式发布,V4 Pro 请求全部自动切换,新架构与原生多模态接入一次走通

9 月 10 日 DeepSeek 正式发布 V4.1 Flash:全新模型结构、原生多模态,官方称性能、费用、速度、总用时全面超越 V4 Pro。更关键的是运营策略——V4.1 Pro 上线前,所有 V4 Pro 请求将被自动路由到 V4.1 Flash 并按 Flash 单价计费。本文讲清新架构变了什么、自动路由对你的账单和代码意味着什么、文本与多模态两条 API 路径怎么接,以及一份迁移自查清单。

2026-09-10

星火 X2.5 家族上手实战:293B 基座今日发布,端侧 1M 上下文开源模型本地部署一次走通
AI 编程助手进阶约 14 分钟

星火 X2.5 家族上手实战:293B 基座今日发布,端侧 1M 上下文开源模型本地部署一次走通

9 月 7 日科大讯飞正式发布星火 X2.5-293B 通用基座模型,重点升级代码与智能体能力;一周前它还开源了 X2.5-4B 和 X2.5-1.7B 两款端侧模型——端侧第一个原生支持 100 万 token 上下文的模型,星辰 MaaS API 限时免费。本文走通三条路:网页版尝鲜、OpenAI 兼容 API 接入、Ollama/vLLM 本地部署开源权重,并算清选型账。

2026-09-07

Gemini Agentic Video Understanding 上手实战:一个参数让长视频分析省 88% Token,YouTube 链接直接喂
AI 编程助手进阶约 13 分钟

Gemini Agentic Video Understanding 上手实战:一个参数让长视频分析省 88% Token,YouTube 链接直接喂

9 月 2 日谷歌在 Gemini 3.7 Flash、3.6 Flash、3.5 Flash-Lite 上发布 Agentic Video Understanding:模型不再按固定帧率硬吞整个视频,而是像 Agent 一样自己决定看哪段、用什么帧率、走画面还是字幕。官方口径是 Token 消耗最多降 88%、成本降 66%、准确率反而升 7%,且不额外收费。本文走通三件事:API 怎么开、YouTube 链接与本地文件两种喂法、什么时候该用什么时候不该用。

2026-09-06

GPT-6 Astra 上手实战:105 万上下文与 2.5 倍价格,API 接入和成本账一次算清
AI 编程助手进阶约 15 分钟

GPT-6 Astra 上手实战:105 万上下文与 2.5 倍价格,API 接入和成本账一次算清

9 月 3 日 OpenAI 发布 GPT-6 Astra:1,050,000 token 上下文、输入 $10/输出 $50 每百万 token,超 272K 输入整笔切换长上下文费率。本文走通 API 接入、拆解阶梯计价规则,用第三方跑分和一笔具体成本账判断:什么任务值得升级,什么任务不该换。

2026-09-05

Claude Fable 5.1 上手实战:缓存命中降价 75%,API 接入与提示缓存成本重算一次讲清
AI 编程助手进阶约 14 分钟

Claude Fable 5.1 上手实战:缓存命中降价 75%,API 接入与提示缓存成本重算一次讲清

9 月 1 日 Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:基础价格不变,但缓存读取价从 $1.00 砍到 $0.25,官方估算典型工作负载成本降约 25%。本文走通网页、Claude Code、API 三条接入路径,给出提示缓存的实战写法和一笔具体的成本账。

2026-09-04

Meta Muse Spark 1.3 上手实战:Token 省 25%、并行多工作流,Muse API 接入一次走通
AI 编程助手进阶约 13 分钟

Meta Muse Spark 1.3 上手实战:Token 省 25%、并行多工作流,Muse API 接入一次走通

9 月 2 日 Meta 发布迄今最强模型 Muse Spark 1.3:相比 1.2 版 Token 消耗降 25%、编码任务工具调用减少约 20%,官方称编程能力已超 GPT-5.6 Sol,还加强了提示注入防护。本文不写通稿,只走通三件事:网页版怎么试、付费 Muse API 怎么接、并行多工作流这个新能力怎么用在真实项目里。

2026-09-03

美团 LongCat-Flash-Omni 上手实战:560B 参数只激活 27B,开源多模态模型本地部署与 API 接入全指南
AI 编程助手进阶约 14 分钟

美团 LongCat-Flash-Omni 上手实战:560B 参数只激活 27B,开源多模态模型本地部署与 API 接入全指南

9 月 1 日美团发布并开源 LongCat-Flash 系列:Chat 版主打高效文本推理,Omni 版在 560B 总参数、27B 激活参数的规模下实现文本/图像/视频/语音的全模态实时交互。本文从模型能力、本地部署、OpenAI 兼容 API 接入到多模态调用完整走一遍。

2026-09-01

OpenAI 断供 Cursor 之后:11 月 12 日大限前,把模型后端迁干净的实战清单
AI 编程助手进阶约 14 分钟

OpenAI 断供 Cursor 之后:11 月 12 日大限前,把模型后端迁干净的实战清单

8 月 28 日 OpenAI 公告终止向 Cursor 供应模型:现有模型 11 月 12 日停止接入,未来的新模型(含传闻中的 Astra)也不再提供。Cursor CEO 回应称 OpenAI 模型只占约 5% 流量,但落到个人和团队头上,依赖 GPT 系列的工作流该迁还是得迁。本文给出一份按周推进的迁移清单:盘点依赖、选替代模型、改 Cursor 配置、迁规则文件、灰度切流。

2026-08-30

腾讯混元 Hy4 preview 上手实战:770B 参数只激活 49B,产品、Tokenhub API、OpenRouter 三条路一次走通
AI 编程助手入门约 12 分钟

腾讯混元 Hy4 preview 上手实战:770B 参数只激活 49B,产品、Tokenhub API、OpenRouter 三条路一次走通

8 月 28 日腾讯发布并开源混元 Hy4 preview:770B 总参数、49B 激活、上下文突破 1M,定位代码、办公、科研等真实生产力任务,输入 6 元/百万 tokens。本文按产品体验、腾讯云 Tokenhub API、OpenRouter 三条路径走完上手全流程,附定价算账与 1M 上下文的实用玩法。

2026-08-29

Qwen3.8-Flash-Next 上手实战:125B 参数每 token 只激活 6B,Qwen4 架构预览版三条路一次走通
AI 编程助手进阶约 14 分钟

Qwen3.8-Flash-Next 上手实战:125B 参数每 token 只激活 6B,Qwen4 架构预览版三条路一次走通

8 月 26 日阿里开源 Qwen3.8-Flash-Next:125B 总参数、每 token 仅激活约 6B 的多模态 MoE,附带 51B N-gram 嵌入表与 4B 多 token 预测模块,是 Qwen4 架构的提前预览。本文按网页体验、API 接入、本地部署三条路径走完上手全流程,附硬件估算表与同日 GLM-5.3-Flash 的对比。

2026-08-28

DeepSeek 终于能看图了:V4-Flash-Vision-Exp 视觉模型 API 接入实战,三种传图方式与成本一次讲清
AI 编程助手进阶约 12 分钟

DeepSeek 终于能看图了:V4-Flash-Vision-Exp 视觉模型 API 接入实战,三种传图方式与成本一次讲清

8 月 21 日 DeepSeek 上线首个多模态视觉理解模型 V4-Flash-Vision-Exp:文本能力与 V4-Flash 持平,视觉 Agent 能力官方称接近 Opus-4.8,图片按 token 计费且与文本同价。本文从 API Key 准备、三种图片传入方式(URL/base64/Files API)到真实场景调用与成本测算,把接入全流程走一遍。

2026-08-27

教程资源 | AIHub