本文为 AIHOT 精选 AI 日报(2026-08-05),当日共收录 29 条资讯。以下内容来自 AIHOT,点击标题可查看详情。

模型发布/更新

产品发布/更新

行业动态

技巧与观点

  • 在单颗 AMD MI300X 上运行 DeepSeek V4 Flash:一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。(来源:Hacker News 热门(buzzing.cc 中文翻译)) [原文]
  • MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行:MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。(来源:Simon Willison 博客) [原文]
  • 用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线:本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 检查流水线扫描每个技能。(来源:MarkTechPost(RSS)) [原文]
  • Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零:Cloudflare 在 Astro 仓库上运行自动化 triage 流水线,通过隔离的 AI 子代理复现、诊断并修复 bug,将开放 issue 从 200 多个降至约 30 个,预计下月归零。该流水线由 issue 标签驱动,修复后自动发布预览版本供用户验证。其底层引擎已发展为 Flue,一个开源的平台无关框架,用于构建持久化智能体与工作流。(来源:Cloudflare Blog) [原文]
  • GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码:GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。(来源:GitHub Blog) [原文]
  • 如何用 LangSmith 评估语音智能体:LangChain 官方博客介绍如何用 LangSmith 评估语音智能体,覆盖执行、结果与来电者体验三个层面。评估手段包括 LangSmith traces、代码评估器、LLM judges 和人工审查,帮助开发者系统化验证语音智能体的实际表现。(来源:LangChain:Blog(RSS)) [原文]
  • 从零开始,教你用Codex搓出属于你自己的第一个硬件:作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪硬件。文中还介绍了用Agent调试宏键盘、以及OpenAI与Work Louder联名发布的Codex Micro键盘(13个机械按键,售价230美元)等案例,强调“干中学”的AI开发方式。(来源:公众号:数字生命卡兹克) [原文]
  • 杰文斯悖论还能持续吗:AI 定价分层如何支撑算力需求增长:科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却在上涨:Anthropic 7 月 24 日发布的 Fable 5 定价每百万输出 token 50 美元,较 Opus 5 翻倍;OpenAI 则在 Fable 5 发布五天后将 GPT-5.6 Luna 价格下调 80%。(来源:Tomer Tunguz 博客(VC 分析)) [原文]

来源:AIHOT 日报 2026-08-05|数据版权归 AIHOT 及原始来源所有

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。