EPISODE · Jul 26, 2026 · 13 MIN
EP130 · NVIDIA 创始人心法、前沿模型产品化、LLM 评测 · 07-27 早报
from BestBlogs
章节时间戳00:00 开场00:41 精讲:黄仁勋复盘英伟达转型与创始人判断03:19 精讲:Diane Penn 讲前沿模型如何变成产品06:14 精讲:大模型裁判的用法、偏差与人工校准08:51 速览:合成数据、Agent 小模型、具身机器人、Ruff、脑机接口11:40 补充阅读:心理健康评测、向量搜索、实时视频、微软模型、模型卡13:03 结语★ 精讲一 | Jensen Huang:打造 NVIDIA 的创始人心法 [视频]00:41|来自 Y Combinator黄仁勋从买回 OpenGL 教科书纠正错误路线、向 Sega 坦白无法交付,讲到把 AlexNet 视为通用函数逼近器后重做整套计算栈。访谈把 NVIDIA 的转型拆成一套可复用的方法:深入算法域、坚持第一性原理,并让组织围绕创始人的长处演化。★ 精讲二 | Anthropic 的 Diane Penn:如何把前沿模型做成产品 [视频]03:19|来自 Lenny's PodcastDiane Penn 用 Golden Gate Claude、Claude Code 与模型发布复盘 Anthropic 如何把研究能力变成产品。她把高强度模型使用视为发现未来工作流的实验输入,并解释 eval 如何承接用户反馈、成为研究与产品协作的可测试接口,同时正视能力进步并不均匀的锯齿边界。★ 精讲三 | 究竟什么是 LLM-as-a-Judge?2026 年前沿技术实战指南06:14|来自 Hacker News - Newest: 「LLM」这份指南从 pointwise、pairwise 与 rubric 三类判分方式出发,梳理 LLM-as-a-Judge 在模型评测、对齐与生产工程中的实际用法,也逐层拆开位置、冗长、自偏好、格式和对抗攻击等失真来源。它给出的落点很务实:拆分标准、交换顺序、参考答案校验,并始终用人工金标集持续标定。速览08:51 更多值得关注的内容· 规模化训练的真实难题:合成数据与预训练的工程现实 [视频] — AI Engineer· AI 拿走了 98%的工作,那属于你的、谁都替不了的 2%到底是什么? — 非凡产研· Nanbeige4.2-3B:探索通用 Agent 小模型 — 魔搭 ModelScope 社区· 腾讯开源三大具身基座模型,首席科学家张正友详解「三层脑」如何破解机器人反应慢 — InfoQ 中文· 3 万小时触觉数据补齐具身智能「手感」!新智具身&复旦报告三连发 — 量子位· Ruff v0.16.0:默认启用规则从 59 条增至 413 条 — Simon Willison's Weblog· Meta 开源 Brain2Qwerty v2:非侵入式脑机接口语句解码准确率达到 61% — InfoQ 中文补充阅读11:40 今天额外值得一读的几条· 用评估驱动开发打造心理健康 AI 教练 [视频] — AI Engineer· 当 RAM 成本过高时如何优化向量搜索:磁盘 vs 内存 ANN 索引 — Towards Data Science· 快一点!再快一点!快到世界能实时生成|和生数科技张金涛聊:Vidu S1、推理加速、实时交互视频 — 十字路口 Crossing· 微软发布全新自研 AI 模型,自称成本较 OpenAI 降低高达 89% — VentureBeat· 字节发了一张「永远最新」的模型卡片,我拿三个真实任务帮你测了测 — 王吉伟相关链接· 本期早报在线阅读:https://www.bestblogs.dev/explore/brief/2026-07-27· Jensen Huang:打造 NVIDIA 的创始人心法 [视频]:https://www.bestblogs.dev/video/cea291fb0· Anthropic 的 Diane Penn:如何把前沿模型做成产品 [视频]:https://www.bestblogs.dev/video/085fbfbd6· 究竟什么是 LLM-as-a-Judge?2026 年前沿技术实战指南:https://www.bestblogs.dev/article/20cb8c9352· 规模化训练的真实难题:合成数据与预训练的工程现实 [视频]:https://www.bestblogs.dev/video/70c245059· AI 拿走了 98%的工作,那属于你的、谁都替不了的 2%到底是什么?:https://www.bestblogs.dev/article/ecb2009752· Nanbeige4.2-3B:探索通用 Agent 小模型:https://www.bestblogs.dev/article/1873a6fa14· 腾讯开源三大具身基座模型,首席科学家张正友详解「三层脑」如何破解机器人反应慢:https://www.bestblogs.dev/article/f834198ca4· 3 万小时触觉数据补齐具身智能「手感」!新智具身&复旦报告三连发:https://www.bestblogs.dev/article/7aeb4a9ce0· Ruff v0.16.0:默认启用规则从 59 条增至 413 条:https://www.bestblogs.dev/article/30d667cf26· Meta 开源 Brain2Qwerty v2:非侵入式脑机接口语句解码准确率达到 61%:https://www.bestblogs.dev/article/cadf54b18b· 用评估驱动开发打造心理健康 AI 教练 [视频]:https://www.bestblogs.dev/video/a1850946b· 当 RAM 成本过高时如何优化向量搜索:磁盘 vs 内存 ANN 索引:https://www.bestblogs.dev/article/170fa7aa3d· 快一点!再快一点!快到世界能实时生成|和生数科技张金涛聊:Vidu S1、推理加速、实时交互视频:https://www.bestblogs.dev/article/61f0b01bb9· 微软发布全新自研 AI 模型,自称成本较 OpenAI 降低高达 89%:https://www.bestblogs.dev/article/720ea24dc0· 字节发了一张「永远最新」的模型卡片,我拿三个真实任务帮你测了测:https://www.bestblogs.dev/article/a5451f9ba2关于 BestBlogsBestBlogs 是 AI 驱动的私人阅读助手,帮助你发现真正适合你的高质量内容,关注你感兴趣的来源和主题,每天生成一份更适合自己的「我的早报」,欢迎体验和关注我们。前往小宇宙评论区与主播互动
Embed this episode
Ready to play
EP130 · NVIDIA 创始人心法、前沿模型产品化、LLM 评测 · 07-27 早报
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.