Artwork

Nội dung được cung cấp bởi Hugo Bowne-Anderson. Tất cả nội dung podcast bao gồm các tập, đồ họa và mô tả podcast đều được Hugo Bowne-Anderson hoặc đối tác nền tảng podcast của họ tải lên và cung cấp trực tiếp. Nếu bạn cho rằng ai đó đang sử dụng tác phẩm có bản quyền của bạn mà không có sự cho phép của bạn, bạn có thể làm theo quy trình được nêu ở đây https://vi.player.fm/legal.
Player FM - Ứng dụng Podcast
Chuyển sang chế độ ngoại tuyến với ứng dụng Player FM !

Episode 63: Why Gemini 3 Will Change How You Build AI Agents with Ravin Kumar (Google DeepMind)

1:00:12
 
Chia sẻ
 

Manage episode 520612127 series 3317544
Nội dung được cung cấp bởi Hugo Bowne-Anderson. Tất cả nội dung podcast bao gồm các tập, đồ họa và mô tả podcast đều được Hugo Bowne-Anderson hoặc đối tác nền tảng podcast của họ tải lên và cung cấp trực tiếp. Nếu bạn cho rằng ai đó đang sử dụng tác phẩm có bản quyền của bạn mà không có sự cho phép của bạn, bạn có thể làm theo quy trình được nêu ở đây https://vi.player.fm/legal.

Gemini 3 is a few days old and the massive leap in performance and model reasoning has big implications for builders: as models begin to self-heal, builders are literally tearing out the functionality they built just months ago... ripping out the defensive coding and reshipping their agent harnesses entirely.

Ravin Kumar (Google DeepMind) joins Hugo to breaks down exactly why the rapid evolution of models like Gemini 3 is changing how we build software. They detail the shift from simple tool calling to building reliable "Agent Harnesses", explore the architectural tradeoffs between deterministic workflows and high-agency systems, the nuance of preventing context rot in massive windows, and why proper evaluation infrastructure is the only way to manage the chaos of autonomous loops.

They talk through:

  • The implications of models that can "self-heal" and fix their own code
  • The two cultures of agents: LLM workflows with a few tools versus when you should unleash high-agency, autonomous systems.
  • Inside NotebookLM: moving from prototypes to viral production features like Audio Overviews
  • Why Needle in a Haystack benchmarks often fail to predict real-world performance
  • How to build agent harnesses that turn model capabilities into product velocity
  • The shift from measuring latency to managing time-to-compute for reasoning tasks

LINKS

Join the final cohort of our Building AI Applications course starting Jan 12, 2026: https://maven.com/hugo-stefan/building-ai-apps-ds-and-swe-from-first-principles?promoCode=vgrav

  continue reading

64 tập

Artwork
iconChia sẻ
 
Manage episode 520612127 series 3317544
Nội dung được cung cấp bởi Hugo Bowne-Anderson. Tất cả nội dung podcast bao gồm các tập, đồ họa và mô tả podcast đều được Hugo Bowne-Anderson hoặc đối tác nền tảng podcast của họ tải lên và cung cấp trực tiếp. Nếu bạn cho rằng ai đó đang sử dụng tác phẩm có bản quyền của bạn mà không có sự cho phép của bạn, bạn có thể làm theo quy trình được nêu ở đây https://vi.player.fm/legal.

Gemini 3 is a few days old and the massive leap in performance and model reasoning has big implications for builders: as models begin to self-heal, builders are literally tearing out the functionality they built just months ago... ripping out the defensive coding and reshipping their agent harnesses entirely.

Ravin Kumar (Google DeepMind) joins Hugo to breaks down exactly why the rapid evolution of models like Gemini 3 is changing how we build software. They detail the shift from simple tool calling to building reliable "Agent Harnesses", explore the architectural tradeoffs between deterministic workflows and high-agency systems, the nuance of preventing context rot in massive windows, and why proper evaluation infrastructure is the only way to manage the chaos of autonomous loops.

They talk through:

  • The implications of models that can "self-heal" and fix their own code
  • The two cultures of agents: LLM workflows with a few tools versus when you should unleash high-agency, autonomous systems.
  • Inside NotebookLM: moving from prototypes to viral production features like Audio Overviews
  • Why Needle in a Haystack benchmarks often fail to predict real-world performance
  • How to build agent harnesses that turn model capabilities into product velocity
  • The shift from measuring latency to managing time-to-compute for reasoning tasks

LINKS

Join the final cohort of our Building AI Applications course starting Jan 12, 2026: https://maven.com/hugo-stefan/building-ai-apps-ds-and-swe-from-first-principles?promoCode=vgrav

  continue reading

64 tập

Kaikki jaksot

×
 
Loading …

Chào mừng bạn đến với Player FM!

Player FM đang quét trang web để tìm các podcast chất lượng cao cho bạn thưởng thức ngay bây giờ. Đây là ứng dụng podcast tốt nhất và hoạt động trên Android, iPhone và web. Đăng ký để đồng bộ các theo dõi trên tất cả thiết bị.

 

Hướng dẫn sử dụng nhanh

Nghe chương trình này trong khi bạn khám phá
Nghe