AITV.cz

Video • 58 min

20. 07. 2026

AI ta Krajta #59 | Jak kódovat s AI agenty? Claude 3.5, testování a historicky PRVNÍ LIVESTREAM

Náš první stream byl technicky trochu punk, ale ty informace o Číně a AI agentech byly moc dobré na to, aby zůstaly v šuplíku. Omluvte prosím horší kvalitu záznamu – věříme, že obsah vám to bohatě vynahradí! 🔥 Dnešní díl jsme odpálili (po drobných technických peripetiích) pěkně zostra. Rozebrali jsme velký technologický třesk v Číně, kde pod tlakem banů vzniká fascinující ekosystém nezávislý na NVIDIA, a podívali jsme se na to, jak efektivně ohýbat nejnovější modely od Anthropicu a OpenAI, aby dělaly přesně to, co chcete. Co se v dnešním streamu dozvíte? - Čínská odveta NVIDIA: Jak 7 čínských společností (včetně Huawei a Alibaby) buduje vlastní hardware a hlavně sjednocené, hardwarově nezávislé API jako alternativu ke CUDA. Dočkáme se grafických karet z Číny? - Claude 3.5 Sonnet vs. Opus: Který model zvolit pro reasoning a který pro čistý coding? Probrali jsme benchmarky, cenu i efektivitu delegování úkolů. - AI Coding & UI Design: Proč je GPT na UI „debilní“ a jaké triky (design systémy, striktní guardraily) použít, abyste z AI dostali použitelný výsledek. - Testování pod taktovkou AI: Best practices pro generování automatických testů. Proč u agentů dává TDD (Test-Driven Development) mnohem větší smysl než u lidí? - Bezpečnost a izolace: Kdy AI agenta pustit do shellu a proč je dobré ho izolovat ve vlastní VM (aby vám třeba „omylem“ neukončil důležité procesy na portech). - Budoucnost „Evals“: Proč se testování modelů a jejich výstupů stává novou standardní disciplínou softwarového vývoje. Děkujeme sponzorům: 🚀 Promptbook: https://ptbk.io 🤖 AI supervize: https://ptbk.io/ai-supervize Sítě, kde nás můžete sledovat: ➡️ LinkedIn: https://www.linkedin.com/company/aitakrajta/ ➡️ Spotify: https://open.spotify.com/show/31vLTHTV4vlCBeHpnbMKlK?si=1e51d95b9d3f46dd&nd=1&dlsi=3fe3c4775b9c4c25 ➡️ Apple Podcasts: https://podcasts.apple.com/cz/podcast/ai-ta-krajta/id1813389353 #AI #NVIDIA #Coding #Claude35 #SoftwareEngineering #TechTrends #ChinaTech #AIDevelopment #Testing #AItaKrajta 00:00 - Úvod a technické peripetie livestreamu 00:43 - Čínská odpověď na ban NVIDIA: Vlastní hardware a ekosystém 02:22 - Sjednocený čínský standard: Hardwarově nezávislá alternativa ke CUDA 04:45 - Claude 3.5 Sonnet vs. Opus: Srovnání výkonu a ceny 06:40 - Úrovně reasoningu: Kdy chtít po AI hluboké zamyšlení? 08:25 - Strategická delegace úkolů mezi AI agenty 09:40 - OpenRouter Fusion: Kombinování modelů pro dosažení kvality "Fable" 10:48 - AI v UI designu: Proč GPT selhává a jak mu pomoci 13:10 - Finta se souborem agentreport.md pro čistší výstupy 14:21 - Best practices pro automatizované testování s AI (Unit vs. E2E) 17:25 - TDD pro agenty: Proč psát testy před samotnou implementací 19:15 - AI Roadmapy: Propojení Slacku, analytiky a Sentry do jednoho celku 21:50 - Problém s "přifeaturováním" a smysluplnost vývoje 22:50 - Jak udržet kvalitu codebase a nastavit AI guardrails 25:35 - Riziko duplikace špatných vzorců v kódu (Pattern matching) 27:50 - Bezpečnost a izolace: Pustit AI agenty k shellu a do VM? 30:30 - Schopnosti Open Source modelů vs. GPT-4o a Claude 31:48 - Budoucnost "Evals" v testování softwaru 32:40 - Závěr: Hodnocení punkového streamu a plány do budoucna

Zdroj

AI ta Krajta

Další doporučený obsah