Members-Only
Recent Talks & Demos are for members only
You must be an AI Tinkerers active member to view these talks and demos.
Building High-Performance Search Agents: Local Inference with DuckDuckGo and Google Search Integration
Learn to build high-performance search agents locally with DuckDuckGo and Google integration. Discover techniques for large context windows, memory optimization, and achieving lower latency.
Demostraré cómo crear agentes de búsqueda de alto rendimiento con inferencia LLM local usando llama-cpp-agents. Esta sesión de programación en vivo mostrará cómo implementar integraciones de búsqueda de DuckDuckGo y Google, optimizar la gestión de memoria para ventanas de contexto grandes (32 000 tokens) y lograr una latencia un 60 % menor que las alternativas en la nube. Verá técnicas prácticas para el uso eficiente de tokens, la aceleración de GPU con flash attention y la gestión de citas de fuentes. La demostración incluirá métricas de rendimiento en tiempo real que comparan ambos motores de búsqueda en los modelos open source
Hugging Face Space hosts a DuckDuckGo web search chat agent.
Local LLM web search agent via Gradio/llama.cpp.
Compose Email
Loading recent emails...