Sebastian Raschka
Read post

Using Local Coding Agents

A comprehensive tutorial on setting up a fully local coding agent stack using open-weight LLMs as an alternative to proprietary services like Claude Code and Codex. Covers installing Ollama to serve models locally (primarily Qwen3.6 35B-A3B), connecting it to three harnesses (Qwen-Code, Codex CLI, and Claude Code), performing speed and benchmark assessments, auditing agent codebases for security and telemetry risks, and configuring privacy settings. Includes token usage comparisons across harnesses (Claude Code uses far more input tokens), a cross-machine SSH tunnel setup for running the model on a separate DGX Spark while coding on a Mac, and benchmark results showing Qwen3.6 and North Mini Code outperform smaller models like Gemma 4 E2B for agentic tool-use tasks.

    #ai-agents#claude-code#ollama#local-ai#qwen
Jun 27•32m read time•From magazine.sebastianraschka.com
Post cover image
Table of contents
1. Intro2. Coding Agent Harness Overview3. Local LLM Setup4. Simple Speed Performance Assessment5. Simple Benchmark Performance Assessment6. Agent Code Base Audit7. Qwen-Code Setup8. Agent Capability Assessment9. Codex Setup10. Claude Code Setup11. Mac <-> DGX12. What about OpenClaw and Hermes?13. ConclusionFurther Resources
1.3K Impressions
Sebastian Raschka's image
Sebastian Raschka

Sebastian Raschka's Blog offers insights, tutorials, and research updates on machine learning, deep ...

176 Followers

•

1.3K Upvotes

Would you recommend this post?

Copy link
WhatsApp
Facebook
X
New Squad
  • © 2026 Daily Dev Ltd.
  • Guidelines
  • Explore
  • Tags
  • Sources
  • Squads
  • Leaderboard