DEV Community

#llm

Posts

đź‘‹ Sign in for the ability to sort posts by relevant, latest, or top.
Running Local AI on Linux With GPU: Ollama + Open WebUI + Gemma

Running Local AI on Linux With GPU: Ollama + Open WebUI + Gemma

26
Comments 1
4 min read
Shrinking Giants: A Word on Floating-Point Precision in LLM Domain for Faster, Cheaper Models

Shrinking Giants: A Word on Floating-Point Precision in LLM Domain for Faster, Cheaper Models

1
Comments 2
8 min read
Why RAG and Agent Systems Are Unstable — A Minimal Deterministic Planner POC

Why RAG and Agent Systems Are Unstable — A Minimal Deterministic Planner POC

Comments 1
2 min read
Building with LLMs at Scale: Part 3 - Higher-Level Abstractions

Building with LLMs at Scale: Part 3 - Higher-Level Abstractions

Comments
9 min read
Building with LLMs at Scale: Part 2 - Ergonomics and Observability

Building with LLMs at Scale: Part 2 - Ergonomics and Observability

Comments
6 min read
Prompt Tracker: Turn Your Coding Sessions into a Star Wars Opening Crawl

Prompt Tracker: Turn Your Coding Sessions into a Star Wars Opening Crawl

Comments
8 min read
I Let an LLM Write JavaScript Inside My AI Runtime. Here’s What Happened

I Let an LLM Write JavaScript Inside My AI Runtime. Here’s What Happened

6
Comments 1
5 min read
TOON: The Token Ninja

TOON: The Token Ninja

1
Comments
3 min read
SCAR: A High-Trust Operating System for AI Coding Assistants (Stop Package Hallucinations in Your Repo)

SCAR: A High-Trust Operating System for AI Coding Assistants (Stop Package Hallucinations in Your Repo)

Comments
2 min read
From Brilliant Interns to Reliable Experts: Why Enterprises Are Betting Big on RAG Systems

From Brilliant Interns to Reliable Experts: Why Enterprises Are Betting Big on RAG Systems

Comments
5 min read
Observations from Finetuning Gemma Model on Strix Halo (Fedora 43)

Observations from Finetuning Gemma Model on Strix Halo (Fedora 43)

Comments
3 min read
đź§° Meet LM-Kit Tool Calling for Local Agents

đź§° Meet LM-Kit Tool Calling for Local Agents

Comments
12 min read
RAG - The Smart Way to Improve AI Answers

RAG - The Smart Way to Improve AI Answers

3
Comments
5 min read
Deterministic RAG: A Drop-in Replacement for GraphRAG’s Unstable Planning

Deterministic RAG: A Drop-in Replacement for GraphRAG’s Unstable Planning

Comments
3 min read
Stop Wasting LLM Tokens: Introducing CTON (Compact Token-Oriented Notation)

Stop Wasting LLM Tokens: Introducing CTON (Compact Token-Oriented Notation)

7
Comments 1
3 min read
đź‘‹ Sign in for the ability to sort posts by relevant, latest, or top.