<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: lumine8</title>
    <description>The latest articles on DEV Community by lumine8 (@lumine8).</description>
    <link>https://dev.to/lumine8</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F4114891%2F5a15b973-260c-444a-83b7-16bbe62faf4d.jpg</url>
      <title>DEV Community: lumine8</title>
      <link>https://dev.to/lumine8</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/lumine8"/>
    <language>en</language>
    <item>
      <title>Your AI Agent Has No Memory. I Built MouseBase to Fix That</title>
      <dc:creator>lumine8</dc:creator>
      <pubDate>Tue, 08 Sep 2026 04:54:31 +0000</pubDate>
      <link>https://dev.to/lumine8/your-ai-agent-has-no-memory-i-built-mousebase-to-fix-that-1joo</link>
      <guid>https://dev.to/lumine8/your-ai-agent-has-no-memory-i-built-mousebase-to-fix-that-1joo</guid>
      <description>&lt;p&gt;We have gotten surprisingly good at building AI agents that can reason, call tools, browse the web, write code, and interact with users.&lt;/p&gt;

&lt;p&gt;But there is still a basic problem:&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Most AI agents forget.&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;A conversation ends, the context window resets, and the agent starts over.&lt;/p&gt;

&lt;p&gt;You can build your own memory system, but then you quickly end up maintaining embeddings, vector search, metadata filters, storage, cleanup policies, APIs, authentication, rate limiting, and an SDK.&lt;/p&gt;

&lt;p&gt;I wanted the memory part to feel more like a normal infrastructure primitive.&lt;/p&gt;

&lt;p&gt;So I built &lt;strong&gt;MouseBase&lt;/strong&gt;.&lt;/p&gt;

&lt;p&gt;GitHub: &lt;a href="https://github.com/Lumine8/MouseBase-AI/" rel="noopener noreferrer"&gt;https://github.com/Lumine8/MouseBase-AI/&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;Website: &lt;a href="https://mousebase.dev" rel="noopener noreferrer"&gt;https://mousebase.dev&lt;/a&gt;&lt;/p&gt;

&lt;h2&gt;
  
  
  What is MouseBase?
&lt;/h2&gt;

&lt;p&gt;MouseBase is persistent memory infrastructure for AI applications and agents.&lt;/p&gt;

&lt;p&gt;The basic idea is simple:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Your AI application
        |
        v
     MouseBase
        |
        +--&amp;gt; Store memories
        |
        +--&amp;gt; Search memories
        |
        +--&amp;gt; Manage memory lifecycle
        |
        +--&amp;gt; Retrieve relevant context
        |
        v
   PostgreSQL + pgvector
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Instead of trying to cram an entire conversation history into every prompt, your application can store useful information and retrieve the relevant pieces when needed.&lt;/p&gt;

&lt;p&gt;For example:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;mousebase&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;MouseBase&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nc"&gt;MouseBase&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;api_key&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;mb_live_...&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;remember&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;content&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;The user prefers dark mode in their IDE.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;metadata&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;source&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;preferences&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user_id&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;123&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;
    &lt;span class="p"&gt;}&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="n"&gt;results&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;search&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;What theme does the user prefer?&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;result&lt;/span&gt; &lt;span class="ow"&gt;in&lt;/span&gt; &lt;span class="n"&gt;results&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;results&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;
    &lt;span class="nf"&gt;print&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;result&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;content&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;The agent does not need to remember everything.&lt;/p&gt;

&lt;p&gt;It only needs access to the &lt;strong&gt;right memory at the right time&lt;/strong&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Why not just use a vector database?
&lt;/h2&gt;

&lt;p&gt;This was one of the questions I kept coming back to while building MouseBase.&lt;/p&gt;

&lt;p&gt;You can absolutely store embeddings in a vector database yourself.&lt;/p&gt;

&lt;p&gt;But AI memory is not only a vector-search problem.&lt;/p&gt;

&lt;p&gt;A real memory system also needs things like:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;memory lifecycle management&lt;/li&gt;
&lt;li&gt;metadata&lt;/li&gt;
&lt;li&gt;project isolation&lt;/li&gt;
&lt;li&gt;authentication&lt;/li&gt;
&lt;li&gt;rate limits&lt;/li&gt;
&lt;li&gt;APIs&lt;/li&gt;
&lt;li&gt;SDKs&lt;/li&gt;
&lt;li&gt;expiration&lt;/li&gt;
&lt;li&gt;archival&lt;/li&gt;
&lt;li&gt;recovery&lt;/li&gt;
&lt;li&gt;usage tracking&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;That means a lot of application code ends up surrounding the vector database.&lt;/p&gt;

&lt;p&gt;MouseBase tries to package those pieces together.&lt;/p&gt;

&lt;p&gt;The goal is not:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;"Here is a database with vectors."&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;The goal is:&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;"Here is an API your AI application can use as its memory."&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Hybrid search instead of semantic search alone
&lt;/h2&gt;

&lt;p&gt;One of the design decisions I made was not to rely exclusively on embeddings.&lt;/p&gt;

&lt;p&gt;MouseBase uses a hybrid ranking approach that combines:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Signal&lt;/th&gt;
&lt;th&gt;Weight&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Semantic similarity&lt;/td&gt;
&lt;td&gt;60%&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Keyword matching&lt;/td&gt;
&lt;td&gt;25%&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Metadata matching&lt;/td&gt;
&lt;td&gt;10%&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Recency&lt;/td&gt;
&lt;td&gt;5%&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;Semantic similarity is useful because the query:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;"What UI preferences does this user have?"
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;should be able to find:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;"The user prefers dark mode."
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;even though the words don't exactly match.&lt;/p&gt;

&lt;p&gt;But semantic similarity is not always enough.&lt;/p&gt;

&lt;p&gt;Sometimes the exact keyword matters.&lt;/p&gt;

&lt;p&gt;Sometimes metadata matters.&lt;/p&gt;

&lt;p&gt;And sometimes a recent memory should be preferred over something that happened months ago.&lt;/p&gt;

&lt;p&gt;That is why MouseBase combines multiple signals rather than treating vector similarity as the entire retrieval system.&lt;/p&gt;

&lt;h2&gt;
  
  
  Memories need a lifecycle
&lt;/h2&gt;

&lt;p&gt;Another thing that becomes obvious once you build an actual memory system is that &lt;strong&gt;not every memory should live forever&lt;/strong&gt;.&lt;/p&gt;

&lt;p&gt;Some information should remain active.&lt;/p&gt;

&lt;p&gt;Some information should be archived.&lt;/p&gt;

&lt;p&gt;Some information should eventually disappear.&lt;/p&gt;

&lt;p&gt;MouseBase currently provides three lifecycle states:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Active
  |
  +--&amp;gt; searchable
  |
  v
Archived
  |
  +--&amp;gt; preserved but excluded from normal search
  |
  v
Deleted
  |
  +--&amp;gt; soft deleted / hidden from normal queries
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;You can also attach an expiration time to a memory.&lt;/p&gt;

&lt;p&gt;For example:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;datetime&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;datetime&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;timedelta&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;timezone&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;remember&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="n"&gt;content&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Temporary onboarding note&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
    &lt;span class="n"&gt;expires_at&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
        &lt;span class="n"&gt;datetime&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;now&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;timezone&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;utc&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt; &lt;span class="o"&gt;+&lt;/span&gt;
        &lt;span class="nf"&gt;timedelta&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;days&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="mi"&gt;30&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
    &lt;span class="p"&gt;).&lt;/span&gt;&lt;span class="nf"&gt;isoformat&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;This is useful for information that should not become permanent user memory.&lt;/p&gt;

&lt;h2&gt;
  
  
  Projects keep memory isolated
&lt;/h2&gt;

&lt;p&gt;Applications usually have more than one memory space.&lt;/p&gt;

&lt;p&gt;You might have:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Project: Customer Support Agent
Project: Personal Assistant
Project: Internal Research Agent
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;MouseBase scopes memories to projects so different applications can maintain separate memory stores and API keys.&lt;/p&gt;

&lt;p&gt;That makes the model much closer to how developers actually build software.&lt;/p&gt;

&lt;h2&gt;
  
  
  It is not tied to one LLM
&lt;/h2&gt;

&lt;p&gt;Another design goal was to avoid making memory synonymous with a particular model provider.&lt;/p&gt;

&lt;p&gt;Your application can use OpenAI, Gemini, Anthropic, open-source models, or something else.&lt;/p&gt;

&lt;p&gt;MouseBase sits underneath the application:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;               +----------------+
               |   Your Agent   |
               +-------+--------+
                       |
                       v
               +---------------+
               |   MouseBase   |
               +-------+-------+
                       |
             +---------+---------+
             |                   |
             v                   v
        Vector Search       Metadata/Search
             |
             v
        PostgreSQL
        + pgvector
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;The memory layer does not need to know which LLM generated the response.&lt;/p&gt;

&lt;p&gt;It simply stores and retrieves useful information.&lt;/p&gt;

&lt;h2&gt;
  
  
  Developer experience matters
&lt;/h2&gt;

&lt;p&gt;Infrastructure is only useful if developers can actually integrate it.&lt;/p&gt;

&lt;p&gt;MouseBase currently provides SDKs for Python and JavaScript/TypeScript.&lt;/p&gt;

&lt;p&gt;Python:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;pip &lt;span class="nb"&gt;install &lt;/span&gt;mousebase
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;JavaScript:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npm &lt;span class="nb"&gt;install &lt;/span&gt;mousebase
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;Python:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;mousebase&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;MouseBase&lt;/span&gt;

&lt;span class="n"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nc"&gt;MouseBase&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;

&lt;span class="n"&gt;memory&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;remember&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;Alice prefers concise answers.&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;

&lt;span class="n"&gt;results&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;search&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
    &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;How should I respond to Alice?&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;
&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;TypeScript:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight typescript"&gt;&lt;code&gt;&lt;span class="k"&gt;import&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt; &lt;span class="nx"&gt;MouseBase&lt;/span&gt; &lt;span class="p"&gt;}&lt;/span&gt; &lt;span class="k"&gt;from&lt;/span&gt; &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;mousebase&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="p"&gt;;&lt;/span&gt;

&lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;client&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="k"&gt;new&lt;/span&gt; &lt;span class="nc"&gt;MouseBase&lt;/span&gt;&lt;span class="p"&gt;({&lt;/span&gt;
  &lt;span class="na"&gt;apiKey&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="nx"&gt;process&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;env&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nx"&gt;MOUSEBASE_API_KEY&lt;/span&gt;&lt;span class="o"&gt;!&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;

&lt;span class="k"&gt;await&lt;/span&gt; &lt;span class="nx"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;remember&lt;/span&gt;&lt;span class="p"&gt;({&lt;/span&gt;
  &lt;span class="na"&gt;content&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;Alice prefers concise answers&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;

&lt;span class="kd"&gt;const&lt;/span&gt; &lt;span class="nx"&gt;results&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="k"&gt;await&lt;/span&gt; &lt;span class="nx"&gt;client&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;search&lt;/span&gt;&lt;span class="p"&gt;({&lt;/span&gt;
  &lt;span class="na"&gt;query&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="dl"&gt;"&lt;/span&gt;&lt;span class="s2"&gt;How should I respond to Alice?&lt;/span&gt;&lt;span class="dl"&gt;"&lt;/span&gt;
&lt;span class="p"&gt;});&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;There is also an async Python client for applications built around &lt;code&gt;asyncio&lt;/code&gt; and frameworks such as FastAPI.&lt;/p&gt;

&lt;h2&gt;
  
  
  Framework integrations
&lt;/h2&gt;

&lt;p&gt;The next level is making memory feel native to the ecosystem developers already use.&lt;/p&gt;

&lt;p&gt;MouseBase includes integrations/adapters for tools such as:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;LangChain&lt;/li&gt;
&lt;li&gt;LlamaIndex&lt;/li&gt;
&lt;li&gt;OpenAI Agents&lt;/li&gt;
&lt;li&gt;MCP&lt;/li&gt;
&lt;li&gt;Next.js&lt;/li&gt;
&lt;li&gt;Express&lt;/li&gt;
&lt;li&gt;NestJS&lt;/li&gt;
&lt;li&gt;Cloudflare&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;The long-term idea is that adding persistent memory should be closer to adding a dependency than building an entire memory subsystem.&lt;/p&gt;

&lt;h2&gt;
  
  
  A simple agent architecture
&lt;/h2&gt;

&lt;p&gt;A basic AI agent with MouseBase can look like this:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="n"&gt;mousebase&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;MouseBase&lt;/span&gt;

&lt;span class="n"&gt;memory&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nc"&gt;MouseBase&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;

&lt;span class="k"&gt;def&lt;/span&gt; &lt;span class="nf"&gt;agent&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="n"&gt;user_id&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;):&lt;/span&gt;
    &lt;span class="c1"&gt;# Save the interaction
&lt;/span&gt;    &lt;span class="n"&gt;memory&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;remember&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
        &lt;span class="n"&gt;content&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="n"&gt;external_id&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="n"&gt;user_id&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="n"&gt;metadata&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="p"&gt;{&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;role&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
            &lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="s"&gt;user_id&lt;/span&gt;&lt;span class="sh"&gt;"&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt; &lt;span class="n"&gt;user_id&lt;/span&gt;
        &lt;span class="p"&gt;}&lt;/span&gt;
    &lt;span class="p"&gt;)&lt;/span&gt;

    &lt;span class="c1"&gt;# Retrieve relevant memories
&lt;/span&gt;    &lt;span class="n"&gt;results&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;memory&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;search&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;
        &lt;span class="n"&gt;message&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt;
        &lt;span class="n"&gt;top_k&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="mi"&gt;5&lt;/span&gt;
    &lt;span class="p"&gt;)&lt;/span&gt;

    &lt;span class="n"&gt;context&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="p"&gt;[&lt;/span&gt;
        &lt;span class="n"&gt;result&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;content&lt;/span&gt;
        &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;result&lt;/span&gt; &lt;span class="ow"&gt;in&lt;/span&gt; &lt;span class="n"&gt;results&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;results&lt;/span&gt;
    &lt;span class="p"&gt;]&lt;/span&gt;

    &lt;span class="c1"&gt;# Pass `context` to your LLM
&lt;/span&gt;    &lt;span class="k"&gt;return&lt;/span&gt; &lt;span class="n"&gt;context&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;The important part is not the final LLM call.&lt;/p&gt;

&lt;p&gt;It is the loop:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Observe
   ↓
Remember
   ↓
Retrieve
   ↓
Reason
   ↓
Act
   ↓
Remember
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;That loop starts to make an agent feel less like a stateless chatbot and more like a persistent software system.&lt;/p&gt;

&lt;h2&gt;
  
  
  Production concerns
&lt;/h2&gt;

&lt;p&gt;Building a demo is easy.&lt;/p&gt;

&lt;p&gt;Building infrastructure means caring about the less exciting parts too.&lt;/p&gt;

&lt;p&gt;MouseBase includes production-oriented components such as:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;JWT authentication&lt;/li&gt;
&lt;li&gt;refresh-token rotation&lt;/li&gt;
&lt;li&gt;API key authentication&lt;/li&gt;
&lt;li&gt;API key hashing and encryption&lt;/li&gt;
&lt;li&gt;key rotation&lt;/li&gt;
&lt;li&gt;rate limiting&lt;/li&gt;
&lt;li&gt;project-level isolation&lt;/li&gt;
&lt;li&gt;memory limits&lt;/li&gt;
&lt;li&gt;request IDs&lt;/li&gt;
&lt;li&gt;structured logging&lt;/li&gt;
&lt;li&gt;Sentry integration&lt;/li&gt;
&lt;li&gt;webhook processing&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;For example, API keys follow a format similar to:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;mb_live_&amp;lt;key_id&amp;gt;_&amp;lt;secret&amp;gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;and sensitive credentials are not stored as plaintext.&lt;/p&gt;

&lt;p&gt;There are also plan-level limits so memory and request usage can be controlled.&lt;/p&gt;

&lt;h2&gt;
  
  
  Self-hosting
&lt;/h2&gt;

&lt;p&gt;MouseBase is also designed to be self-hostable.&lt;/p&gt;

&lt;p&gt;The backend uses PostgreSQL with the &lt;code&gt;pgvector&lt;/code&gt; extension and supports embedding providers such as Gemini and OpenAI.&lt;/p&gt;

&lt;p&gt;A basic setup looks like:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;git clone https://github.com/Lumine8/MouseBase-AI.git

&lt;span class="nb"&gt;cd &lt;/span&gt;MouseBase-AI/backend

python &lt;span class="nt"&gt;-m&lt;/span&gt; venv .venv

&lt;span class="nb"&gt;source&lt;/span&gt; .venv/bin/activate

pip &lt;span class="nb"&gt;install&lt;/span&gt; &lt;span class="nt"&gt;-e&lt;/span&gt; &lt;span class="s2"&gt;".[dev]"&lt;/span&gt;

alembic upgrade &lt;span class="nb"&gt;head

&lt;/span&gt;uvicorn app.main:app &lt;span class="nt"&gt;--reload&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;You can then run the frontend separately.&lt;/p&gt;

&lt;p&gt;This is important to me because memory is often one of the most sensitive parts of an AI application.&lt;/p&gt;

&lt;p&gt;Some teams will prefer a hosted service.&lt;/p&gt;

&lt;p&gt;Others will want the entire memory stack inside their own infrastructure.&lt;/p&gt;

&lt;p&gt;Both should be possible.&lt;/p&gt;

&lt;h2&gt;
  
  
  What I am trying to build
&lt;/h2&gt;

&lt;p&gt;I don't think AI memory should remain an implementation detail that every developer rebuilds independently.&lt;/p&gt;

&lt;p&gt;Right now, a lot of AI applications have architectures that look roughly like:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;LLM
+
Prompt
+
Tools
+
RAG
+
Custom database
+
Custom embeddings
+
Custom memory code
+
Custom cleanup logic
+
Custom retrieval logic
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;I think memory deserves to become its own infrastructure layer.&lt;/p&gt;

&lt;p&gt;Something developers can call as easily as:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight python"&gt;&lt;code&gt;&lt;span class="n"&gt;memory&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;remember&lt;/span&gt;&lt;span class="p"&gt;(...)&lt;/span&gt;
&lt;span class="n"&gt;memory&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="nf"&gt;search&lt;/span&gt;&lt;span class="p"&gt;(...)&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;without having to rebuild the entire system underneath it.&lt;/p&gt;

&lt;h2&gt;
  
  
  The bigger idea
&lt;/h2&gt;

&lt;p&gt;AI agents are becoming increasingly capable.&lt;/p&gt;

&lt;p&gt;But capability without continuity has an interesting limitation.&lt;/p&gt;

&lt;p&gt;An agent can reason extremely well in the current moment and still know almost nothing about what happened yesterday.&lt;/p&gt;

&lt;p&gt;Persistent memory changes that.&lt;/p&gt;

&lt;p&gt;It allows an application to accumulate useful context over time:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;Day 1
User preference learned
        ↓
Day 7
Preference retrieved
        ↓
Day 30
New behavior remembered
        ↓
Day 100
Agent has accumulated useful context
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;That is the direction I think agent infrastructure is moving toward.&lt;/p&gt;

&lt;p&gt;Not just smarter models.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Systems that can remember.&lt;/strong&gt;&lt;/p&gt;

&lt;h2&gt;
  
  
  Try MouseBase
&lt;/h2&gt;

&lt;p&gt;The project is open on GitHub:&lt;/p&gt;

&lt;p&gt;&lt;a href="https://github.com/Lumine8/MouseBase-AI/" rel="noopener noreferrer"&gt;https://github.com/Lumine8/MouseBase-AI/&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;You can also check out the hosted service:&lt;/p&gt;

&lt;p&gt;&lt;a href="https://mousebase.dev" rel="noopener noreferrer"&gt;https://mousebase.dev&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;And install the SDK directly:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;pip &lt;span class="nb"&gt;install &lt;/span&gt;mousebase
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;or:&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;npm &lt;span class="nb"&gt;install &lt;/span&gt;mousebase
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;I am still building MouseBase, so feedback from developers working on agents, assistants, RAG systems, and long-running AI applications is especially useful.&lt;/p&gt;

&lt;p&gt;If persistent memory is something you've had to build yourself, I'd genuinely like to hear what your architecture looks like.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>api</category>
      <category>agents</category>
    </item>
  </channel>
</rss>
