Andrew Ng lancou o OpenWorker em 23 de julho, um agente de desktop com licenca MIT agora em beta aberto cujo enquadramento marca uma ruptura pequena mas real. Voce nao escreve um comando para ele, voce lhe da um resultado: um documento acabado, uma resposta que contem os numeros reais, uma agenda atualizada, uma caixa de entrada triada. Ele quebra o resultado em etapas, trabalha sobre arquivos locais e aplicativos conectados, e volta a perguntar antes de qualquer acao consequente. Ng o chama de colega de trabalho e nao de chatbot, e o produto foi construido para que isso seja mais que um slogan.
Ele e local primeiro em sentido estrito. O laco do agente, as conversas, os tokens dos conectores e as chaves de API dos modelos vivem todos na maquina do usuario. A pilha e uma casca de desktop com Tauri 2 e React 18 sobre um servidor Python FastAPI ouvindo em 127.0.0.1:8765, com turnos limitados a 12 iteracoes. Um roteador de modelos agnostico construido sobre o aisuite oferece cerca de 30 modelos selecionados que voce dirige com suas proprias chaves de API, ou modelos totalmente locais via Ollama. Cerca de 25 conectores vem junto, entre eles GitHub, Slack, Jira, Notion, Linear e HubSpot, alem de acesso ao terminal e aos arquivos locais.
A parte que merece estudo e o modelo de permissoes. Cada chamada de ferramenta e classificada em uma de quatro classes de risco antes de executar: read, sem efeitos colaterais, write_local, que altera o espaco de trabalho e fica restrita a um caminho, exec, que roda comandos, e external, cujos efeitos saem da maquina. Cinco modos se apoiam em cima disso. Discuss e plan sao somente leitura, interactive e o padrao e pede confirmacao antes de escritas e chamadas externas, auto permite tudo dentro do limite de caminho, e custom aprova automaticamente uma lista branca definida pelo usuario. Comandos de shell sempre exigem aprovacao, seja qual for o modo.
A melhor decisao de projeto e o que o modo sem supervisao nao faz. Ele nao aumenta a autonomia do agente. Ele redireciona as aprovacoes para uma caixa de entrada e suspende a sessao ate que um humano responda. A maioria dos agentes de desktop trata sem supervisao como sinonimo de confiavel, o que converte silenciosamente ninguem esta olhando em voce pode fazer mais. Manter essas duas ideias separadas e quase toda a diferenca entre um agente que da para deixar rodando e um que nao deveria.
E isso que faz dele mais que mais uma entrada em uma categoria lotada. Os agentes de desktop vem sendo lancados ha um ano com historias de seguranca que se resumem a uma caixa de confirmacao parafusada na interface. Tipar o risco na camada de ferramentas, antes que a chamada rode, e estrutural e nao cosmetico, e uma licenca MIT significa que o padrao pode ser lido e copiado em vez de admirado de fora. Vindo de alguem cujo alcance sempre passou pelo ensino, esse provavelmente e o ponto.
